2026년 7월 22일 · 4² AI 뉴스레터
딥마인드, 새로운 Gemini 모델 시리즈 발표
Google DeepMind
파이랩 정리
딥마인드의 새로운 Gemini 모델 시리즈 발표
딥마인드는 최근 Gemini 3.6 Flash, 3.5 Flash-Lite, 그리고 3.5 Flash Cyber 모델을 발표했습니다. 이 모델들은 대규모 AI 에이전트를 구축하기 위한 효율성, 지연 시간, 신뢰성을 제공합니다. 딥마인드의 제품 관리 수석 디렉터인 Tulsee Doshi는 이번 발표를 통해 개발자와 고객이 생산성 높은 AI 에이전트를 구축하는 데 필요한 높은 토큰 효율성, 낮은 지연 시간, 신뢰할 수 있는 성능을 제공한다고 설명했습니다.
Gemini 3.6 Flash
Gemini 3.6 Flash는 3.5 Flash 모델의 피드백을 바탕으로 개선된 모델로, 코딩 및 지식 작업에서 더 나은 성능을 제공합니다. 이 모델은 토큰 효율성을 크게 개선하여 3.5 Flash에 비해 출력 토큰 사용량을 17% 줄였으며, 몇몇 벤치마크에서는 최대 65%까지 감소시켰습니다. 또한, 3.6 Flash는 다중 단계 워크플로우를 수행하는 데 필요한 추론 단계와 도구 호출을 줄여 효율성을 높였습니다. 가격 면에서도 3.5 Flash보다 저렴하여, 에이전트 작업의 전체 비용을 절감할 수 있습니다.
3.6 Flash는 다양한 사용 사례에서 3.5 Flash보다 더 높은 정밀도를 제공하며, 불필요한 코드 수정과 실행 루프를 줄였습니다. 예를 들어, DeepSWE 벤치마크에서는 49%의 정밀도를 기록했으며, ML 연구에서도 63.9%의 개선된 성능을 보였습니다. 또한, OSWorld-Verified 벤치마크에서는 83.0%의 성능을 기록하며, 3.5 Flash보다 향상된 컴퓨터 사용 능력을 보여주었습니다.
이 모델은 다중 모드 작업에서도 뛰어난 성능을 발휘하며, 문서 파싱, 차트 및 데이터 분석, 보고서 작성 등에서 우수한 성과를 보였습니다. 3.6 Flash는 금융 데이터 및 전사본을 효율적이고 정확하게 분석할 수 있으며, 코드 마이그레이션을 더 낮은 지연 시간과 높은 품질로 수행할 수 있습니다. 또한, 3D 워크플로우를 위한 사진 텍스처 추출기를 개발하는 데 도움을 줄 수 있습니다.
3.6 Flash는 화학, 생물학, 방사선, 핵(CBRN) 및 사이버 공격 오용 방지에 대한 강화된 안전 장치를 갖추고 있으며, 유익한 사용을 위한 거부를 최소화하도록 훈련되었습니다.
Gemini 3.5 Flash-Lite
Gemini 3.5 Flash-Lite는 저지연 작업과 높은 처리량이 중요한 작업을 위해 설계된 모델입니다. 이 모델은 3.5 시리즈 중 가장 빠른 모델로, 초당 350개의 출력 토큰을 생성할 수 있습니다. 가격은 입력 토큰 100만 개당 $0.3, 출력 토큰 100만 개당 $2.5로 설정되어 있으며, 3.1 Flash-Lite보다 훨씬 더 나은 품질을 제공합니다.
3.5 Flash-Lite는 높은 볼륨의 작업을 더 낮은 지연 시간으로 실행할 수 있으며, 에이전트 시스템의 효율적인 확장을 가능하게 합니다. 이 모델은 다양한 사고 수준에서 3.1 Flash-Lite보다 뛰어난 성능을 발휘하며, 개발자는 작업량에 따라 저지연, 저비용 실행을 우선시하거나 다중 단계 하위 에이전트 작업을 처리하기 위해 높은 사고 수준을 사용할 수 있습니다.
3.5 Flash-Lite는 대규모 전자상거래 데이터셋에서 제품 기능을 추출하고 이를 종합할 수 있으며, 3.6 Flash와 협력하여 웹 디자인 개념을 즉시 생성할 수 있습니다. 또한, 영수증 번역 및 요약을 확장할 수 있는 다중 모드 이해력을 갖추고 있으며, 게임을 개발할 때 여러 옵션을 즉시 생성하고 반복할 수 있습니다.
Gemini 3.5 Flash Cyber
Gemini 3.5 Flash Cyber는 CodeMender 내에서 사이버 보안 취약점을 효율적으로 찾고 수정하는 데 중점을 둔 모델입니다. 이 모델은 3.5 Flash를 기반으로 하며, 사이버 보안 취약점을 더 낮은 비용으로 찾고 수정할 수 있도록 미세 조정되었습니다. CodeMender는 여러 3.5 Flash Cyber 에이전트를 사용하여 단일 보고서를 생성하며, CyberGym 벤치마크에서 경쟁력 있는 성능을 제공합니다.
이 모델은 정부 및 신뢰할 수 있는 파트너에게만 제한적으로 제공될 예정이며, 주요 취약점을 발견하고 수정하는 데 앞서 나갈 수 있도록 지원합니다.
사용 가능성 및 시작 방법
Gemini 3.6 Flash와 3.5 Flash-Lite는 현재 Google AI Studio와 Android Studio의 Gemini API를 통해 개발자에게 제공되고 있습니다. 또한, Gemini Enterprise Agent Platform과 Gemini Enterprise 앱을 통해 기업에서도 사용할 수 있으며, Gemini 앱을 통해 모든 사용자에게 제공됩니다. Google Search에서도 3.5 Flash-Lite가 출시되고 있습니다.
개발자 가이드를 통해 시작할 수 있으며, 피드백을 통해 향후 Gemini 모델을 개선하는 데 기여할 수 있습니다.
