<aside>
📋 구글 공식 블로그 발표를 한국어로 정리했어요. 원문은 맨 아래 링크 모음에서 확인할 수 있습니다.
</aside>
한눈에 보기
- Gemini 3.6 Flash — 새 주력(워크호스) 모델. 같은 작업을 더 적은 토큰으로, 더 빠르고 저렴하게
- Gemini 3.5 Flash-Lite — 속도·가격 특화 경량 모델. 초당 350토큰, 구글 검색에 적용 중
- Gemini 3.5 Flash Cyber — 사이버보안 특화 모델. 정부·검증 파트너 대상 제한 시범
- 3.5 Pro는 이번 발표에서 제외 — 파트너 테스트 중, "준비되는 대로" 공개 예정

1. Gemini 3.6 Flash — 새 주력 모델
코딩, 지식 노동, 멀티모달(텍스트+이미지+영상) 작업을 두루 맡는 주력 모델입니다. 핵심은 토큰 효율 — 같은 질문에 답할 때 출력 토큰(모델이 내놓는 글자량)을 이전 3.5 Flash보다 17% 줄였습니다. API 비용은 토큰 수에 비례하므로 그대로 요금 절감으로 이어집니다.
- 코딩 벤치마크 DeepSWE: 작업당 출력 토큰 276K → 97K (최대 65% 절감)
- 에이전트 벤치마크(자사 세대 비교): DeepSWE 49%(이전 37%) · MLE-Bench 63.9%(49.7%) · 지식 노동 GDPVal-AA 1421(1349) · 컴퓨터 사용 OSWorld 83.0%(78.4%)
- 가격: 100만 토큰당 입력 $1.50 / 출력 $7.50

- 같은 작업을 3.5 Flash와 3.6 Flash가 나란히 수행하며 토큰 사용량 차이를 보여주는 공식 데모
https://storage.googleapis.com/gweb-uniblog-publish-prod/original_videos/token_efficiency.mp4

- 멀티 에이전트(여러 AI가 역할을 나눠 협업하는 방식)로 코드 마이그레이션을 수행하는 데모