
구글 Gemini 3.6 Flash 공개 — 출력 토큰 17% 절감에 가격 인하
구글 딥마인드가 주력 모델 Gemini 3.6 Flash를 내놨습니다. 3.5 Flash보다 출력 토큰을 17% 덜 쓰면서 코딩(DeepSWE 37→49%)·컴퓨터 사용(OSWorld 78.4→83%) 벤치마크가 올랐고, 가격은 100만 토큰당 입력 $1.50 / 출력 $7.50($9에서 인하)으로 떨어졌습니다. 함께 나온 저가형 3.5 Flash-Lite($0.30/$2.50)와 정부·파트너용 보안 모델 3.5 Flash Cyber도 공개됐습니다. 지식 컷오프는 2025년 1월에서 2026년 3월로 앞당겨졌습니다.
💡💡 에이전트(agent)를 대량으로 돌릴수록 토큰 효율과 단가가 곧 운영비입니다. 기본 모델을 3.6 Flash로 바꾸는 것만으로 코딩 워크플로 비용이 내려갑니다.
- 누가
- Google DeepMind (Logan Kilpatrick, product lead)
- 무엇을
- Released a trio of Gemini models — 3.6 Flash (workhorse), 3.5 Flash-Lite (budget), 3.5 Flash Cyber (security) — with lower prices and 17% fewer output tokens
- 언제
- 2026-07-21T15:00:00Z
- 왜
- To deliver efficiency, latency and reliability for customers building AI agents at scale, and to close the cost gap while Gemini 3.5 Pro remains in partner testing
#gemini#llm#agent#cost
