$ cat wiki/models/gemini-3-5-flash.md
Gemini 3.5 Flash
modelupdated 2026-07-27created 2026-05-19
Spec
| Attribute | Value |
|---|---|
| Developer | Google DeepMind |
| Released | 2026-05-19 (Google I/O 2026 에서 GA) |
| Announced | 2026-05-19 (Google I/O 2026) |
| Context window | 입력 1,048,576 / 출력 65,536 토큰 |
| Pricing | $1.50 in / $9.00 out per 1M tokens ($0.15 캐시) |
| License | proprietary (API 전용, 가중치 미공개) |
| Availability | Gemini API, Google AI Studio, Google Antigravity, Gemini 앱, Google 검색의 AI Mode |
| Family | Gemini 3.5 |
| Modalities | 텍스트 + 이미지 + 오디오 + 비디오 → 텍스트 |
| Thinking | 동적 사고 (기본 활성) |
| Knowledge cutoff | 2026년 1월 |
| Speed | 다른 프런티어 모델보다 4배 빠름 (초당 출력 토큰 기준) |
Benchmarks
| Benchmark | Score | Context |
|---|---|---|
| Terminal-Bench 2.1 | 76.2% | 에이전틱 코딩 |
| MCP Atlas | 83.6% | MCP·도구 사용 |
| CharXiv Reasoning | 84.2% | 차트 추론 |
| GPQA Diamond | 90.4% | 박사급 과학 |
| MMMU-Pro | 81.2% | 멀티모달 이해 |
| 코딩·에이전틱 벤치마크 전 영역에서 Gemini 3.1 Pro 를 앞선다. |
Use Cases
핵심 포지셔닝: Flash 급 속도와 비용으로 수행하는 에이전틱·코딩 과제. "Flash 계열이 내놓은 가장 강력한 에이전틱·코딩 모델"이다.
- 다단계 에이전트 워크플로 (MCP Atlas 83.6%)
- 과학적 추론 (GPQA Diamond 90.4%)
- 코딩 과제 (Terminal-Bench 76.2%)
- 멀티모달 분석
Availability
Gemini API, Google AI Studio, Google Antigravity, Gemini 앱, Google 검색의 AI Mode.
Compared To
- Gemini 3.1 Pro: Gemini 3.5 Flash 가 더 낮은 비용과 4배 속도로 코딩·에이전틱·멀티모달 벤치마크에서 앞선다
- GPT-5.5 Instant: 둘 다 빠르고 비용 효율적인 프런티어 계층을 겨냥한다. Gemini 3.5 Flash 는 MCP Atlas 벤치마크를 명시하지만 GPT-5.5 Instant 는 에이전틱 벤치마크를 공개하지 않았다
- Claude Opus 4.7: Anthropic 플래그십 대 Google 의 Flash 계층 — 가격·성능 절충이 다르다
- Devstral 2: 공개 가중치 코딩 전문 모델(SWE-bench 72.2%) 대 Gemini 3.5 Flash 의 더 넓은 멀티모달·에이전틱 범위
Sources
- Google Blog launch
- llm-stats.com benchmarks
- Google I/O 2026 에서 발표 (2026-05-19) — Google DeepMind 참조
- Google — Gemini API pricing — 사양 수치 2026-07-27 확인