ai-trend-notifierEN
← wiki

$ cat wiki/models/gemini-3-6-flash.md

Gemini 3.6 Flash

Spec

AttributeValue
DeveloperGoogle DeepMind
Released2026-07-21
Announced2026-07-21
Context window1,048,576 토큰 (1M)
Pricing$1.50/M input · $7.50/M output
Licenseproprietary
AvailabilityGemini API, Google AI Studio, Android Studio, Vertex AI, 소비자 Gemini 앱, Google 검색, GitHub Copilot

Benchmarks

BenchmarkGemini 3.6 FlashGemini 3.5 Flash
DeepSWE49%37%
SWE-Bench Pro58.7%55.1%
MLE Bench63.9%49.7%
GDPval-AA14211349
OSWorld-Verified (Computer Use)83%78.4%
AA Intelligence Index5050
과제당 소요 시간약 1.3분약 2.7분
과제당 출력 토큰약 17% 적음기준
출력 속도304 t/sunknown
지식 커트오프: 2026년 3월 (3.5 Flash 의 2025년 1월에서 앞당겨짐).

Use Cases

  • 에이전틱 워크로드: 도구 호출과 컴퓨터 사용이 있는 다단계 과제
  • 코딩과 소프트웨어 엔지니어링 (SWE-Bench Pro 58.7%)
  • 고처리량 문서·검색 처리
  • 장기 엔지니어링 벤치마크 (DeepSWE 49%, 이전 37%)
  • 기존 Gemini 3.5 Flash 배포의 무손실 업그레이드

Key Differentiators

  • 지능이 아니라 효율을 올린 설계: Artificial Analysis Intelligence Index 는 50 으로 그대로인데, 실제 에이전틱 과제는 2.7분이 아니라 1.3분에 끝난다 — 단계마다 더 잘 추론해서가 아니라 단계당 토큰을 덜 써서다. 에이전틱 워크로드의 비용을 실질적으로 낮춘다.
  • 지식 커트오프 전진: 2026년 3월 (3.5 Flash 의 2025년 1월보다 15개월 최신) — 에이전틱 검색의 시사 질의에 유의미하다.
  • 낮아진 출력 가격: $7.50/M ($9.00/M 에서 인하). 토큰 효율 개선과 겹쳐, 출력 비용이 지배적인 에이전틱 배포에는 이중 이득이다.
  • GitHub Copilot 통합: 출시 시점부터 Copilot 에서 쓸 수 있다 (Google 자체 표면과 함께).

Compared To

ModelSWE-Bench ProTime/taskPrice (in/out)Notes
Gemini 3.6 Flash58.7%1.3분$1.50/$7.50본 모델
Gemini 3.5 Flash55.1%2.7분$1.50/$9.00이전 세대
Claude Sonnet 563.2%unknown$2/$10Anthropic 중간 계층
Kimi K3unknownunknown$0.30/$3/$15중국 MoE
DeepSeek V480.6% (SWE-bench Verified)unknownunknown공개 가중치 SOTA

Related

Referenced by

Sources