ai-trend-notifierEN
← wiki

$ cat wiki/models/gemini-3-5-flash.md

Gemini 3.5 Flash

modelupdated 2026-07-27created 2026-05-19

Spec

AttributeValue
DeveloperGoogle DeepMind
Released2026-05-19 (Google I/O 2026 에서 GA)
Announced2026-05-19 (Google I/O 2026)
Context window입력 1,048,576 / 출력 65,536 토큰
Pricing$1.50 in / $9.00 out per 1M tokens ($0.15 캐시)
Licenseproprietary (API 전용, 가중치 미공개)
AvailabilityGemini API, Google AI Studio, Google Antigravity, Gemini 앱, Google 검색의 AI Mode
FamilyGemini 3.5
Modalities텍스트 + 이미지 + 오디오 + 비디오 → 텍스트
Thinking동적 사고 (기본 활성)
Knowledge cutoff2026년 1월
Speed다른 프런티어 모델보다 4배 빠름 (초당 출력 토큰 기준)

Benchmarks

BenchmarkScoreContext
Terminal-Bench 2.176.2%에이전틱 코딩
MCP Atlas83.6%MCP·도구 사용
CharXiv Reasoning84.2%차트 추론
GPQA Diamond90.4%박사급 과학
MMMU-Pro81.2%멀티모달 이해
코딩·에이전틱 벤치마크 전 영역에서 Gemini 3.1 Pro 를 앞선다.

Use Cases

핵심 포지셔닝: Flash 급 속도와 비용으로 수행하는 에이전틱·코딩 과제. "Flash 계열이 내놓은 가장 강력한 에이전틱·코딩 모델"이다.

  • 다단계 에이전트 워크플로 (MCP Atlas 83.6%)
  • 과학적 추론 (GPQA Diamond 90.4%)
  • 코딩 과제 (Terminal-Bench 76.2%)
  • 멀티모달 분석

Availability

Gemini API, Google AI Studio, Google Antigravity, Gemini 앱, Google 검색의 AI Mode.

Compared To

  • Gemini 3.1 Pro: Gemini 3.5 Flash 가 더 낮은 비용과 4배 속도로 코딩·에이전틱·멀티모달 벤치마크에서 앞선다
  • GPT-5.5 Instant: 둘 다 빠르고 비용 효율적인 프런티어 계층을 겨냥한다. Gemini 3.5 Flash 는 MCP Atlas 벤치마크를 명시하지만 GPT-5.5 Instant 는 에이전틱 벤치마크를 공개하지 않았다
  • Claude Opus 4.7: Anthropic 플래그십 대 Google 의 Flash 계층 — 가격·성능 절충이 다르다
  • Devstral 2: 공개 가중치 코딩 전문 모델(SWE-bench 72.2%) 대 Gemini 3.5 Flash 의 더 넓은 멀티모달·에이전틱 범위

Sources

Referenced by

Sources