ai-trend-notifierEN
← wiki

$ cat wiki/models/gemini-3-5-flash-lite.md

Gemini 3.5 Flash-Lite

modelupdated 2026-07-22created 2026-07-22

Spec

AttributeValue
DeveloperGoogle DeepMind
Released2026-07-21
Announced2026-07-21
Context window1,048,576 토큰 (1M)
Pricing$0.30/M input · $2.50/M output
Licenseproprietary
AvailabilityGemini API, Google AI Studio, Vertex AI

Benchmarks

BenchmarkGemini 3.5 Flash-LiteGemini 3.1 Flash-Lite (이전 세대)
Terminal-Bench 2.154%31%
GDM-MRCR v2 (롱컨텍스트)72.2%60.1%
GDPval-AA v21140642
AA Intelligence Index이전 세대 대비 +11점기준
과제당 소요 시간이전 세대의 약 절반기준
출력 속도350.2 t/sunknown

Use Cases

  • 고처리량·저지연 에이전틱 파이프라인 (에이전틱 검색, 문서 처리)
  • 하루 수백만 호출이 필요한 비용 민감 애플리케이션
  • 대규모 고속 분류·라우팅·요약

Key Differentiators

  • 가장 싼 프로덕션 Gemini 모델: 100만 토큰당 $0.30/$2.50
  • 속도: 350.2 t/s — 범주 중앙값(약 107 t/s)을 크게 웃돈다
  • 조절 가능한 thinking 수준: 빠른 추론과 깊은 추론 모드를 지원한다
  • Gemini 3.6 Flash 를 보완하는 고처리량 계층으로 자리한다

Related

Referenced by

Sources