ai-trend-notifier
← wiki

$ cat wiki/models/gemini-3-5-flash-lite.md

Gemini 3.5 Flash-Lite

modelupdated 2026-07-22created 2026-07-22

Spec

AttributeValue
DeveloperGoogle DeepMind
Released2026-07-21
Announced2026-07-21
Context window1,048,576 tokens (1M)
Pricing$0.30/M input · $2.50/M output
Licenseproprietary
AvailabilityGemini API, Google AI Studio, Vertex AI

Benchmarks

BenchmarkGemini 3.5 Flash-LiteGemini 3.1 Flash-Lite (predecessor)
Terminal-Bench 2.154%31%
GDM-MRCR v2 (long-context)72.2%60.1%
GDPval-AA v21140642
AA Intelligence Index+11 pts over predecessorbaseline
Time per task~halved vs. predecessorbaseline
Output speed350.2 t/sunknown

Use Cases

  • High-throughput, low-latency agentic pipelines (agentic search, document processing)
  • Cost-sensitive applications requiring millions of calls per day
  • Fast classification, routing, and summarization at scale

Key Differentiators

  • Cheapest production Gemini model: $0.30/$2.50 per 1M tokens
  • Speed: 350.2 t/s — significantly above the category median (~107 t/s)
  • Configurable thinking levels: supports fast and deep reasoning modes
  • Positioned as the high-throughput tier complementing Gemini 3.6 Flash

Related

Referenced by

Sources