$ diff gemini-3-5-flash-lite minimax-m3
Gemini 3.5 Flash-Lite vs MiniMax M3
값의 출처는 Gemini 3.5 Flash-Lite와 MiniMax M3 문서이며, 각 항목에 원 출처가 인용돼 있습니다. 이 페이지는 벤치마크 결과를 제시하지 않고 두 모델의 우열도 가리지 않습니다 — 공개된 사양 두 개를 나란히 놓을 뿐입니다. 랩이 공개하지 않은 값은 추측하지 않고 미기재로 표시합니다.
Google DeepMindGemini 3.5 Flash-Lite
- 컨텍스트
- 1.0M
- 가중치
- 비공개
- $/M 입력
- $0.3
- $/M 출력
- $2.5
- 컨텍스트
- 1M
- 가중치
- 공개
- $/M 입력
- —
- $/M 출력
- —
실제로 무엇이 다른가
- 컨텍스트 창
- Gemini 3.5 Flash-Lite가 1.0M, 상대는 1M — 한 번의 요청에 조금 더 넣을 수 있습니다.
- 가중치 공개
- MiniMax M3는 가중치를 공개합니다(Open-weight (HuggingFace)). Gemini 3.5 Flash-Lite는 API로만 제공됩니다. 이 차이는 자체 호스팅·망분리 환경 배포·파인튜닝 가능 여부를 성능 논의보다 먼저 결정합니다.
- 출시 시점
- Gemini 3.5 Flash-Lite가 MiniMax M3보다 50일 늦게 출시됐습니다 (2026-07-21 / 2026-06-01).
전체 스펙
| 항목 | Gemini 3.5 Flash-Lite | MiniMax M3 |
|---|---|---|
| 개발사 | Google DeepMind | MiniMax |
| 출시일 | 2026-07-21 | 2026-06-01 |
| 컨텍스트 창 | 1,048,576 tokens (1M) | 1,000,000 tokens (1M); min. 512K guaranteed |
| 가격 | $0.30/M input · $2.50/M output | Available via API; pricing on OpenRouter |
| 라이선스 | proprietary | Open-weight (HuggingFace) |
| 이용 경로 | Gemini API, Google AI Studio, Vertex AI | API (global, including English) + open-weight on HuggingFace |