$ diff gemini-3-5-flash-lite kimi-k3
Gemini 3.5 Flash-Lite vs Kimi K3
값의 출처는 Gemini 3.5 Flash-Lite와 Kimi K3 문서이며, 각 항목에 원 출처가 인용돼 있습니다. 이 페이지는 벤치마크 결과를 제시하지 않고 두 모델의 우열도 가리지 않습니다 — 공개된 사양 두 개를 나란히 놓을 뿐입니다. 랩이 공개하지 않은 값은 추측하지 않고 미기재로 표시합니다.
Google DeepMindGemini 3.5 Flash-Lite
- 컨텍스트
- 1.0M
- 가중치
- 비공개
- $/M 입력
- $0.3
- $/M 출력
- $2.5
- 컨텍스트
- 1M
- 가중치
- 공개
- $/M 입력
- $3
- $/M 출력
- $15
실제로 무엇이 다른가
- 컨텍스트 창
- Gemini 3.5 Flash-Lite가 1.0M, 상대는 1M — 한 번의 요청에 조금 더 넣을 수 있습니다.
- 입력 가격
- Gemini 3.5 Flash-Lite가 $0.3/M, 상대는 $3/M — 입력 비용이 10.0배 저렴합니다. 표준 요금 기준입니다. 두 랩 중 한쪽은 더 낮은 캐시 입력 요금도 제시하지만, 이는 프리픽스를 재사용할 때만 적용됩니다 — 아래 전체 스펙을 참고하세요.
- 출력 가격
- Gemini 3.5 Flash-Lite가 $2.5/M, 상대는 $15/M — 출력 비용이 6.0배 저렴합니다. 에이전트 작업에서는 모델이 읽는 양보다 쓰는 양이 훨씬 많아 출력 요금이 청구액을 좌우합니다.
- 가중치 공개
- Kimi K3는 가중치를 공개합니다(Modified MIT (commercial use permitted; weights publicly downloadable)). Gemini 3.5 Flash-Lite는 API로만 제공됩니다. 이 차이는 자체 호스팅·망분리 환경 배포·파인튜닝 가능 여부를 성능 논의보다 먼저 결정합니다.
- 출시 시점
- Gemini 3.5 Flash-Lite가 Kimi K3보다 5일 늦게 출시됐습니다 (2026-07-21 / 2026-07-16).
전체 스펙
| 항목 | Gemini 3.5 Flash-Lite | Kimi K3 |
|---|---|---|
| 개발사 | Google DeepMind | Moonshot AI |
| 출시일 | 2026-07-21 | 2026-07-16 |
| 컨텍스트 창 | 1,048,576 tokens (1M) | 1M tokens |
| 가격 | $0.30/M input · $2.50/M output | $0.30/M cache-hit input · $3.00/M cache-miss input · $15.00/M output |
| 라이선스 | proprietary | Modified MIT (commercial use permitted; weights publicly downloadable) |
| 이용 경로 | Gemini API, Google AI Studio, Vertex AI | Kimi Code, Kimi app, Kimi API; weights on Hugging Face (`moonshot-ai/kimi-k3`, released 2026-07-27) |