ai-trend-notifierEN

$ diff gemini-3-5-flash-lite longcat-2-0

Gemini 3.5 Flash-Lite vs LongCat-2.0

값의 출처는 Gemini 3.5 Flash-Lite와 LongCat-2.0 문서이며, 각 항목에 원 출처가 인용돼 있습니다. 이 페이지는 벤치마크 결과를 제시하지 않고 두 모델의 우열도 가리지 않습니다 — 공개된 사양 두 개를 나란히 놓을 뿐입니다. 랩이 공개하지 않은 값은 추측하지 않고 미기재로 표시합니다.

실제로 무엇이 다른가

컨텍스트 창
Gemini 3.5 Flash-Lite가 1.0M, 상대는 1M — 한 번의 요청에 조금 더 넣을 수 있습니다.
출력 가격
LongCat-2.0가 $1.2/M, 상대는 $2.5/M — 출력 비용이 2.1배 저렴합니다. 에이전트 작업에서는 모델이 읽는 양보다 쓰는 양이 훨씬 많아 출력 요금이 청구액을 좌우합니다.
가중치 공개
LongCat-2.0는 가중치를 공개합니다(MIT (commercially permissive)). Gemini 3.5 Flash-Lite는 API로만 제공됩니다. 이 차이는 자체 호스팅·망분리 환경 배포·파인튜닝 가능 여부를 성능 논의보다 먼저 결정합니다.
출시 시점
Gemini 3.5 Flash-Lite가 LongCat-2.0보다 21일 늦게 출시됐습니다 (2026-07-21 / 2026-06-30).

전체 스펙

항목Gemini 3.5 Flash-LiteLongCat-2.0
개발사Google DeepMindMeituan
출시일2026-07-212026-06-30
컨텍스트 창1,048,576 tokens (1M)1 million tokens (LongCat Sparse Attention / LSA)
가격$0.30/M input · $2.50/M output$0.30/M input · $1.20/M output ($0.006/M cached input) — OpenRouter catalogue, read 2026-07-28. Open weights, so this is hosted-inference pricing rather than a licence fee.
라이선스proprietaryMIT (commercially permissive)
이용 경로Gemini API, Google AI Studio, Vertex AIOpen-sourced 2026-06-30; previously served on OpenRouter under the codename "Owl Alpha"

이 페이지가 만들어지는 방식

← 전체 비교 목록