$ cat wiki/models/inkling.md
Inkling
나란히 보기
스펙
| 속성 | 값 |
|---|---|
| Developer | Thinking Machines Lab |
| Released | 2026-07-15 |
| Announced | 2026-07-15 |
| Context window | 1M |
| Pricing | unknown |
| License | Apache 2.0 (오픈 웨이트) |
| Availability | Hugging Face (BF16 및 NVFP4), Tinker (파인튜닝), SGLang, vLLM, llama.cpp, Unsloth |
Pricing 이 unknown 인 이유는 Thinking Machines 가 공표한 가격표 가운데 이 환경에서 | |
| 읽을 수 있는 것이 없기 때문이다. Artificial Analysis 표의 Inkling 행에 적힌 | |
Cost per Task USD 는 -- 로, 게시자의 결측값 표기다. 애초에 이 열은 토큰당 단가가 | |
| 아니라 그들이 측정한 과제 1건의 비용이다 | |
| (source). |
| 속성 | 값 |
|---|---|
| Catalogue id | unknown |
출시일
2026-07-15 — Thinking Machines Lab 의 첫 프로덕션 모델이자 첫 오픈 웨이트 릴리스다 (source).
아키텍처: 총 975B, 토큰당 활성 41B 의 멀티모달 Mixture-of-Experts 로, 텍스트·이미지· 오디오를 입력으로 받아 텍스트를 출력한다. 사전학습은 텍스트·이미지·오디오·비디오 45조 토큰에 걸쳐 이뤄졌다. MoE 설계는 DeepSeek-V3 를 대체로 따른다 — 라우팅 전문가 256, 공유 2, 토큰당 활성 6 (source).
이 모델은 조절 가능한 "thinking effort" 설정을 노출한다 (source). 이는 이 위키가 Claude Opus 5 와 Kimi K3 에 기록해 둔 effort 등급과 같은 제품 형태이며, Test-Time Compute (Inference-Time Compute Scaling) 를 참조하라.
벤치마크
이 환경에서 읽을 수 있는 벤더 벤치마크 표는 없었다. 이 저장소가 보유한 것은 제3자 자료, 즉 2026-08-02 에 읽은 Artificial Analysis 리더보드 스냅숏이다. 열 이름은 게시자 자신의 것이다 (source):
| Model | Reasoning (derived) | Context Window | Creator | Artificial Analysis Intelligence Index | Cost per Task USD | Median Tokens/s | Latency First Chunk (s) | Total Response (s) |
|---|---|---|---|---|---|---|---|---|
| Inkling | yes | 1M | Thinking Machines | 41 | -- | 86 | 1.87 | 31.04 |
| Inkling Small | yes | 1M | Thinking Machines | 40 | $0.07 | 95 | 1.67 | 27.96 |
| 같은 표, 같은 읽기 시점의 척도를 곁들이면 Claude Opus 5 (max) 61, GPT-5.6 Sol (max) 59, | ||||||||
| Kimi K3 (max) 57, DeepSeek V4 Flash 0731 (max) 50 이다 | ||||||||
| (source). |
여기서 따라 나오는 것은 두 가지뿐이다. Inkling 은 이 지수에서 역량의 프런티어에 있지 않다. 그리고 빠르다 — 중앙값 초당 86 토큰, 첫 청크까지 1.87초로, 같은 읽기에서 Claude Opus 5 (max) 의 54 와 92.02초와 대비된다 (source).
Reasoning (derived) 는 게시자의 열이 아니라 이 저장소의 열이다. 그들의 페이지에 있는
아이콘에서 온 것으로, Eval Harness Configuration 를 따른다.
비교
- Kimi K3 — 2.8T, 같은 달의 더 큰 오픈 웨이트 릴리스. 2026-08-02 읽기 기준 Artificial Analysis Intelligence Index 에서 Inkling 의 41 에 대해 57 (source)
- Laguna S 2.1 — 118B/8B, Inkling 이 제너럴리스트라면 이쪽은 스페셜리스트다. 두 모델은 Pareto 프런티어 위의 오픈 모델로 함께 거명됐다 (source)
- DeepSeek V4-Flash — 284B/13B, MIT. 훨씬 작은 규모로 같은 지수에서 50 (source)
- Mistral Large 3 — 이 위키가 추적하는 또 하나의 Apache 2.0 프런티어급 가중치 릴리스