AI Trend Notifier
EN
← wiki

$ cat wiki/models/inkling.md

Inkling

model갱신 2026-08-03생성 2026-08-03

나란히 보기

스펙

속성
DeveloperThinking Machines Lab
Released2026-07-15
Announced2026-07-15
Context window1M
Pricingunknown
LicenseApache 2.0 (오픈 웨이트)
AvailabilityHugging Face (BF16 및 NVFP4), Tinker (파인튜닝), SGLang, vLLM, llama.cpp, Unsloth
Pricingunknown 인 이유는 Thinking Machines 가 공표한 가격표 가운데 이 환경에서
읽을 수 있는 것이 없기 때문이다. Artificial Analysis 표의 Inkling 행에 적힌
Cost per Task USD-- 로, 게시자의 결측값 표기다. 애초에 이 열은 토큰당 단가가
아니라 그들이 측정한 과제 1건의 비용이다
(source).
속성
Catalogue idunknown

출시일

2026-07-15 — Thinking Machines Lab 의 첫 프로덕션 모델이자 첫 오픈 웨이트 릴리스다 (source).

아키텍처: 총 975B, 토큰당 활성 41B 의 멀티모달 Mixture-of-Experts 로, 텍스트·이미지· 오디오를 입력으로 받아 텍스트를 출력한다. 사전학습은 텍스트·이미지·오디오·비디오 45조 토큰에 걸쳐 이뤄졌다. MoE 설계는 DeepSeek-V3 를 대체로 따른다 — 라우팅 전문가 256, 공유 2, 토큰당 활성 6 (source).

이 모델은 조절 가능한 "thinking effort" 설정을 노출한다 (source). 이는 이 위키가 Claude Opus 5Kimi K3 에 기록해 둔 effort 등급과 같은 제품 형태이며, Test-Time Compute (Inference-Time Compute Scaling) 를 참조하라.

벤치마크

이 환경에서 읽을 수 있는 벤더 벤치마크 표는 없었다. 이 저장소가 보유한 것은 제3자 자료, 즉 2026-08-02 에 읽은 Artificial Analysis 리더보드 스냅숏이다. 열 이름은 게시자 자신의 것이다 (source):

ModelReasoning (derived)Context WindowCreatorArtificial Analysis Intelligence IndexCost per Task USDMedian Tokens/sLatency First Chunk (s)Total Response (s)
Inklingyes1MThinking Machines41--861.8731.04
Inkling Smallyes1MThinking Machines40$0.07951.6727.96
같은 표, 같은 읽기 시점의 척도를 곁들이면 Claude Opus 5 (max) 61, GPT-5.6 Sol (max) 59,
Kimi K3 (max) 57, DeepSeek V4 Flash 0731 (max) 50 이다
(source).

여기서 따라 나오는 것은 두 가지뿐이다. Inkling 은 이 지수에서 역량의 프런티어에 있지 않다. 그리고 빠르다 — 중앙값 초당 86 토큰, 첫 청크까지 1.87초로, 같은 읽기에서 Claude Opus 5 (max) 의 54 와 92.02초와 대비된다 (source).

Reasoning (derived) 는 게시자의 열이 아니라 이 저장소의 열이다. 그들의 페이지에 있는 아이콘에서 온 것으로, Eval Harness Configuration 를 따른다.

활용 사례

이 모델에 대해 연구소가 스스로 밝힌 역할은 다운스트림 파인튜닝을 위한 균형 잡힌 멀티모달 커스터마이즈 가능 베이스이며, Inkling 이 전반적으로 가장 강한 모델이라는 주장은 명시적으로 하지 않는다 (source). 연구소 자체 플랫폼 Tinker 에서의 당일 파인튜닝, 그리고 SGLang·vLLM·llama.cpp·Unsloth 의 day-zero 지원이 그 주장의 운영상 형태다 (source).

비교

  • Kimi K3 — 2.8T, 같은 달의 더 큰 오픈 웨이트 릴리스. 2026-08-02 읽기 기준 Artificial Analysis Intelligence Index 에서 Inkling 의 41 에 대해 57 (source)
  • Laguna S 2.1 — 118B/8B, Inkling 이 제너럴리스트라면 이쪽은 스페셜리스트다. 두 모델은 Pareto 프런티어 위의 오픈 모델로 함께 거명됐다 (source)
  • DeepSeek V4-Flash — 284B/13B, MIT. 훨씬 작은 규모로 같은 지수에서 50 (source)
  • Mistral Large 3 — 이 위키가 추적하는 또 하나의 Apache 2.0 프런티어급 가중치 릴리스

Referenced by

Sources