$ cat wiki/models/minimax-m3.md
MiniMax M3
modelupdated 2026-07-28created 2026-07-17
Spec
| Attribute | Value |
|---|---|
| Developer | MiniMax |
| Released | 2026년 6월 1일 |
| Announced | 2026년 6월 1일 (MiniMax 공식 블로그) |
| Architecture | MSA (MiniMax Sparse Attention) — 희소 MoE |
| Total parameters | ~428B |
| Active parameters | 토큰당 약 23B |
| Context window | 1,000,000 토큰 (1M), 최소 512K 보장 |
| Max output | 131,072 토큰 |
| Modalities | 텍스트·이미지·비디오 (네이티브 멀티모달, 사후 어댑터 없음) |
| License | 공개 가중치 (HuggingFace) |
| API access | 글로벌 (영어 포함) |
| Pricing | $0.30/M input · $1.20/M output ($0.06/M 캐시 입력) — OpenRouter 카탈로그, 2026-07-28 판독 |
| Availability | API (global, including English) + open-weight on HuggingFace |
Release Date
2026년 6월 1일 — MiniMax 공식 블로그와 HuggingFace 공개. WAIC 2026 보도로 모델이 드러나 이 위키는 7월 17일에 캡처했다.
Benchmarks
| Benchmark | MiniMax M3 | Comparison | Notes |
|---|---|---|---|
| SWE-Bench Pro | 59.0% | GPT-5.5(직전 OpenAI 프런티어)를 앞선다 | 코딩 에이전트 |
| BrowseComp | 83.5 | Claude Opus 4.7(79.3)을 앞선다 | 브라우저 에이전트 |
| OSWorld-Verified | 70.06% | — | 컴퓨터 사용 |
| 비교에 대한 참고: 현재 OpenAI 프런티어는 GPT-5.6 Sol(2026년 7월 9일)이고, M3 의 비교 대상은 GPT-5.5 다. Claude Sonnet 5(2026년 6월 30일)는 대부분 벤치마크에서 Opus 4.7 을 앞선다. 그럼에도 중국 공개 가중치 모델로서 M3 의 BrowseComp 결과는 인상적이다. |
Architecture
- MSA (MiniMax Sparse Attention): 자체 희소 어텐션 메커니즘
- 100만 토큰 컨텍스트에서 M2(직전 MiniMax 모델) 대비 프리필 9배 이상 가속
- 100만 컨텍스트에서 M2 대비 디코딩 15배 이상 가속
- 100만 컨텍스트에서 M2 대비 토큰당 연산 20분의 1
- MoE: 총 약 428B, 활성 약 23B — 총 파라미터 수 대비 추론이 효율적이다
Use Cases
- 에이전틱 코딩 (SWE-Bench Pro 59.0%)
- 브라우저 기반 에이전트 과제 (BrowseComp 83.5)
- 컴퓨터 사용 (OSWorld 70.06%)
- 롱컨텍스트 문서 분석 (100만 토큰)
- 멀티모달 워크플로 (텍스트 + 이미지 + 비디오)
Significance
MiniMax M3 가 주목되는 이유:
- 에이전트 벤치마크에서 미국 선도 폐쇄형 모델(Claude Opus 4.7)을 앞선 최초의 중국 공개 가중치 모델 중 하나다 (BrowseComp 83.5 대 79.3)
- Tier-1 이 아닌(Alibaba·ByteDance 가 아닌) 중국 랩이 낸, 100만 컨텍스트와 네이티브 멀티모달을 갖춘 프런티어급 공개 가중치 모델이다
- API 와 공개 가중치로 전 세계에서 쓸 수 있어 중국 AI 모델의 국제적 접근을 넓힌다
Compared To
| Model | Org | SWE-Bench Pro | Notes |
|---|---|---|---|
| MiniMax M3 | MiniMax | 59.0% | 공개 가중치, 428B MoE, BrowseComp 83.5 |
| GPT-5.5 | OpenAI | 약 58.6% | 출시 시점 M3 의 기준. 현재는 GPT-5.6 으로 대체됨 |
| Claude Opus 4.7 | Anthropic | 약 64.3% | BrowseComp 79.3 (여기서는 M3 가 앞선다) |
| GLM-5.2 | Z.ai | — | 비교 가능한 중국 공개 가중치 프런티어 |
| Claude Sonnet 5 | Anthropic | 63.2% | 현재 Anthropic 중간 계층 (6월 30일 GA) |
Sources
- MiniMax official blog: https://www.minimax.io/blog/minimax-m3
- HuggingFace model: https://huggingface.co/MiniMaxAI/MiniMax-M3
- OpenRouter: https://openrouter.ai/minimax/minimax-m3
- Pandaily: https://pandaily.com/minimax-m3-model-2026
- MarkTechPost: https://www.marktechpost.com/2026/06/01/minimax-releases-minimax-m3-with-msa-architecture-supporting-1m-token-context-native-multimodality-and-agentic-coding/
Related
- MiniMax — 개발사
- Z.ai — 비교 가능한 중국 프런티어 랩 (GLM-5.2, 744B MoE)
- Agents (LLM Agents) — 에이전트 벤치마크 성능의 기준점
- Reasoning Models — 100만 컨텍스트 + 장기 과제