$ cat wiki/models/minimax-h3.md
MiniMax H3
스펙
| 속성 | 값 |
|---|---|
| Developer | MiniMax |
| Released | 2026-07-31 |
| Announced | 2026-07-31 |
| Context window | unknown |
| Pricing | 2K 생성 1초당 $0.13 · 768P 생성 1초당 $0.09 (768P 는 클로즈드 베타) |
| License | unknown — 오픈 웨이트로 홍보되나 2026-08-01 기준 가중치 미배포 |
| Availability | MiniMax 플랫폼 API (MiniMax-H3), Hailuo AI 앱 |
Context window 가 unknown 인 이유: 이것은 출력 초 단위로 과금되는 비디오 생성 | |
| 모델이고, 읽어 본 범위에서 MiniMax 의 출시 자료는 입력 한도를 토큰이 아니라 파일 수로 | |
| 밝힌다 (이미지 최대 9개, 합계 15초 이하의 비디오 3개, 오디오 클립 3개, 파일 총 12개) | |
| (source). |
License 가 라이선스 이름이 아니라 unknown 인 것은 가중치를 공개하겠다는 예고가
라이선스는 아니기 때문이다 — 출시일 절의 끝을 참조하라.
출시일
2026-07-31 (source).
MiniMax H3 — 함께 출시된 소비자 앱을 따 Hailuo 3.0 / Hailuo 03 이라는 별칭이 널리 쓰인다 — 은 범용 옴니모달 생성 모델이다. 하나의 트랜스포머가 텍스트·이미지· 비디오·오디오를 단일 컨텍스트에서 읽고 네이티브 스테레오 사운드가 붙은 비디오를 돌려준다 (source).
출력: 네이티브 1440p (2K), 4–15초 를 1초 단위로, 24 fps. Hailuo 2.3 은 6초와 10초 가운데 고르는 방식이었다 (source).
아키텍처: MiniMax 는 이번 릴리스에서 Hailuo-02 아키텍처를 내려놓았다고 밝힌다. 새 H3-Omni Transformer 는 학습 중 이해 워크로드와 생성 워크로드를 분리하고 각각에 맞춰 하드웨어 활용도를 조정하는데, 멀티모달 컨텍스트가 시퀀스 길이 분산을 3배로 늘렸기 때문이다. 종단간 학습 처리량은 거의 30% 올랐다 (source).
오픈 웨이트: 예고됐고, 배포되지 않았다. 이 모델은 오픈 웨이트로 홍보되며 MiniMax 는 "며칠 안에" 가중치를 공개하겠다고 밝혔다. 출시 하루 뒤 기준 배포된 가중치는 없었고, API 가 유일한 경로였다 (source). 이 위키는 그것을 완료된 릴리스가 아니라 예고된 의사로 기록한다 — Qwen 3.8 Max (Preview) 이 2026-07-19 의 "곧 오픈 웨이트" 주장에 대해 받는 것과 같은 처리이며, 그 주장은 이 페이지를 만드는 시점까지도 이행되지 않았다. Open-Weights Policy Fight 를 참조하라.
벤치마크
이 환경에서 읽을 수 있는 공개 벤치마크는 없었고, 이 위키에 제3자 측정치도 없다. MiniMax H3 는 2026-08-02 에 읽은 Artificial Analysis 리더보드에 등장하지 않는데, 그 리더보드는 언어 모델을 다룬다 (source). 비디오 생성은 이 저장소의 소스 집합 안에 리더보드가 없다 — Frontier Pacing 를 참조하라.
비교
- Muse Video — Meta 의 비디오 생성 모델
- Grok Imagine Video 1.5 (Preview) — xAI 의 비디오 생성 모델
- Gemini Omni — 이 위키에서 파이프라인이 아니라 모달리티를 가로지르는 단일 트랜스포머를 내세우는 또 하나의 모델
- MiniMax M3 — MiniMax 의 언어/에이전트 모델. H3 는 별개 라인이다