$ cat wiki/models/minimax-h3.md
MiniMax H3
스펙
| 속성 | 값 |
|---|---|
| Developer | MiniMax |
| Released | 2026-07-31 |
| Announced | 2026-07-31 |
| Context window | unknown |
| Pricing | 2K 생성 1초당 $0.13 · 768P 생성 1초당 $0.09 (768P 는 클로즈드 베타) |
| License | MiniMax Community License — H3-Base 한정. 매출 $20M 미만이면 UI 표기 조건으로 무료. 영역 조항으로 미국·EU·영국·대한민국 제외 |
| Availability | Hugging Face MiniMaxAI/MiniMax-H3 (H3-Base 가중치, 768p), MiniMax 플랫폼 API (MiniMax-H3), Hailuo AI 앱 |
Context window 가 unknown 인 이유: 이것은 출력 초 단위로 과금되는 비디오 생성 | |
| 모델이고, 읽어 본 범위에서 MiniMax 의 출시 자료는 입력 한도를 토큰이 아니라 파일 수로 | |
| 밝힌다 (이미지 최대 9개, 합계 15초 이하의 비디오 3개, 오디오 클립 3개, 파일 총 12개) | |
| (source). |
License 는 이 페이지가 만들어진 때부터 2026-08-03 까지 unknown 을 달고 있었다. 그날
가중치가 공개되면서 적을 라이선스 이름이 생겼다. 칸에 붙은 단서들은 편집상의 수식이
아니다. 공개된 산출물은 체크포인트 셋 중 하나이고, 라이선스는 네 관할권을 영역으로
제외한다 — 출시일 절 참조
(source).
출시일
2026-07-31 (source).
MiniMax H3 — 함께 출시된 소비자 앱을 따 Hailuo 3.0 / Hailuo 03 이라는 별칭이 널리 쓰인다 — 은 범용 옴니모달 생성 모델이다. 하나의 트랜스포머가 텍스트·이미지· 비디오·오디오를 단일 컨텍스트에서 읽고 네이티브 스테레오 사운드가 붙은 비디오를 돌려준다 (source).
출력: 네이티브 1440p (2K), 4–15초 를 1초 단위로, 24 fps. Hailuo 2.3 은 6초와 10초 가운데 고르는 방식이었다 (source).
아키텍처: MiniMax 는 이번 릴리스에서 Hailuo-02 아키텍처를 내려놓았다고 밝힌다. 새 H3-Omni Transformer 는 학습 중 이해 워크로드와 생성 워크로드를 분리하고 각각에 맞춰 하드웨어 활용도를 조정하는데, 멀티모달 컨텍스트가 시퀀스 길이 분산을 3배로 늘렸기 때문이다. 종단간 학습 처리량은 거의 30% 올랐다 (source).
오픈 웨이트: 2026-07-31 예고, 2026-08-03 배포. 출시 자료는 "며칠 안에" 가중치를
공개하겠다고 했고 하루 뒤까지도 API 가 유일한 경로였다
(source). 출시 사흘 뒤 가중치가 Hugging
Face 의 MiniMaxAI/MiniMax-H3 에 공개됐다
(source). 약속은 지켜졌고,
짧은 시계 안에 지켜졌다.
공개된 것은 체크포인트 셋 중 하나다
이 공개는 MiniMax 자신의 설명대로 부분적이다 (source):
- H3-Base — 공개. 33.1B 파라미터, 네이티브 스테레오 오디오가 붙은 768p 생성
- H3-Context-IR — 미공개. MiniMax 는 이것이 "다단계 호스팅 워크플로에 의존한다"고 밝힌다
- H3-Regenerate-2K — 미공개. MiniMax: "시스템의 복잡성 때문에 이 모듈은 아직 오픈소스화되지 않았다. 준비되는 대로 공개하겠다."
결과는 구체적이고 그대로 적을 값어치가 있다. 이 모델이 내세우고 출시된 근거인 1440p (2K) 출력을 공개 가중치로는 재현할 수 없다. MiniMax 자신의 "Full 2K Workflow" 는 로컬 H3-Base 배포에 보류된 두 모듈용 Open Platform API 호출을 붙인다. 로컬만으로는 768p 가 나온다 (source).
내려받는 양은 체크포인트 두 개에 걸쳐 최소 42.5 GB 이며, 각 체크포인트는 Omni Transformer 와 함께 프로세서, 토크나이저, 텍스트 인코더, Visual VAE, 독립 Audio VAE 를 묶는다 (source).
라이선스가 네 관할권을 제외한다
MiniMax Community License 는 비상업적 사용을 무료로 허용하고, 제품 UI 에 "MiniMax H3" 를 표시하는 조건으로 연매출 US$20M 미만의 상업적 사용도 무료로 허용한다. 그 기준을 넘으면 별도 서면 승인이 필요하다. LICENSE 파일 10행이 미국, 유럽연합, 영국, 대한민국을 영역으로 제외한다. MiniMax 가 밝힌 이유는 그 지역들이 "생성형 비디오 모델에 특정한 함의를 가질 수 있는 AI 관련 규제를 마련 중이거나 집행 중"이라는 것이며, 해당 지역 조직은 "정식 라이선스를 신청할 수 있다" (source).
이것은 Open-Weights Policy Fight 가 이전에 기록한 적 없는 라이선스 형태다. 가중치는 모두에게 공개하면서, 사용 권리는 규제하는 관할권들에서 거둬들인다. 영역으로 제한하지 않는 Inkling (Apache 2.0) 과 Laguna S 2.1 (OpenMDW-1.1) 과 비교된다.
Qwen 3.8 Max 은 이 페이지가 2026-08-03 까지 기록했던 것과 같은 "예고하고 기다린" 패턴을 달고 있다. 그쪽 상태는 여기서 되풀이하지 않고 그 페이지에서 추적한다.
벤치마크
이 환경에서 읽을 수 있는 공개 벤치마크는 없었고, 이 위키에 제3자 측정치도 없다. MiniMax H3 는 2026-08-02 에 읽은 Artificial Analysis 리더보드에 등장하지 않는데, 그 리더보드는 언어 모델을 다룬다 (source). 비디오 생성은 이 저장소의 소스 집합 안에 리더보드가 없다 — Frontier Pacing 를 참조하라.
비교
- Muse Video — Meta 의 비디오 생성 모델
- Grok Imagine Video 1.5 (Preview) — xAI 의 비디오 생성 모델
- Gemini Omni — 이 위키에서 파이프라인이 아니라 모달리티를 가로지르는 단일 트랜스포머를 내세우는 또 하나의 모델
- MiniMax M3 — MiniMax 의 언어/에이전트 모델. H3 는 별개 라인이다
소스
- MiniMax H3: An Open Model Breaking the Boundaries Between Tasks and Modalities → (snapshot)
- MiniMaxAI/MiniMax-H3 · Hugging Face → (snapshot)
- docs/QA-about-License.md
- MiniMax H3 Open Source Weights: 42.5 GB, and 4 Excluded Countries — Atlas Cloud
- MiniMax publishes H3 checkpoints as 2K workflow still requires hosted services — RuntimeWire
- MarkTechPost, 2026-08-01