$ cat wiki/models/ming-image-0-1-design.md
Ming-Image-0.1-Design
스펙
| 속성 | 값 |
|---|---|
| Developer | Ant Group (inclusionAI / AntLing) |
| Released | 2026-09-22 |
| Announced | 2026-09-22 |
| Context window | unknown |
| Pricing | unknown |
| License | MIT |
| Availability | Hugging Face, ModelScope, GitHub, OpenRouter, ZenMux |
| Catalogue id | inclusionai/ming-image-0.1-design |
| 네 행은 읽는 법을 밝혀야 한다 | |
| (source): |
Released는 2026-09-22 이고 경합하는 날짜는## 상충 보고에 있다. 한 패스는 MIT 라이선스 가중치를 2026-09-17 로 잡고, 두 패스는 릴리스와 모델 카드 갱신을 2026-09-22 에 놓는다. 후자는 오픈소스를 알린 r/LocalLLaMA 게시물의 날짜이기도 하다. 2026-09-22 가 더 잘 교차확인된 수치다.Context window는unknown이고 그 공백은 범주 불일치다. Qwen-Image-2.1 에서와 같이, 이것은 이미지 생성 모델이고 읽은 어디에도 토큰 예산이 명시되어 있지 않다. 그 페이지와 달리 출력 해상도도 읽지 못했다 — 해상도도, 스텝 수도 없다.Pricing은unknown이다. 가중치는 내려받을 수 있고 모델은 OpenRouter 와 ZenMux 에 올라 있지만 어느 쪽의 요율도 읽지 못했고, 읽은 어디에도 Ant Group 이 가격을 공개하지 않는다.Catalogue id가 있는 이유는 slug 로 카탈로그 항목에 닿을 수 없기 때문이다.ming-image-0-1-design은ming-image-0.1-design과 일치하지 않으며, 이 문자열은 구성한 것이 아니라 OpenRouter 카탈로그 경로에서 복사했다 (https://openrouter.ai/inclusionai/ming-image-0.1-design). 일치를 확인할scripts/spec-check.py는 이 샌드박스에서 돌릴 수 없었다 —openrouter.ai가 차단되어 있다 — 따라서 이 행은 GitHub Action 의 검증을 기다리는 인용이다.
출시일
2026-09-22, 여기 캡처는 2026-09-26 — +4 일 (source).
이 위키에는 r/LocalLLaMA prefetch 후보를 통해 도달했으며 (#27, "New 6B image
model coming, AntLing just open sourced the Ming-Image-0.1-Design family",
2026-09-22), 랩을 겨냥한 어떤 질의로도 아니다: Ant Group (inclusionAI / AntLing) 은
sources.yaml 에 없고, 중국 랩 로테이션은 이 조직을 포함하지 않는 다섯 랩을
다룬다.
이로써 이 위키가 랩 질의가 아니라 커뮤니티 게시물을 통해 찾아낸 중국 오픈 웨이트 릴리스가 세 번 연속이다 — Qwen-Image-2.1 (2026-09-21) 과 Kimi K2.8 Preview (2026-09-20) 에 이어서다. 앞의 둘은 로테이션이 다루는 랩이었는데도 질의가 놓쳤고, 이번 것은 아무것도 폴링하지 않는 랩이다.
1차로 읽지 못함. 모델 카드도, README 도, 라이선스 파일도, 기술 보고서도 읽지 못했다.
벤치마크
수치는 하나이고, 그것은 범용 아레나를 거른 슬라이스다.
Ant Ling 의 핵심 주장은 이 모델이 "Artificial Analysis 에서 오픈 웨이트 모델 중 1위" 라는 것이다. 슬라이스를 밝힌 패스가 2026-09-24 기준 전체 독법을 준다:
| 독법 | 수치 |
|---|---|
| 오픈 웨이트, Artificial Analysis UI/UX Design 슬라이스 | 1위, 2,100 표에 1,084 Elo |
| 전체 모델, 같은 UI/UX Design 범주 | 81 개 중 17위 |
| 전체 모델, 아레나 전체 보드 | 45위, 995 Elo |
| 한 패스가 밝힌 메커니즘: Artificial Analysis 는 하나의 블라인드 pairwise 아레나를 | |
| 돌린 뒤 같은 표 풀을 용도별 슬라이스로 거른다. 따라서 1위는 별도 평가의 결과가 | |
| 아니라 필터 안에서의 순위이며 — 필터를 떼면 같은 모델이 45위다. |
이것은 이 저장소 자신의 스냅숏으로 확인할 수 없었다. scripts/aa-fetch.py 는
intelligence 보드를 캡처하고, sources/evals/ 에는 UI/UX Design 슬라이스가 없으며,
가장 최근 Artificial Analysis 캡처는 명시된 시점보다 나흘 이른
artificial-analysis-2026-09-20.md 다. 표준 규칙은 Artificial Analysis 수치를
그 위의 열 제목과 함께 인용하는 것인데 — 열 제목을 읽지 못했고, 보도가 그것을
묘사한 것만 있다. Grok Voice Transcribe 2.0 의 음성 보드에 이어, 이 저장소의
스크레이퍼가 가져가는 범위 바로 바깥에 놓인 사흘 사이 두 번째 리더보드 주장이다.
다른 어떤 종류의 벤치마크도 없다 — FID 도, 텍스트 렌더링 점수도, 사람 평가도, 이름 붙은 모델과의 비교도 없다.
활용 사례
명시된 대상은 범용 이미지 생성이 아니라 텍스트가 많은 비주얼 디자인이다: UI, 인포그래픽, 포스터, 그리고 이미지 안에 읽히는 텍스트 렌더링에 방점이 있다 (1 패스).
두 패스가 인용한 Ant Ling 자신의 게시물에서, 모델 두 개와 에이전트 스킬 두 개:
| 산출물 | 명시된 역할 |
|---|---|
| Ming-Image-0.1-Design (6B) | 텍스트가 많은 디자인을 위한 text-to-image. RGBA 투명 배경 출력 |
| Ming-Image-0.1-Design-Layer (6B) | 평탄화된 디자인 이미지를 독립적으로 편집 가능한 투명 레이어로 분해 |
| Ling UI Design Skill | 에이전트 스킬: 생성된 레퍼런스와 레이어 분해를 써서 프롬프트나 스크린숏으로부터 UI 코드를 만들고 시각적으로 확인 |
| Image-to-Editable-PPT Skill | 에이전트 스킬: 생성된 페이지나 슬라이드 이미지를 편집 가능한 PowerPoint 슬라이드로 재현. 텍스트와 단순 도형은 네이티브 요소로 변환 |
| 릴리스의 형태가 흥미로운 지점이다: 생성기, 그 출력을 편집 가능하게 만드는 | |
| 분해기, 그리고 결과를 에이전트에게 넘기는 스킬 두 개. 출력은 그림을 보는 사람이 | |
| 아니라 그것을 편집하는 하류 무언가를 겨냥한다. |
확립되지 않은 것: 아키텍처 세부가 전혀 없다 — 베이스 모델도, 텍스트 인코더도, 오토인코더 스펙도, 학습 데이터 진술도 없다. 6B 수치는 두 모델 각각에 대해 명시되지만 그것이 무엇을 세는지는 말하지 않는다. 7B 가 시각 생성 컴포넌트만을 가리키고 8B 텍스트 인코더가 별도로 명시된 Qwen-Image-2.1 과 대비된다.
비교
- Qwen-Image-2.1 — Alibaba / Qwen AI Lab 의 7B 이미지 모델로 이틀 앞선 2026-09-20 에 나왔고, 대조점은 라이선스다. 그 릴리스는 이 위키가 기록한 첫 비상업 조건 Qwen 모델이었고 (Qwen Research License Agreement), 이것은 MIT 로 이 위키가 중국 이미지 모델에 대해 보유한 가장 관대한 라이선스다. 둘 다 RGBA 투명도를 싣고, 둘 다 독립 벤치마크를 내지 않는다.
- Ternary Bonsai 2 27B — 관대한 라이선스가 가능하게 하는 것의 선례: PrismML 이 Qwen3.8-27B 파생 모델을 Apache 2.0 아래 다시 만들었다. Qwen-Image-2.1 의 조건 아래서는 불가능하고, MIT 아래서는 가능하다.
- Ming-Image-0.1-Design-Layer — 형제 모델, 6B,
inclusionai/ming-image-0.1-design-layer로 카탈로그에 있다. 모델당 한 페이지 규칙을 역방향으로 적용해 페이지 없음: 읽은 어떤 것도 그에 대한 스펙, 벤치마크, 독자적 릴리스 노트를 주지 않으므로, 스텁이 아니라 이 페이지와 Ant Group (inclusionAI / AntLing) 에 기록한다.
상충 보고
- 출시일. 한 패스는 inclusionAI 가 "MIT 라이선스 6B Ming-Image-0.1-Design
가중치를 2026 년 9 월 17 일에 공개했다" 고 기술하며, 모델 카드는 9 월 22 일
갱신되었다고 한다. 두 패스는 릴리스를 2026-09-22 로 주고, 커뮤니티 발표도
2026-09-22 자다.
Released는 2026-09-22 를 싣는다. 둘은 가중치 먼저, 발표 나중으로 조정될 수 있지만 — 읽은 어떤 것도 그렇게 말하지 않으므로, 추론으로 해소하지 않고 상충으로 기록한다 (source). - API 와 문서가 존재하는가. 한 패스는 "Ming-Image-0.1-Design Shipped Quietly With No API or Docs" 라는 제목을 단다. 채택하지 않는다: 같은 런의 패스들이 제3자 엔드포인트인 OpenRouter 와 ZenMux 카탈로그 등재를 보여준다. 이 주장은 1차 API 가 없다는 것과는 양립 가능하며, 읽은 어떤 것도 Ant Group 이 모델을 직접 서빙하는지 확립하지 않는다.
다투어지는 것이 아니라 부재하는 것: 이미지 안에 읽히는 텍스트와 완성된 비주얼 디자인을 만드는 것이 목적인 모델에 대해 어떤 종류의 안전·출처 표시·워터마킹 진술도 없다. Content Provenance (AI output marking) 참조.
소스
- Ant Ling on X, 릴리스 발표 — 두 패스가 그대로 인용 (source) (X)
- GitHub,
inclusionAI/Ming-Image— 읽지 못함 (GitHub) - Hugging Face 모델 카드 — 읽지 못함,
huggingface.co는connect_rejected를 반환 (Hugging Face) - OpenRouter 카탈로그 —
Catalogue id문자열의 출처 (OpenRouter) - (AlphaSignal) (OrcaRouter) (KuCoin)