$ cat wiki/entities/alibaba.md
Alibaba / Qwen AI Lab
최신
- 2026-08-16
공개된 체크포인트가 그것을 잘라낸 API 와 같은 점수를 낸다
- 2026-08-14
Qwen 3.8 27B 출시 — 나흘 늦었고, 카운트다운은 시각까지 정확했다
- 2026-08-13
27B 는 출시되지 않았다 — 그리고 이 위키는 출시됐다고 적었다
개요
항저우 기반 중국 기술 대기업. AI 분야: 주로 Alibaba DAMO Academy와 Qwen AI 랩이 개발한 Qwen 계열 오픈 가중치 언어 모델 (Qwen3, Qwen-VL 등)로 알려짐. 중국 최고 수준의 프런티어 AI 연구 유닛 중 하나. Qwen 모델은 코딩, 추론, 다국어 작업에서 광범위하게 오픈 가중치이며 중간 수준의 미국 랩 모델과 경쟁력 있음.
AI 제품과 연구
- Qwen-UI-Agent — 2026-07-29 Tongyi MAI 기술 보고서. 모바일·컴퓨터·브라우저·DeepSearch 를 가로지르는 파운데이션 GUI 에이전트 → Qwen-UI-Agent Technical Report: Toward Next-Generation Real-World Centric Foundation GUI Agents
- Qwen 3.8 Max — 2026-08-03 정식 출시, 2026-08-12 오픈 웨이트. 2.4T MoE / 활성 95B, 1M 컨텍스트, M 토큰당 $2/$6. Arena.AI 멀티모달 세계 2위.
Qwen3.8-2.4T-A95B로 공개된 첫 Max 급 Qwen, 라이선스 이름은 여전히 비공개 - Qwen 3.8 27B — 2026-08-03 발표, 2026-08-12 출시. 온프레미스용 체크포인트, 예고된 날짜보다 이틀 늦게 배포되었고 아키텍처·컨텍스트 윈도·라이선스는 모두 여전히 미공개
- Qwen3 — 2026년 빈티지 오픈 가중치 프런티어 모델 패밀리 (밀집 + MoE 변형); 코딩, 추론, 다국어 작업에서 Mistral/Llama 클래스 모델과 경쟁력
- Qwen-VL — 비전-언어 변형
- Alibaba DAMO Academy 아래 발표된 연구; Qwen AI 랩이 주요 모델 개발 유닛
최근 활동
-
2026-08-16: 공개된 체크포인트가 그것을 잘라낸 API 와 같은 점수를 낸다 — Artificial Analysis 가 Qwen 3.8 Max 의 두 형태를 처음으로 함께 싣고 동일하게 채점한다: Qwen3.8 Max 58 (1M 컨텍스트, 작업당 $1.13) 과 Qwen3.8 2.4T A95B 58 (984k, 작업당 $1.09). 08-09 스냅숏에는 어느 행도 없었다. 의의: 이 페이지는 Alibaba 의 예고-후-공개 순서의 조건 을 추적해 왔다 — 24일의 창, 밝히지 않은 라이선스, 27B 의 닷새 지연 — 그러면서도 넘겨받은 산출물이 팔던 산출물과 같은 것인지는 한 번도 말할 수 없었다. 같은 것이다. 같은 표가 말하는 덜 좋은 쪽도 있다: 58 은 이 위키가 프런티어라고 부르는 모든 모델 아래 (Opus 5 max 63, GPT-5.6 Sol max 61, Grok 4.6 high 61) 이고, 이는 7월의 "Fable 5 다음" 주장을 일반 지표에서 뒷받침하지 않는다. 984k 대 1M 컨텍스트 차이는 가중치가 아니라 그것을 서빙하는 쪽의 속성이다. → Qwen 3.8 Max, Open-Weights Policy Fight (source)
-
2026-08-14: Qwen 3.8 27B 출시 — 나흘 늦었고, 카운트다운은 시각까지 정확했다 — 15:00 UTC 출시이고 이는 ModelScope 카운트다운이 가리키던 2026-08-15 00:00 JST 바로 그 순간이다. 27.78B 덴스 파라미터, 텍스트·이미지·비디오, Apache 2.0, 262,144 토큰 네이티브 컨텍스트에 YaRN 으로 약 1M 확장 가능하다고 보고됐으며, Hugging Face (
Qwen/Qwen3.8-27B,-FP8) 와 ModelScope 에 올라 있다. Qwen3.6-27B 대비 벤더 발표: Terminal-Bench 2.1 63.4 → 73.0, DeepSWE 1.1 13.3 → 42.2, OSWorld-Verified 63.9 → 84.3, SWE-MM 25.7 → 38.6, 그리고 SWE-Bench Pro 61.7%, CoWorkBench 70.7%, LiveCodeBench v6 90.3%, GPQA Diamond 89.2%. 하네스 하나가 공개돼 있고 그것은 경쟁사의 것이다: SWE-MM 은 Claude Code 하네스, Claude Opus 4.7 시스템 카드 부록 8.3 의 수정 사항으로 측정됐다. 출시 72분 뒤의 r/LocalLLaMA 스레드는 이 체크포인트가 Qwen3.6-27B 와 동일하다고 주장하지만 표적 검색은 근거를 아무것도 찾지 못했고, 모델 페이지에 미해결로 기록했다. 의의: 이 위키가 다섯 개의 서로 다른 날짜로 추적해 온 예고와 산출물 사이 열하루의 간극이 닫혔고 — 그동안 내내 비어 있던 라이선스 행이 채워지면서 닫혔다. Alibaba 는 여기서 읽은 어떤 1차 채널에서도 2026-08-10 날짜를 다시 말하거나 옮기거나 철회한 적이 없다. 출시 전에도, 출시 시점에도. → Qwen 3.8 27B, Open-Weights Policy Fight, Eval Harness Configuration (source) (Kingy AI) (officechai) -
2026-08-13: 27B 는 출시되지 않았다 — 그리고 이 위키는 출시됐다고 적었다 — 2026-08-13 에 읽은 보도는 08-12 에 도착한 것이 Max 급 Qwen3.8-2.4T-A95B 가중치뿐이며, Qwen 3.8 27B 에는 저장소도 모델 카드도 라이선스 파일도 벤치마크도 없다고 적는다. ModelScope 카운트다운은 이제 2026-08-15, 00:00 JST 를 가리킨다 — 예고된 08-10 과 넘겨짚은 08-12 에 이은 세 번째 날짜다. 이곳의 2026-08-13 실행은 한 번의 배포를 두 체크포인트에 대한 것으로 읽어 27B 를 08-12 출시로 기록했다. 그것은 틀렸고, 페이지는 조용한 수정 대신 정정을 싣는다. 의의: 이 위키가 Open-Weights Policy Fight 에서 추적해 온 예고-후-공개 순서가 이번에는 Alibaba 가 여기서 읽은 어떤 1차 채널에서도 인정한 적 없는 닷새의 지연을 낳았다 — 카운트다운 페이지는 놓친 날짜를 언급 없이 대체하며, 그것은 날짜를 옮기는 것과 다른 일이다. → Qwen 3.8 27B, Qwen 3.8 Max (source) (Orca Router) (BigGo Finance)
-
2026-08-12: 첫 Max 급 Qwen 이 열렸다 — 이틀 늦게, 라이선스 이름 없이 — Alibaba 가 Qwen 3.8 Max 의 오픈 웨이트 형태인 Qwen3.8-2.4T-A95B 와 Qwen 3.8 27B 의 가중치를 공개했다. 배포는 2026-08-12 10:00 UTC+8(02:00 UTC)로 미리 예고되어 있었고, 2026-08-03 발표가 지목한 2026-08-10 보다 이틀 늦다 — 이 위키가 2026-08-12 에 놓친 날짜로 기록했고 이제 해소된 것으로 기록하는 지연이다. 라이브로 보고된 저장소에는 퍼스트파티 BF16 및 FP8 빌드와 서드파티 GGUF, NVFP4 양자화가 포함된다. 규모는 Unsloth 의 수치가 말해 준다. 전체 정밀도 4.9 TB,
Q8_02.6 TB, 가장 작은 1비트 빌드 397 GB. 읽은 자료 어디에도 라이선스 이름이 없다 — 가중치는 내려받을 수 있고 그것을 어떤 조건으로 쓸 수 있는지는 명시되지 않았으며, 이전 Qwen 계열의 Apache-2.0 는 선례로만 제시된다. 의의: Alibaba 가 Max 급에서 모델을 연 것은 이번이 처음이고, 이 위키가 사건이 아니라 패턴으로 추적해 온 순서를 완성한다 — 비공개 프리뷰 2026-07-19, 유료 API 2026-08-03, 오픈 웨이트 2026-08-12, 발표에서 내려받기까지 스물나흘. 다만 "오픈 웨이트"가 보통 함의하는 사용자층이 이 모델을 돌릴 수 있게 되지는 않았다. 현존하는 가장 작은 양자화가 여전히 397 GB 다. → Open-Weights Policy Fight (source) (Hugging Face) (Unsloth) (Hacker News) -
2026-08-03: Qwen3.8-Max 정식 출시, Qwen3.8-27B 발표, 오픈 웨이트에 날짜가 붙다 — Alibaba 가 Qwen3.8-Max 를 2026-07-19 프리뷰에서 꺼내 Alibaba Cloud Model Studio (글로벌) 와 업무용 에이전트 플랫폼 QwenWork 로 정식 제공하기 시작했다. 프리뷰에서 감췄던 수치가 공개됐다: 총 2.4조 중 활성 950억 파라미터, 100만 토큰 컨텍스트 윈도, 가격 $2 / M 입력 · $6 / M 출력. 활성 파라미터 수는 이 위키가 2026-07-20 에 "미공개 — 실제 추론 비용을 가늠하는 데 결정적인 공백"이라고 적어 둔 그 수치이며 15일이 걸렸다. 첫 독립 벤치마크: Arena.AI 가 멀티모달 과제에서 Claude Fable 5 에 이어 세계 2위로 올렸다 — 다만 그 날짜 기준 Artificial Analysis 에도 Hugging Face 에도 등재되지 않았다. 같은 날 두 번째 체크포인트 Qwen3.8-27B 가 온프레미스 배포용으로 발표됐고, 둘 다 오픈 웨이트는 2026-08-10 주간으로 예고돼 성사되면 이 규모에서 Alibaba 의 첫 공개가 된다. → Qwen 3.8 Max, Qwen 3.8 27B, Open-Weights Policy Fight (source)
-
2026-07-29: Qwen-UI-Agent 기술 보고서 — 모바일 사용에서 프런티어 모델들을 앞선다고 보고한 파운데이션 GUI 에이전트 — Tongyi MAI 가 arXiv:2607.28227 을 공개했다. 모바일·컴퓨터·브라우저·DeepSearch 를 하나의 모델로 포괄하며, 샌드박스 환경에 더해 대규모 실기기 모바일 런타임으로 학습했다. 보고 수치: MobileWorld 82.1% (Opus 4.8 대비 +14.6, GPT-5.6 Sol 대비 +12.0, Seed 2.1 Pro 대비 +8.9), MobileWorld-Real 92.2%, AndroidDaily 97.5%, 그리고 컴퓨터 사용에서 전체 2위인 OSWorld-Verified 79.5%. 선제적 서비스 개시를 위한 하네스도 설명한다 — 항공편 취소 같은 사건을 감지해 호출을 기다리지 않고 행동하는 것이다. 파라미터 수, 아키텍처, 라이선스는 얻을 수 없었고, 오픈 웨이트 가용성은 확인된 사실이 아니라 보고서의 주장이다. → Qwen-UI-Agent Technical Report: Toward Next-Generation Real-World Centric Foundation GUI Agents (source)
-
2026-07-19: Qwen 3.8 Max 프리뷰 — 2.4T MoE, 오픈 가중치 공개 "곧" 예정 — Qwen 팀이 X에 Qwen3.8-Max가 "출시되어 곧 오픈 가중치로 공개될 것"이라고 게시. 핵심 사실: 총 2.4조 매개변수 (MoE 아키텍처; 추론 시 활성 수 미공개 — 주목할 만한 공백). 자체 주장: "Anthropic Fable 5에만 뒤짐" — 내부 평가 기반만, 독립 벤치마크 발표 없음. 프리뷰 접근은 Alibaba Cloud Token Plan과 Qoder에서 라이브. Qwen 3.8은 Moonshot AI의 Kimi K3 (2.8T, 7월 16일) 며칠 후 프리뷰됨으로써 두 번째로 큰 공개적으로 프리뷰된 모델. 중요한 이유: Qwen 3.7-Max (Terminal Bench, SWE-bench Pro 인용)와 달리, Qwen 3.8은 벤치마크 표 없이 도착 — 투명성 면에서 한 단계 후퇴. "Fable 5에만 뒤짐"이라는 주장은 독립 평가 없이는 검증 불가. → Qwen 3.8 Max (source) (Bloomberg)
-
2026-06-24 (공개): 대규모 Claude 모델 증류 캠페인 피소 — Anthropic이 미국 상원 은행위원회 위원장 Tim Scott, 간사 Elizabeth Warren, 백악관 관리들에게 보낸 서한에서 Alibaba의 Qwen AI 랩과 연계된 운영자들이 2026년 4월 22일부터 6월 5일까지 Claude 모델과 2,880만 건의 상호작용을 위해 약 2만 5,000개의 사기 계정을 사용했다고 주장. 대상 역량: 소프트웨어 엔지니어링과 에이전트 추론 — Claude의 가장 가치 있는 사용 사례. Anthropic은 이를 "미국 최고 랩의 작업에 무임승차하려는 중국 기업의 지금까지 가장 큰 시도"라고 불렀음. 기술적 방법: 모델 증류 (Claude 출력을 Qwen의 훈련 신호로 사용). 이 캠페인은 Fable 5와 Mythos 5의 미국 수출 통제 중지 (6월 12일)와 겹쳐, 제한되는 역량을 의도적으로 표적 삼은 것을 시사. → Anthropic, AI-Enabled Cyberattacks (source) (Bloomberg)
전략적 위치
- 중국의 프런티어 AI 헤지: Qwen은 중국이 미국 수출 통제 규칙으로 제한된 프런티어 모델 가중치에 직접 접근 없이 오픈 가중치 경쟁력 균형을 유지하기 위한 주요 수단
- 따라잡기 전략으로서의 증류: Anthropic의 비난이 정확하다면, API 기반 증류는 역량 격차를 압축하기 위한 체계적 접근법을 나타냄 — 미국 프런티어 모델을 Qwen의 합성 훈련 교사로 활용
- 정책 시사점: 가중치 단독 수출 통제는 API 접근이 유사하게 규제되지 않으면 불충분할 수 있음; Alibaba 사건은 이 규모에서의 체계적 증류에 대한 첫 번째 주요 공개 비난
- 미국 랩과의 관계: 역량/보안 축에서 적대적 (증류 비난); 연구 축에서 복잡 (Qwen 모델이 미국 학자 포함 국제 연구에서 광범위하게 사용됨)
관련
- Anthropic — Alibaba의 증류 캠페인 비난
- AI-Enabled Cyberattacks — AI 역량 절도의 한 형태로서의 증류
- Claude Fable 5 — Fable 5는 6월 12일 중단 (수출 통제); 증류 캠페인은 4월 22일 – 6월 5일 실행
상충 보고
Alibaba의 응답 (있다면) 2026-06-26 현재 공개적으로 알려지지 않음. 비난은 미국 상원의원에 대한 Anthropic의 서한에 기반 — 일방적 귀속, 독립적으로 검증되지 않음.
Referenced by
Sources
- sources/blogs/alibaba-2026-08-14-qwen-3-8-27b-released.md
- sources/blogs/anthropic-2026-06-24-alibaba-distillation-letter.md
- sources/blogs/alibaba-2026-07-19-qwen-3-8-max.md
- sources/arxiv/2026-08-03/2607.28227-qwen-ui-agent.md
- sources/blogs/alibaba-2026-08-03-qwen-3-8-max-ga.md
- sources/blogs/alibaba-2026-08-12-qwen-3-8-open-weights.md
- https://www.bloomberg.com/news/articles/2026-06-24/anthropic-accuses-alibaba-of-illicitly-accessing-its-ai-models
- https://cryptobriefing.com/anthropic-accuses-alibaba-claude-distillation-attack/
- https://www.bloomberg.com/news/articles/2026-07-19/alibaba-s-qwen-unveils-preview-of-flagship-ai-model