$ cat wiki/models/qwen-3-8-flash-next.md
Qwen3.8-Flash-Next
스펙
| 속성 | 값 |
|---|---|
| Developer | Alibaba / Qwen AI Lab |
| Released | not yet |
| Announced | 2026-08-25 |
| Context window | unknown |
| Pricing | unknown |
| License | unknown |
| Availability | ModelScope, 2026-08-26 23:00 (UTC+08:00) 예고, standard 및 FP8 |
Released 가 not yet 이라는 것이 이 페이지의 상태 전부다. ModelScope 티저가 | |
| 2026-08-25 에 "Upcoming Open-Release" 배지와 카운트다운 타이머를 달고 올라왔고, 타이머는 | |
| 2026-08-26 23:00 UTC+08:00 — 이 실행 이후를 가리킨다. 공개가 실제로 이루어졌음을 확인해 주는 | |
| 것은 읽은 어디에도 없다 | |
| (source). |
License 는 이 위키가 이미 Qwen 3.8 Max 에서 지고 있는 간극을 되풀이한다. 그 모델의
라이선스 이름은 가중치가 나온 2026-08-12 이후로 줄곧 unknown 이다. 이 모델에 대한 한 요약은
"파라미터 수와 라이선스 조건은 공개되지 않았다"고 분명히 진술한다.
출시일
2026-08-25 발표; 2026-08-26 23:00 (UTC+08:00) 예정; 캡처 시점 미공개.
오픈 웨이트 멀티모달 MoE 로, "다가올 Qwen4 계열을 떠받칠 차세대 아키텍처" 위에 세워졌으며 Qwen4 자체는 아니라고 명시된다 — 전체 계열에 앞서 아키텍처에 먼저 접근하게 해 주는 것 (source).
벤치마크
없다. 어떤 종류의 평가 수치도 읽은 어디에도 나오지 않는다 — 리더보드 행도, 벤더 도표도, 주장조차도. 차세대 아키텍처를 미리 보이는 모델치고 그것은 나중에 채워 넣을 누락이라기보다 기록해 둘 사실이다.
활용 사례
"오픈 웨이트"와 "멀티모달" 외에는 읽은 어떤 것도 진술하지 않는다. 2026-08-25 의 r/LocalLLaMA 스레드 셋이 로컬 배포를 기대하는데 — 하나는 "가중치가 풀리면 이 아키텍처는 의외로 로컬 친화적일 수 있다"는 제목이고, 다른 하나는 unsloth 의 day-0 지원을 언급한다 — 이는 미공개 모델에 대한 커뮤니티의 기대이며 연구소 산출물을 전혀 담고 있지 않다 (source).
비교
- Qwen 3.8 Max — 2.4T 파라미터 플래그십, 2026-08-03 출시, 가중치 2026-08-12. Flash-Next 가 3.8 계열의 작은 형제인지 별도 아키텍처 분기인지는 확인되지 않는다; "Qwen4 를 미리 보인다"는 후자를 시사하지만 그렇게 진술한 것은 없다.
- Qwen 3.8 27B — 이 위키가 이미 쥐고 있는 3.8 계열의 오픈 웨이트 구성원.
Alibaba 밖 모델과의 비교는 불가능하다: 비교의 어느 쪽에도 수치가 없다.
상충 보고
파라미터 수. 대부분의 요약은 총 125B, 토큰당 활성 6B 를 제시하고; 한 X 게시물은 그 위에 51B 의 N-gram 임베딩을 더하며; 한 기사는 **"파라미터 수와 라이선스 조건은 공개되지 않았다"**고 분명히 진술한다. 셋 다 이 실행에서 읽었고 셋이 동시에 옳을 수는 없다. 따라서 위 스펙 표에는 파라미터 행이 없고, 수치들은 사실로 게시되는 대신 여기에 기록된다 (source).
아키텍처. 단 하나의 기사가 GDN hybrid architecture, Qwen Sparse Attention (QSA), 그리고 48개 층 중 매 4번째 층이 GQA attention 을 쓰고 나머지는 "새로운 linear attention" 을 쓴다고 명명한다. 단일 출처이고 공개 이전이며, 1차 모델 카드는 읽지 못했다 (source).