$ cat briefs/daily/2026-08-13.md
2026-08-13
2026년 8월 13일 (목)
스토리 3건 · 논문 0건 · 관찰 3건 · 신규 페이지 1건
이 브리프가 사흘 동안 **놓친 날짜**로 안고 있던 건이 해소됐다. Alibaba 가 Max 급 모델을 열었다. 나머지 둘은 **판단에 필요한 수치 없이 배포된** 릴리스다 — 정확도 수치가 없는 접근성 모델, 그리고 권한 변경이 명시되지 않은 브라우저 에이전트.
주요 소식
1. 첫 Max 급 Qwen 이 열렸다 — 이틀 늦게, 라이선스 이름은 아무도 밝히지 않은 채
- Alibaba 가 2.4T MoE 플래그십의 오픈 웨이트 형태인 Qwen3.8-2.4T-A95B 와 27B 의 가중치를, 닷새 전 예고된 시각인 2026-08-12 10:00 UTC+8 에 공개했다 (source). Max 급 Qwen 이 열린 것은 이번이 처음이다.
- 예고된 날짜는 2026-08-10 이었다. 이 위키는 어제 그것을 놓친 날짜로 기록했고, 그 기록은 고쳐 쓰지 않고 페이지에 남겨 둔다. 이틀 늦게 도착한 릴리스는 제때 도착한 릴리스와 다른 사실이기 때문이다.
- 라이선스 이름은 여전히 붙지 않았다. 가중치는 내려받을 수 있고 읽은 자료 어디에도 그 조건이 명시되어 있지 않다. 이전 Qwen 계열이 Apache-2.0 로 나왔다는 것은 선례이지 라이선스가 아니고, 선례로 기록한다. 27B 의 아키텍처·컨텍스트 윈도·가격은 자신의 출시를 통과하면서도
unknown으로 남았다. - 규모, Unsloth 가 공개한 양자화 기준: 전체 정밀도 4.9 TB,
Q8_02.6 TB, 가장 작은 1비트 빌드 397 GB — 89–91% 를 줄이고도 단일 소비자 GPU 에 닿지 못한다. - 의의: 여기서 "오픈"과 "돌릴 수 있음"이 갈라졌고, 벤더가 27B 를 나란히 내놓음으로써 그것을 인정했다. 이 규모의 오픈 릴리스는 이제 자원을 갖춘 쪽이 들여다보고 파인튜닝할 수 있음을 뜻하지 개인이 자체 호스팅할 수 있음을 뜻하지 않으며, 그 결과 오픈 웨이트의 보안 논거는 그대로 살아남고 민주화 논거는 대체로 그렇지 못하다. 순서도 이제 시간을 잴 수 있다 — 비공개 프리뷰 07-19 → 유료 API 08-03 → 오픈 웨이트 08-12, 스물나흘.
- → Qwen 3.8 Max, Qwen 3.8 27B, Open-Weights Policy Fight, Alibaba / Qwen AI Lab
2. DeepMind 가 수어 번역을 키보드 안에 넣고 정확도 수치는 공개하지 않았다
- SL2T, 2026-08-12: 다국어 수어-텍스트 모델로, 같은 날 Pixel 11 의 Gboard 와 Live Transcribe 에 수어-텍스트 받아쓰기로 실렸다 (source). 실제 소비자 제품 안에 들어간 최초의 수어 모델로 설명된다.
- 10만 시간 이상의 다국어 수어 데이터로 학습했고 그중 약 사분의 일이 ASL 인데, 출시된 기능이 지원하는 언어 쌍은 그 하나뿐이다. 수어들은 서로 통하지 않으므로, 다국어 학습 데이터가 ASL→영어 기능을 BSL 사용자에게 쓸모 있게 만들어 주지 않는다. 두 번째 쌍에 대한 일정은 공개되지 않았다.
- 아키텍처는 분리형이고 정확히 읽을 값어치가 있다. 온디바이스 모델이 카메라 영상을 "기하 좌표로 이루어진 일종의 와이어프레임"으로 축약하고, 그 좌표가 Google 서버로 간다. 원본 영상은 기기를 떠나지 않는다고 명시되어 있다. 이것은 하이브리드이지 온디바이스 모델이 아니다.
- 읽은 자료 어디에도 정확도, 단어 오류율, 비교 수치가 없다 — 그리고 이 저장소가 보유한 어떤 eval 스냅샷에도 수어 벤치마크가 없으므로, 대조할 로컬 근거도 없다.
- 의의: 가치 주장 전체가 전사 품질에 달린 접근성 제품이 품질 수치 하나 없이 발표됐다. 듣지 못하는 사용자에게 잘못된 전사는 품질이 떨어진 경험이 아니라 실패한 대화이고, 청각장애 당사자나 리뷰어나 조달 담당자가 그 위험을 판단하게 해 줄 유일한 수치가 바로 빠진 수치다.
- → SL2T (신규), Google DeepMind
3. Claude 의 Chrome 사이드 패널이 별도 제품이기를 그만두다
- Claude in Chrome 사이드 패널이 이제 완전한 Cowork 세션으로 동작한다. 대화, 스킬, 커넥터가 브라우저와 데스크톱·웹·모바일 앱 사이를 넘나든다. 이전까지 사이드 패널 세션은 분리되어 있었고 "대화와 맥락을 뒤에 남긴 채" 끝났다 (source).
- Max 와 Team 은 즉시, Pro 는 "앞으로 몇 주 안에". Enterprise 관리자는 기능을 켜고 승인된 도메인으로 접근을 제한할 수 있다. 읽은 자료에 Free 등급 언급은 없다.
- 함께 언급된 브라우저 에이전트 역량은 이번 발표로 새로 생긴 것이 아니다 — Claude in Chrome 은 이미 링크를 클릭하고, 입력하고, 양식을 채우고, 기존 로그인을 이용해 페이지를 옮겨 다닐 수 있다.
- 의의: 이것은 역량이 아니라 유통이고, Cowork 가 아직 흡수하지 않았던 마지막 표면이다. 답이 없는 부분은 권한 모델이다. 페이지 단위 행동 권한과 사용자의 살아 있는 세션을 가진 에이전트가 이제 데스크톱 세션과 상태를 공유하는데, 그것이 어떻게 승인되는지에 대한 변경은 서술되지 않았다.
- → Anthropic, Agents (LLM Agents)
스코어링 메모: 스토리 3에 에이전트·툴 사용 가중치(1.5)를 적용하면 공식상 2.24 로 1위가 된다. 여기서는 product launches (0.7) 로 채점해 0.99 를 줬다 — 바뀐 것은 세션 배관과 유통이지 에이전트가 할 수 있는 일이 아니기 때문이다. 스토리 1과 2는 1.86 로 동점이고, Qwen 이 타이브레이크에서 앞선다. 가중치가 붙은 프런티어 모델 릴리스는 interests.md 의 Actively Tracked Signal 이고 접근성 모델은 아니다.
논문 픽
오늘은 없음. 이번 회차에 HuggingFace Daily Papers 에서 arXiv 식별자가 붙은 항목이 올라오지 않았고, Tier-1 필터를 통과한 새 arXiv 논문도 없다. 어제의 수집 (BDH-CQ: In-Context Learning with Recurrent Latent Reasoning (arXiv:2608.09888))이 열하루 만에 식별자를 달고 도착한 첫 건이었고, 오늘은 다시 0 이다. 채워 넣지 않고 기록한다.
워치
- Alibaba 가 실제로 공개한 체크포인트에 대한 벤치마크를 아무도 내놓지 않았다. Qwen 3.8 Max 의 모든 수치는 API 로 제공되는 Max 를 측정한 것이다. 내려받을 수 있는 가중치가 그것을 재현하는지는 측정되지 않았다 — 2026-08-03 에 MiniMax H3 에 대해 기록된, 배포된 가중치가 그 모델이 가격까지 매겨진 사양을 재현하지 못한 바로 그 공백이다. → Qwen 3.8 Max
- DeepSeek V4-Pro 는 보도된 8월 10–20일 GA 창구의 나흘째이고 확인은 없다. 그 창구는 7월 28일 중국 언론의 목표치이지 회사의 날짜가 아니며, DeepSeek 자신의 진술은 여전히 출시가 "곧 뒤따를 것"이라는 것이다. 네 번째 회차째 관찰 항목으로 유지. → DeepSeek
- GLM-5.5 는 루머 상태로 열하루째다. JPMorgan 노트, 창업자의 "epic plus" 발언, 1T 초과로 소문난 파라미터 수가 있을 뿐 모델 카드도 벤치마크도 엔드포인트도 없다. Z.ai 자신의 채널은 여전히 GLM-5.2 를 홍보한다. 위키 바깥에 둔다. → Z.ai
위키 신규
- SL2T (신규 모델 페이지 — 검토 필요) — 스펙 일곱 행 중 넷이
unknown이고, 그 이유는 발표 쪽에 있다. 파라미터 수, 아키텍처, 라이선스, 가중치, API 어느 것도 공개되지 않았다. 소비자 제품 안에 실려 나가는 모델이고, 그래서 이 위키가 질문을 받을 수 있는 모델이므로 만들었다.
업데이트
- Qwen 3.8 Max —
Released는 그대로지만 오픈 웨이트, 저장소 네 곳, 양자화 크기, 새 벤치마크 문단이 추가됐다. SWE-bench Pro 줄은 점수가 아니라 순위로 기록했다("GPT-5.6 Sol 64.6 앞, Opus 4.8 69.2 뒤, Fable 5 80.0 보다 12 아래"), 그래서 Qwen 에 대해 어떤 수치도 지어내지 않았다. 그 80.0 은 Claude Fable 5 에 걸린 공개된 상충의 한쪽이고, 제3자가 한쪽을 인용한 것은 해소가 아니다. - Qwen 3.8 27B —
Releasednot yet → 2026-08-12.date-slipped태그는 유지. - Mistral AI — 2026-08-11, 하루 늦게 수집: 리전별 추론 엔드포인트(유럽 또는 미국), 가동률 보장이 붙은 공개 프리뷰 Priority Tier, 그리고 Mistral 이 2027년 말까지 200MW, 2030년 말까지 1GW 를 뒷받침한다고 말하는 기업 연합. 주권이 모델의 속성에서 계약의 속성으로 옮겨 간다. 검증 가능한 세부는 하나도 공개되지 않았다 — 회원사 이름도, 수도, 약정 규모도, 가동률 수치도.
- Open-Weights Policy Fight — 발표-후-공개 패턴이 이제 측정된 창구(24일) 를 갖게 됐고, 오픈/실행 가능 분리가 민주화 논거가 주장할 수 있는 범위의 변화로 기록됐다.
- Alibaba / Qwen AI Lab, Google DeepMind, Anthropic — 최근 활동과 제품 목록 갱신.