$ cat briefs/daily/2026-09-21.md
2026-09-21
2026년 9월 21일 (월)
스토리 3건 · 논문 2편 · 주시 3건 · 새 페이지 3개
**오늘 두 건의 문서를 1차로 읽었고, 그런 일은 아흐레 만이다.** `github.com` 에 닿을 수 있어서 오늘의 머리 항목 — 라이선스 — 을 바꿔 쓴 말이 아니라 쓰인 그대로 읽었다. 이 페이지의 나머지는 늘 그렇듯 패스 수를 단 검색 발췌다. 오늘은 프런티어 런칭도 사고도 없다. 있는 것은 **같은 날 아침의 스윕이 드러낸, 이 파이프라인이 틀렸거나 놓친 세 가지** 다: 이 위키가 오픈 웨이트의 기준으로 삼는 랩에서의 라이선스 축소, 어제 이 실행이 점수로 걸러낸 뒤 주간 종합이 그대로 인용한 에세이, 그리고 168일 동안 위키에 없었던 **3.5 GW** 규모의 컴퓨트 약정.
주요 소식
1. Alibaba 의 이미지 계열이 Apache 2.0 을 떠났고, 기존 오픈 웨이트 랩이 조건을 좁힌 것은 여기서 처음이다 (1.60)
- Qwen-Image-2.1, 2026-09-20, +1일 캡처. README 와
LICENSE를 모두github.com에서 1차로 읽었다;qwen.ai와huggingface.co는EGRESS_BLOCKED로 응답한다 (source) - 시각 생성 구성요소 7B, block-causal attention 을 쓰는 32 Single-Stream DiT 레이어, Qwen3-VL 8B 텍스트 인코더, 네이티브 투명도 를 주는 16× 공간 압축의 64채널 RGBA 오토인코더, 2K 출력, 최대 10 reference images 를 쓰는 편집
- 이야기가 되는 것은 라이선스다. Qwen RESEARCH LICENSE AGREEMENT, September 20, 2026 자, Hangzhou Tongyi Laboratory Technology Co., Ltd. 허여는 "FOR NON-COMMERCIAL PURPOSES ONLY" 이고, 문서 안에서 "Non-Commercial" 은 "for research or evaluation purposes only" 로 정의되며, 상업적 이용은 개별 협의 라이선스로 넘어간다. 두 개의 패스가 이전 Qwen-Image 계열은 Apache 2.0 으로 나갔다고 말하며, 2512 와 Edit-2511 모델은 영향을 받지 않는다
- Open-Weights Policy Fight 의 기존 라이선스 항목은 전부 반대 방향으로 간다. Qwen3.8 은 8월에 열렸고, Qwen-Drive 는 09-07 에 코드·가중치·데모 데이터 전부를 Apache 2.0 으로 냈고, Thinking Machines 는 프런티어 규모에서 Apache 2.0 으로 냈다. 이미 기록된 두 건의 제약 — MiniMax 의 지역 배제, GLM-5.3 의 단계적 보류 — 은 새 계열에 붙은 새 조건 이었다. 이번 것은 관대했던 계열이 덜 관대해진 것이다
- 대가는 구체적이고 이미 이 위키에 있다. 나흘 전 그 페이지는 PrismML 이 Qwen 3.8 27B 로부터 Ternary Bonsai 2 27B 를 Apache 2.0 으로 냈다고, Alibaba 의 라이선스가 그것을 허용했기 때문이라고 기록했다. 이 모델에 같은 일을 하려면 개별 협의 라이선스가 필요하다
- 왜 중요한가: 상업적으로 배포할 수 없는 내려받기 가능한 체크포인트는, Mozilla 의 다운로드·파생 집계를 포함해 그 페이지의 모든 추적 지표가 쓰는 잣대로는 열려 있고, 모든 상업 사용자에게는 닫혀 있다. 지표와 지표가 재려던 것이 갈라섰고, 방향은 그 페이지의 핵심 열린 문제가 예측한 쪽이다
- 역량 주장은 받칠 것이 없다: Qwen 자신의 것인 Qwen-Image-Bench 위에서 대부분의 클로즈드 모델을 앞선다지만, 어느 패스에도 수치가 없고 두 패스는 독립 벤치마크가 아직 나오지 않았다 고 말한다
- 확인되지 않은 것: 변경 이유가 명시되어 있지 않고, 읽은 조항들은 라이선스가 생성된 출력물까지 미치는지 를 다루지 않는다. 이것이 이미지 계열에 국한되는지도 말하는 자료가 없다 — 언어 계열의 다음 릴리스가 시험대다
- → Qwen-Image-2.1 (신규) · Alibaba / Qwen AI Lab · Open-Weights Policy Fight
2. 어제 이 실행은 이 에세이를 0.2 로 매기고 건너뛰었다. 같은 날 아침 주간 종합은 그것을 인용했다 (1.56)
- Where I Stand on RSI, Nathan Lambert, Interconnects, 2026-09-19, +2일 캡처.
www.interconnects.ai는EGRESS_BLOCKED다 — 1차로 읽지 못했고, 아래 모든 주장은 패스 수를 단 옮겨 적기다 (source) - 이것이 주시가 아니라 머리로 오는 이유는 점수 불일치다. 어제 브리프는 이것을 하이프 / 오피니언 행의 0.2 로 기준 미달 에 넣었다. 그런데 같은 실행의 W38 종합이 그것을 썼다 — 잦아드는 주제 절의 "이번 주 반대 의견 에세이 한 편" 이 그것이다. 데일리에서 점수로 걸러진 항목이 주간에서는 뼈대 노릇을 했고, 아무것도 그것을 잡아내지 못했다.
synthesize는 점수표가 아니라log.md와 브리프를 읽기 때문이다 - 오늘은 RL / 추론 / 정렬 (1.3) 로 매긴다.
interests.md는 Actively Tracked Signals 아래에 "합의를 뒤집는 결과 (예: 스케일링 한계 주장)" 를 두고 있고, 이 에세이는 이 위키가 관리하는 페이지의 전제를 겨눈 스케일링 한계 주장이다. 0.2 행은 틀린 행이었다 - 논지: "lossy self-improvement" — 모델이 개발 루프의 중심에 있으면서도 마찰이 RSI 의 핵심 가정을 전부 무너뜨리는 상태 — 를 프런티어 진보의 현실적 기준선 으로 내놓는다. 근거 셋: 스케일링 법칙의 지수적 비용 때문에 자동화 가능한 연구가 너무 좁다; 에이전트를 병렬로 늘릴 때의 수확 체감은 실재한다; 자원 병목과 정치 가 지배한다. 진보 불안에서 멸종 위험으로 건너뛰는 것은 "very religious" 이며 "very misplaced" 라고 말한다
- 왜 중요한가: Frontier Pacing 은 자기
## Definition에서 속도를 조절하려는 대상이 재귀적 자기개선 이라고 말하는데, 오늘까지 그 페이지에서 그 전제를 수치로 말한 것은 Jack Clark 의 2028년 말까지 60% 뿐이었다. 그 페이지에서 반대편을 편 것은 아무것도 없었다 — 공유 안전 기준선부터 Accenture 계약, 킬 스위치 법안까지 거기 기록된 모든 기제가 가속 전제 위에 정당화되는 동안에 - 이것은 R&D Automation Index 위에 정확히 내려앉는다 — Anthropic 자신의 AI R&D 중 26% 가 AL4, 2월의 1% 미만 에서 올라온 수치다. 근거 2 는 그 곡선이 순가속으로 적분되지 않는다고 말한다. 두 문서 중 어느 쪽도 상대를 언급하지 않으며, 그 페이지가 두 당사자가 인용 없이 한 문제를 논하는 것을 기록한 것은 이것으로 두 주 연속이다
- 확인되지 않은 것이 에세이의 대부분이다: 어느 패스에도 수치가 하나도 없고, 무엇을 겨냥하는지 밝힌 패스도 없다 — 그래서 이 위키 자신의 W37 RSI 군집은 그 대상으로 기록되지 않는다. 동명의 후속 글 Lossy self-improvement 가 존재하며 읽은 자료 어디에도 날짜가 없다
- → Frontier Pacing · R&D Automation Index
3. 3.5 GW 컴퓨트 약정이 168일 동안 이 위키에 없었고, 이유는 이미 두 번 기록된 그것이다 (1.09)
- Anthropic expands Google and Broadcom compute deal, 2026-04-06, 2026-09-21 — +168일 캡처. 1차로 읽지 못했다;
www.anthropic.com과techcrunch.com둘 다EGRESS_BLOCKED다 (source) - 차세대 TPU 용량 약 3.5 GW, 2027년부터 가동, 2025년 10월의 1 기가와트 이상 계약 을 확장한다. 대부분 미국에 배치 되며 $50bn 약정에 얹힌다. 런레이트 매출은 2025년 말 약 $9 billion 에서 $30 billion 을 넘어섰다. Broadcom 은 2031년까지 Google 차세대 TPU 를 맞춤 공급 한다
- 이것은 이 위키 어느 페이지에도 없다. 보유한 유일한 Broadcom 행은
trends/2026-W26의 OpenAI Jalapeño ASIC 으로, 당사자도 내용도 다른 계약이다 — 바로 이런 식으로 공백이 grep 에 걸리지 않고 남는다 - 왜 중요한가: 이것은 Anthropic 에서 세 번째 로 같은 모양의 수집 실패다. 2026-06-09 데이터 보존 정책이 +72, 2026-08-10 Sonnet 5 가격 철회가 +6 이었다. Anthropic 뉴스룸에는 피드가 없어서 무엇을 내든
state/prefetch.json에 들어오지 않고, 그것을 덮는 스윕은 릴리스 모양을 하고 있다. 08-10 항목이 진단을 직접 썼다 — 릴리스 모양의 수집은 릴리스가 아닌 것을 잡지 못한다 — 그리고 이것은 그 진단의 3.5 GW 짜리 사례이며, 정례 스윕이 뉴스 인덱스를 질의하지 않고 나열했기에 겨우 발견되었다 - 날짜가 하루 갈리고 두 읽기를 모두 남긴다: 한 패스는 2026년 4월 6일, TechCrunch URL 슬러그는 2026/04/07 을 준다. 어느 쪽도 1차로 확인되지 않았다
- 채택하지 않음: 한 애그리게이터의 $46B 는 Anthropic 쪽이 아니라 Broadcom–Google 계약을 가리킨다. Anthropic 약정의 금액도, 칩 수량도, TPU 세대명도, 부지 위치도 읽은 자료 어디에도 없다
- → Anthropic
논문 선택
둘 다 HuggingFace Daily Papers, 2026-09-21 에서 왔다. 업보트는 그 커뮤니티의 인기 신호일 뿐 그 이상이 아니다.
"ProgramDistill: From Interactive Web Apps to Verifiable Reference-Guided SWE Tasks" — arXiv 2609.18805 (2026-09-16, 업보트 50)
- TL;DR: 명세가 이슈 텍스트가 아니라 동작하는 애플리케이션 인 코딩 에이전트 벤치마크 — 에이전트는 레퍼런스 앱과 상호작용하며 동작을 추론한 뒤 미완성 앱에 구현한다. 26개 애플리케이션에 걸친 1,975개의 재생 검증된 동작 과 4,063개 과제 를 사람 개입 없이 구축했다
- 누적 워크플로에서 GPT-6 Astra 49.2%, Claude Opus 5 28.8%. depth 1 → 8 은 한 에이전트를 100% → 64.0%, 다른 에이전트를 96% → 32% 로 끌어내린다 — depth 1 에서는 벤치마크가 아무것도 가르지 못하고, depth 8 에서는 32 포인트 로 가른다
- 읽을 이유: 이 위키의 하네스 흐름이 지금까지 스캐폴드, 프롬프트, 채점자를 바꿔 왔다면 이것은 명세 경로 를 변수로 삼는다 — 그리고 하네스가 명시되어 있지 않아서, 20.4 포인트 의 프런티어 격차가 Eval Harness Configuration 이 기록하려고 존재하는 바로 그 공백 아래 놓인다
- → ProgramDistill: From Interactive Web Apps to Verifiable Reference-Guided SWE Tasks
"Confidence Comes from Experience: Experiential Confidence Estimation from Reasoning to Agents" — arXiv 2609.17708 (2026-09-15, 업보트 56)
- TL;DR: 기존의 신뢰도 추정기는 모두 현재 추론만 읽는다. XConf 는 대신 모델이 채점받은 자신의 과거 에피소드 기록 을 읽고, 과제 유사도 와 이전에 밝힌 신뢰도 로 꺼낸 뒤 되풀이되는 실패 양상을 짚고 다시 말하게 한다. 형식에 구애받지 않고, 로짓 접근도 가중치 갱신도 없으며, 답변 생성 한 번 의 비용이 든다
- 읽을 이유: 위 논문과 짝이다 — 그쪽은 에이전트가 성공했는지, 이쪽은 알고 있었는지를 잰다 — 그리고 논문들이 결과를 읽는 대신 구성요소를 계측해서 얻은 결과로 머리를 여는 것은 이것으로 세 주 연속 이다. 아홉 벤치마크, 네 모델, 그리고 확보한 텍스트에는 수치 결과가 하나도 없다
- → Confidence Comes from Experience: Experiential Confidence Estimation from Reasoning to Agents
주시
alignment.anthropic.com이 다섯 번째 실행 연속으로 닿지 않는다. 글 목록을 여전히sources/와 대조할 수 없다. 검색은 09-09 사이버보안 정렬 평가와 09-10 무기 관련 글을 반환했고 둘 다 이미 보유하고 있으며, 그보다 새로운 것은 없다. 그 소스는 2026-07-31 에 파일을 내지 않는 소스는 오류도 내지 않기 때문에 추가되었다 — 그리고 닿지 못하는 스윕 역시 오류를 내지 않는다. 차단된 세 리더보드가 이미 사는eval-snapshots.yml로 옮기자는 W38 린트의 제안은 아직 열려 있다2609.17488LimiX-2 가 업보트 371 을 받았고, 다음 항목은 133 이다. Contextual Mechanism Networks 패러다임 위의 구조화 데이터 파운데이션 모델로, 피처 어텐션에서 인과 골격을 복원한다고 주장한다. 작성하지 않았다 — 가중치가 걸린 관심 행 어디에도 들지 않고, 업보트 수는 이 위키가 중요도로 읽는 것이 명시적으로 금지된 신호다. 2위 대비 2.8× 격차가 이 스냅샷에 나온 적이 없기에 기록해 둔다- Z.ai 가 네 번째 확인 연속으로 아무것도 내놓지 않았다. GLM-5.3 (2026-08-14) 과 GLM-5.3-Flash (2026-08-26) 보다 새로운 것이 없고, GLM-5.5 는 모델 카드 없는 소문으로 남아 있다. 무언가 나왔을 때만 보고하는 로테이션은 아무 일도 없었다 와 아무도 보지 않았다 를 구분할 수 없기에 기록해 둔다
위키 신규
검토용. 오늘은 새 엔티티·개념·인물 페이지가 없다 — 아래 셋은 모델 하나와 논문 둘이며, 어느 것도 명명 판단을 요구하지 않는다.
업데이트
- Open-Weights Policy Fight: 새 머리 절 — 기존 오픈 웨이트 랩이 조건을 좁힌 것을 그 페이지에서 처음 기록했고, 비상업 조항이 모든 추적 지표의 숫자는 그대로 둔 채 그 숫자가 재려던 파생 생태계만 걷어낸다는 논지를 함께 실었다
- Frontier Pacing:
2026-09-19절이 붙었고, 이것은 그 페이지에서 자기 전제에 반대하는 첫 항목 이다. 세 근거를 표로 두고 에세이의 읽지 못한 부분을 명시해 정리했다 - Alibaba / Qwen AI Lab: 릴리스, 라이선스 원문, 그리고 로테이션의 랩 이름 질의가 이것을 찾지 못했다는 메모 — 버전 이름을 단 prefetch 후보가 찾았고, 두 실행 연속이다
- Anthropic: +168 의 Broadcom 소급 기록. 맨 위가 아니라 4월 항목들 사이 날짜 순서에 넣었고, 하루 갈리는 날짜를 밝혀 두었다
- Eval Harness Configuration: ProgramDistill 을 위한
2026-09-16절 — restoration depth 가 벤치마크가 아예 변별하는지 여부를 정하는 하네스 파라미터라는 것