$ cat briefs/daily/2026-08-30.md
2026-08-30
2026년 8월 30일 (일)
5개 스토리 · 2개 신규 페이지 · 0개 논문 픽 · 4개 관찰 항목
> **오늘은 논문 픽이 없고, 그것은 fetch 실패가 아니다.** 오늘의 HuggingFace Daily > 스냅숏은 존재하고, 파싱되었고, 25개 항목을 담고 있다 — 그리고 그 arXiv ID 집합은 > 어제 것과 **정확히 한 건의 교체**만큼만 다르며 양쪽 모두 이 위키가 이미 보유하고 > 있다. **새 ID 0개.** 목록이 하루 동안 돌지 않았으므로, 읽을 것이 없는 게 아니라 > 고를 것이 없는 것이다. > **스냅숏 Action 은 08:05 에도 아직 실행되지 않았고, 이는 나흘 연속이며, 이번 실행이 > 다시 수동으로 디스패치했다.** 두 cron 모두 예정 시각을 넘겼고(각각 65분, 45분) > 생성된 실행이 없었다. 수동 디스패치가 약 20초 만에 세 파일을 모두 기록했다. > 스크레이퍼는 매번 작동하고, 스케줄러는 그렇지 않다 — 오늘 W35 린트에 점검 2o 로 > 이월한다.
주요 소식
1. 이 위키가 보유한 최대 오픈 웨이트 모델이 가장 적은 조건을 달고 나왔고, 그 랩은 여기에 페이지도 없었다 — 점수 2.00
- Tencent Hunyuan 이 2026-08-28 에 Hy4 preview 를 공개하고 같은 날 오픈소스화했다 — 총 770B 파라미터, 활성 49B, 78 레이어(그중 77 개 희소, 라우티드 익스퍼트 256 개 + 공유 1 개, top-8 라우팅) 위의 MoE, 추측 디코딩용 네이티브 MTP 레이어 1 개(10B/0.7B), 1M 토큰을 넘는 컨텍스트. BF16 체크포인트와 FP8 양자화 모두 Apache 2.0, ModelScope · GitCode · CNB 미러링; API 는 Tencent Cloud TokenHub 및 OpenRouter 에서 $0.834/M input · $2.501/M output (source)
- 벤더 수치: Terminal Bench 2.1 85.4, DeepSWE 28.0 → 64.3, 그리고 Tencent 전문가 163명이 채점한 엔지니어링 과제 203건의 내부 블라인드 평가에서 2.99/4 로 Kimi K3 의 2.94 와 GLM-5.3 의 2.92 를 앞섰다 — GLM-5.3 대상 맞대결은 46.8% 승 / 12.8% 무 / 40.4% 패
- 의의: 15일 안에 중국 오픈 웨이트 릴리스가 셋이었고, 라이선스가 모델 자체보다 더 깔끔하게 갈린다 — GLM-5.3-Flash 는 MIT, Qwen3.8-Flash-Next 는
qwen-community-1.0, GLM-5.3 은 매출 100억 달러 초과 사업자에 대한 보안 심사 조항, 그리고 넷 중 가장 큰 것이 Apache 2.0 그대로. 가장 큰 모델이 가장 느슨한 조건을 달았다 - 확립되지 않은 것이 많다: 어느 벤치마크 행에도 하네스가 명시되어 있지 않고; 블라인드 평가는 측정 대상 당사자가 설계·실행·채점했으며 그 격차는 4점 척도에서 0.05 와 0.07 인데 분산도 신뢰구간도 공개되지 않았고; 제3자가 이 모델을 전혀 측정하지 않았다 — 같은 날 아침 Artificial Analysis 캡처에 없으며, 그 표는 Tencent 를 이전 모델 Hy3 의 Index 42 로만 등재한다. 여기 어느 것도 일차 자료로 읽지 못했다:
tencent.com과huggingface.co둘 다 이 샌드박스에서 차단되어 있다 - 검증 가능한 주장 하나가 맞아떨어지지 않는다. 85.4 는 DeepSeek V4-Pro 를 앞선 것으로 보도되는데, 이 위키는 2026-08-14 부터 DeepSeek V4-Pro-0813 에 대해 벤더 자체 수치 87.9 를 보유하고 있고 그쪽 역시 하네스가 공개되지 않았다. 양쪽 출처에 상충으로 기록하며 해소하지 않는다
- → Hy4 preview (신규), Tencent (신규), Open-Weights Policy Fight
2. 리더보드가 재는 대상을 바꿨고, 아무도 모델을 건드리지 않았는데 모든 모델의 대표 수치가 움직였다 — 점수 1.56
- Hugging Face 가 인도 영어를 Voice Arena Monsoon 으로 Open ASR Leaderboard 에 추가하면서 선택형 토글 뒤가 아니라 기본 열 집합에 놓았고, 그 결과 이제 모든 등재 모델의 대표 Average WER 에 기여한다. 공개 및 비공개 힌디어는 Multilingual 탭에 합류하며, 그 탭에서는 선택된 언어를 모두 지원하는 모델만 순위에 오른다. 이 리더보드의 첫 글로벌 사우스 언어로 소개되었다 (source)
- 의의: 핵심은 전적으로 기본 열 배치다. 선택형 열은 참여하지 않는 모델에게 아무것도 바꾸지 않지만, 기본 열은 아무것도 재학습되지 않고 아무것도 재제출되지 않은 채 보드 전체를 다시 채점한다. Eval Harness Configuration 문제가 한 층 올라간 것이다 — 어떤 하네스가 이것을 돌렸는가에서 어떤 언어들이 평균에 들어가는가로
- 빠진 것: 전후 비교표도, 순위가 바뀐 모델도, Average WER 이 얼마나 이동했는지의 수치도 없다. 재채점은 일어났고 그 규모는 공개되지 않았다
- → Hugging Face, Eval Harness Configuration
3. 유지보수자들은 이제 익스플로잇이 패치보다 먼저 온다고 말하고, 그 근거는 일화다 — 점수 1.50
- Anil Madhavapeddy — 케임브리지 컴퓨터과학자이자 OCaml 컴파일러 코어 유지보수자 — 는 패치가 논의를 위해 공유된 뒤 몇 분 안에 익스플로잇 시도가 관측되며, 그 입력이 diff 가 아니라 버그에 대한 소문이라고 보고한다. rclone 유지보수자는 첫 10년간 약 20건이던 보안 제보가 지난 한 달에만 40건을 넘었다고 보고한다. 요약 주장: 평균 익스플로잇까지의 시간이 이제 −7일. Simon Willison 을 통해 2026-08-28 에 올라왔다 (source)
- 의의: AI-Enabled Cyberattacks 의 다른 모든 항목은 통제된 평가 안에서 공격 역량을 측정한다 — CyberGym, ExploitGym, Chrome V8 건수. 이것은 일상적인 오픈소스 유지보수에 미치는 효과를 보고하는 첫 항목이고, 역량이 어딘가에 착지한다면 착지하는 곳이 거기다
- 주장과 함께 약점도 읽을 것: −7일에 대한 방법론이 공개되어 있지 않다 — 표본도, 정의도, 기간도 없다; 모델도 에이전트도 하네스도 지목되지 않았으므로 코딩 에이전트로의 귀속은 측정이 아니라 저자들이 패턴을 읽어낸 것이다; 그리고 제보는 익스플로잇이 아니다. 한계를 명시한 신호로 싣되 발견으로 싣지 않는다
- → AI-Enabled Cyberattacks, Agents (LLM Agents)
4. 이 위키가 나흘 전에 공개한 문장이 거짓이 되었고, 그것을 잡아낸 것은 이미 커밋된 리더보드다 — 점수 1.20
- Qwen3.8-Flash-Next 에는 "제3자가 이 모델을 측정한 적은 전혀 없다"고 적혀 있었다. Artificial Analysis 가 이제 등재하고 있다 — Intelligence Index 56, 컨텍스트 256k, Cost per Task $0.10 — 2026-08-23 캡처에는 없고 08-29 및 08-30 캡처에는 있다 (source)
- 의의: 이 정정은 파이프라인이 이미 커밋해 둔 파일에서 나왔고, 그 파일이 반박하는 페이지와 아무도 대조해 보지 않았다. 이 시스템이 찾을 수 있는 가장 값싼 종류의 오류이자 가장 방치되기 쉬운 오류다
- 보이는 것보다 덜 해소한다. Artificial Analysis 는 SWE-bench Pro 나 JobBench 가 아니라 합성 지표를 공개한다 — 따라서 그 페이지가 독립적 확인 대상으로 지목한 19.1 포인트 JobBench 격차는 여전히 Alibaba 바깥의 누구도 읽지 않았다. 56 은 이제 둘이 함께 등장하는 유일한 척도에서 GLM-5.3-Flash (57) 보다 한 점 아래다
- → Qwen3.8-Flash-Next, GLM-5.3-Flash
5. OpenAI 가 자사 소유가 아닌 최대 AI 코딩 제품을 끊었고, 이유는 안전이 아니라 계약이다 — 점수 1.09
- Our decision on Cursor following its acquisition by SpaceX (2026-08-28) 는 Cursor 의 OpenAI 모델 직접 접근을 2026-11-12 에 종료한다. OpenAI 는 SpaceX 가 자사 이용약관 범위 안에서 기술을 쓰리라 확신할 수 없다고 밝히며 Twitter 인수 건과 xAI 가 해당 약관 위반을 인정한 사실을 근거로 든다 (source)
- Cursor CEO Michael Truell 은 OpenAI 의 비중을 Cursor 트래픽의 약 5% 로 제시하고, Anthropic 은 Claude 지원 확대 약속으로 답한 것으로 보도되었다
- 의의: 이 위키가 GPT-5.6-Cyber 와 Astra 에서 추적하는 게이트들은 모델이 무엇을 할 수 있는지를 제한한다. 이것은 누가 그것을 재판매할 수 있는지를 제한하며, 프런티어 연구소가 계약을 이유로 유통을 회수한 사례로는 여기 보유된 첫 건이다. 덜 분명한 절반은 xAI 쪽이다 — 그 페이지의 Grok 모델 셋이 Cursor 로 학습된 것으로 기록되어 있으므로, 인수는 xAI 코딩 라인이 세워진 워크플로 데이터의 출처이고, 이제 그것을 소유한 대가로 제품이 공급자 하나를 잃는다
- 점수에 관하여 — 오늘 가장 큰 외부 뉴스인데 마지막에 놓였기 때문이다.
official_blog1.2 × business deals 0.7 × OpenAI 1.3 으로 채점했다. 대신 에이전트/툴 사용 항목으로 읽으면 — Cursor 는 에이전트 도구이고interests.md는 그 항목에 1.5 를 준다 — 2.34 가 되어 브리프를 이끌게 된다. 그 독법을 택하지 않은 이유: 이 건은 에이전트가 무엇을 할 수 있는지의 변화가 아니라 재판매 권리에 대한 계약 결정이고,interests.md는 그 항목의 추적 신호로 "changes to agents/MCP standards" 를 명시한다. 반론할 수 있도록 대안 점수를 함께 적는다 - → OpenAI, xAI, Model Routing
논문 픽
오늘은 없음. 오늘의 HuggingFace Daily 스냅숏은 파싱되었고 25개 항목을 담고 있으나 그 arXiv ID 중 새로운 것은 0개다. 집합이 어제 것과 한 건의 교체만큼 다르다 — 2608.24358 (The Handoff Tax) 들어오고, 2608.24987 (D³-MOPD) 나감 — 그리고 둘 다 2026-08-29 에 이미 처리되었다. 앞의 것은 페이지를 얻었고 뒤의 것은 읽고 보류되었다 (source).
관찰
- 스냅숏 Action 의 스케줄러, 나흘 연속. 5시간(08-27), 8시간(08-28), 46분 초과 후 미실행(08-29), 오늘 65분 초과 후 미실행 — 매번 수동 디스패치나 뒤늦은 폴백이 있어야 복구되었다. 누군가 없어진 것을 알아채야 굴러가는 일일 인용은 일일 인용이 아니다
- Anthropic Alignment Science 의 미캡처 게시물 두 건, 19일째. Introspection Adapters (2026년 4월) 와 The Hot Mess of AI (2026년 2월). 이번 실행에서는 인덱스를 아예 읽지 못했다 —
alignment.anthropic.com이 이 샌드박스에서 차단되어 있다 — 따라서 이는 이번 실행에서 읽을 수 없었음으로 기록하며 이상 없음으로 기록하지 않는다 - "GLM-5.5" 가 돌고 있고 뒷받침하는 것이 없다. 모델 카드도, 발표도, 일차 페이지도 없다 — 2026-08-24 부터 보류해 온 "GLM-5.2 Turbo" 카탈로그 등재와 같은 처리다. 버전 번호가 붙은 소문도 여전히 소문이다
spec-check충돌 7건이 오늘 린트로 이월, 그중에는 네 벤더에 걸쳐 정확히 2배씩 어긋난 가격 수치 여덟 개가 있다.openrouter.ai는 이 샌드박스에서 차단되어 있으므로 공개된 가격을 검증하는 것은 여전히 GitHub Action 뿐이다
위키 신규
- Tencent (신규 — 신규 엔티티 페이지, 검토 권장) — 의도적으로 얇다. 주요 인물은 누군가를 지목하는 대신 "확립되지 않음"이라 적었고, Hy3 은 페이지 없이 리더보드 행으로만 보유한다. Hy4 이전의 Hy 계열을 서술하는 캡처가 없기 때문이다
- Hy4 preview (신규)
업데이트
- OpenAI · xAI: Cursor 접근 결정, 그리고 페이지로 올리지 않고 캡처에 남긴 인수 완료일
- Hugging Face: Open ASR Leaderboard 의 기본 열 변경
- Qwen3.8-Flash-Next: 첫 독립 측정치, 그리고 그 측정치가 다루지 않는 것
- Open-Weights Policy Fight: 네 건의 릴리스 라이선스 비교
- AI-Enabled Cyberattacks: 패치보다 먼저 오는 익스플로잇 보고