$ cat briefs/daily/2026-08-11.md
2026-08-11
2026년 8월 11일 (화)
3건 · 논문 1건 · 워치 2건 · 새 페이지 3건
묵직한 월요일이었고, 분포가 이례적으로 고르다. Meta, OpenAI, Anthropic 이 각각 한 건씩 1급 소식을 냈고 모두 2026-08-10 자다. 그중 둘은 어떤 역량을 누가 쥐어도 되는가에 대한 이야기이며, 서로 반대 방향으로 답한다.
+3new pages
[01]
주요 소식
1. Meta 가 자사 플래그십의 학생 모델을 Apache 2.0 으로 공개했다 — 교사 모델은 닫아 둔 채로
- Muse Glimmer, 2026-08-10: 30B 덴스 멀티모달 모델을 Hugging Face 에 Apache 2.0 오픈 웨이트로 공개했다. 컨텍스트 131,072, 100개 이상의 언어, 그리고 4비트 양자화가 메모리를 55 GB 에서 18–20 GB 로 줄이는 것으로 보고된다 — 소비자용 GPU 한 장이다 (source).
- 이 모델은 Muse Spark (1.0 / 1.1) 로부터 증류되었다. 사전학습에 교사 모델 출력에 대한 logit distillation 을 썼고, 중간 학습에서 에이전트 중심 데이터와 더 긴 컨텍스트를 더했다. 그 교사 모델 Muse Spark 1.2 는 닷새 전에 닫힌 유료 API 로 출시되었다.
- Meta 자체 에이전트 수치: MCP Atlas 75.5, Gemma4-31B 의 54.2 와 Qwen3.6-27B 의 62.5 대비. 그 밖에 DeepSearch QA 74.6, Gaia2 43.3, SWE-Bench Pro 51.2. 어느 것도 독립 측정이 아니고, 이 저장소의 평가 스냅샷에는 그 스위트들에 대한 열이 없어 대조할 근거가 없다.
- Mark Zuckerberg 는 정책 논거를 함께 내놓았다. 미국 오픈소스 모델이 장기적으로 앞서려면 미국 정책이 마찰을 줄여야 한다는 것이며, DeepSeek 과 Moonshot 을 "미국 프런티어에 불편할 만큼 가까이" 온 상대로 지목했다.
- 왜 중요한가: "Meta 가 오픈소스로 돌아왔다"가 보도의 틀이었지만 실제로 벌어진 일은 그것과 조금 다르다. 프런티어 모델은 닫힌 채로 남고 파생 모델이 열렸다. 하나의 제품 라인에서 닷새 간격으로. Llama 시절의 열린 프런티어도 아니고 2026년 봄의 닫힌 전환도 아닌 세 번째 입장이다. 수익이 있는 자리에서는 Meta 가 아무것도 치르지 않으면서 정책 논거는 통째로 얻는다.
- → Muse Glimmer, Meta AI, Open-Weights Policy Fight
2. OpenAI 가 사이버 위험으로 모델 하나의 속도를 늦춘 지 사흘 만에, 덜 거부하도록 학습된 사이버 모델을 출시했다
- GPT-5.6-Cyber, 2026-08-10. Daybreak 을 두 티어로 나누는 개편과 함께 출시되었다. Blue 는 승인된 방어자에게 완화된 범용 모델을 열어 주고, Red 는 승인된 취약점 연구와 익스플로잇 검증을 위해 새 모델을 더 엄격한 심사 뒤에 둔다 (source).
- Sol 위에 구축되었고 제로데이 발견과 익스플로잇 체인 구축 능력을 높이도록, 그리고 이중용도 작업에서 명시적으로 덜 거부하도록 학습되었다. 공개된 단 하나의 수치는 역량이 아니라 응답 여부를 잰다 — Advanced Cybersecurity Completion Rate 95.0%, GPT-5.5-Cyber 의 57.3%, Daybreak Blue 를 통한 Sol 의 2.0%, 표준 안전장치가 적용된 Sol 의 1.5% 대비.
- OpenAI 는 이 모델로 알려지지 않았던 V8 취약점 2건을 찾았다고 보고한다. Chrome 힙 샌드박스 탈출로 연결 가능한 것들이다. 가격도, 시스템 카드도, Preparedness 등급도 공개되지 않았다. 개인 Daybreak 계정의 하드웨어 보안 키는 2026-09-01 부터 의무가 된다.
- 왜 중요한가: 2026-08-07 에는 Preparedness Framework 가 Astra 의 개발 속도를 늦춘 이유로 제시되었다. 사흘 뒤 사이버 모델이 나왔다. 두 결정은 갈라 볼 수 있다 — 하나는 미출시 플래그십의 개발을, 다른 하나는 더 좁은 모델의 배포를 심사 뒤에 두는 것이다 — 그러나 OpenAI 는 그 짝지음을 언급하지 않았고, 프레임워크의 공개된 티어는 두 종류의 게이트를 구분하지 않는다. 그 차이가 무게를 지닌 첫 사례이며, 답은 나와 있지 않다.
- → GPT-5.6-Cyber, Preparedness Framework, AI-Enabled Cyberattacks
3. 미공개 Claude 가 160년 된 하한을 옮겼고 — 누구나 검사할 수 있는 증명을 공개했다
- Anthropic 은 2026-08-10, 미공개 연구 버전의 Claude 에게 리만 가설에 도전하게 했더니 가설을 풀지는 못했지만 임계선 위에 놓인 제타 영점 비율의 증명된 하한을 41.6% 에서 67.2% 로 끌어올렸다고 밝혔다 — 이 문제 역사상 최대 폭의 단일 개선으로 보고되었고, 수십 년의 인간 작업으로 쌓인 수치를 밀어냈다 (source).
- Lean 으로 형식 검증되었고 증명은 공개되어 있으며, 외부 수학자 Brian Conrey 와 Dan Goldston 이 검토했다.
- Anthropic 은 이것이 가설의 증명이 아니며 이 접근이 증명으로 이어지리라 기대하지 않는다고 분명히 말한다 — 하한은 더 큰 시도의 의도치 않은 부산물이었다.
- 왜 중요한가: AI for Mathematics 가 여기 존재하는 이유는 이런 주장에서 어려운 부분이 생성이었던 적이 없기 때문이다. 어려운 것은 연구소 밖의 누군가가 결과를 검사할 수 있는가다. 앞선 OpenAI 결과 둘은 모두 인간 편집 단계를 필요로 했고, Astra 의 열 개 결과는 증명서와 함께 왔지만 모델은 공개되지 않았다. 이번 것은 그 페이지에서 검증이 공개되어 있고, 기계로 확인 가능하며, 연구소 자신의 설명과 독립적인 첫 항목이다 — 게다가 연구소가 대표 수치 옆에 스스로 천장을 붙여 공개했다.
- → More than two thirds of the zeros of the Riemann zeta function lie on the critical line, AI for Mathematics, Anthropic
[02]
논문 픽
More than two thirds of the zeros of the Riemann zeta function lie on the critical line — Anthropic, 2026-08-10 (Lean formalisation)
- TL;DR: 수학적 착상은 임계선 위와 밖의 영점을 따로 분석하는 대신 하나의 통합된 기하학적 공간으로 다루어 더 강한 부등식을 얻은 것이다. 실행은 Claude Code 에서 두 세션에 걸쳐 약 하루 반 걸렸다 — 출력 토큰 31M, 초기 아이디어 650개, 서브에이전트 약 60개, 셸 명령 2,400건.
- 읽을 이유: 결과와 무관하게 메커니즘 자체가 흥미롭다. 사람이 손으로 돌리지 않는 규모의 아이디어 생성과 걸러내기이며, 이 위키가 코딩 작업에 대해 추적해 온 바로 그 에이전트 하네스를 정수론의 미해결 문제로 겨눈 것이고, 증명 보조기가 다시 검사할 수 있는 산출물을 남긴다.
- → More than two thirds of the zeros of the Riemann zeta function lie on the critical line
[03]
워치
- DeepSeek V4-Pro 의 보도된 GA 창이 어제 열렸고 아무것도 없었다. 7월 28일 중국 언론의 목표는 8월 10–20일 이었다. DeepSeek 채널 어디도 확인해 주지 않으며, V4-Pro 는 여전히 4월 24일 프리뷰다. 창의 이틀째. → DeepSeek V4
- Gemma 팀 행사가 2026-08-20 로 예고되었다. 산출물이 붙지 않은 날짜이고, Google 채널이 아니라 r/LocalLLaMA 를 통해 나왔다. Gemma 4 12B 와 Nano Banana 2 Lite (Gemini 3.1 Flash Lite Image) 가 모두 이 위키에 있고, Gemma 신규 출시라면 Muse Glimmer 가 방금 차지한 체급에 떨어지기 때문에 적어 둔다. → Google DeepMind
[04]
위키 신규
- Muse Glimmer (신규 — Meta 의 30B Apache 2.0 에이전트 모델. 벤치마크는 Meta 자체 수치이고 대조할 로컬 근거가 없다. 1자 호스팅 요금이 공개되지 않아
Pricing은unknown.) - GPT-5.6-Cyber (신규 — OpenAI 의 Daybreak Red 사이버 모델.
Context window와Pricing은unknown이고, 출시 다음 날까지 시스템 카드도 Preparedness 등급도 없다.) - More than two thirds of the zeros of the Riemann zeta function lie on the critical line (신규 — 제타 하한. arXiv ID 는 나오지 않았고, 보고된 저자 표기는 "Claude; Anthropic" 으로 승인이 아니라 보고된 그대로 기록했다.)
[05]
업데이트
- Meta AI: Muse Glimmer 를 모델과 제품 및 최근 활동에 추가
- OpenAI: Daybreak 분할과 GPT-5.6-Cyber 추가, Astra 와의 짝지음은 해소하지 않고 열어 둠
- Anthropic: 제타 결과를 최근 활동에 추가
- Open-Weights Policy Fight: 열린 학생 / 닫힌 교사 구도를 번복이 아니라 세 번째 입장으로 기록
- Preparedness Framework: GPT-5.6-Cyber 의 등급 부재를 기록하고, 개발 게이트와 배포 게이트의 구분을 명시
- AI-Enabled Cyberattacks: 새 열린 문제 — 공격 역량을 심사받은 방어자에게 배포하는 것이 이제 업계의 표준 답인데 이를 검증한 공개 근거가 없다
- AI for Mathematics: 현재 수준을 다시 씀. "독립적으로 재현 불가" 문제에 이제 2026년의 두 대표 결과 모두 미공개 모델에서 나왔다는 점을 덧붙임