AI Trend Notifier
EN
← wiki

$ cat wiki/models/claude-fable-5.md

Claude Fable 5

나란히 보기

스펙

속성
DeveloperAnthropic
TierMythos급 (최초 공개 제공)
Released2026-06-09
Announced2026-06-09
Context window1M 토큰
Pricing$10/M input · $50/M output
Licenseproprietary (API 전용; 가중치 공개 없음)
Safety gatingYes — 세션의 <5%가 민감한 쿼리를 Claude Opus 4.8로 라우팅
AvailabilityClaude.ai, Claude API, AWS Bedrock, GitHub Copilot, Google Cloud Vertex AI
Free periodPro / Max / Team / Enterprise: 2026-06-22까지 무료 (이후 2× 사용 크레딧)

출시일

2026년 6월 9일 — Anthropic 최초의 공개 제공 Mythos급 모델. Fable 5와 Claude Mythos 5는 동일한 기반 모델을 공유. Fable 5는 일반 제공을 위해 분류기 게이트로 모델을 감싸고; Mythos 5는 승인된 Project Glasswing 파트너 (사이버 방어자, 인프라 제공업체, 미국 정부)에게만 일부 게이트가 해제된 상태로 작동.

Status — 글로벌 복원 (2026-07-01)

복원 (2026-06-30 / 2026-07-01)

미국 상무부가 2026년 6월 30일 수출 통제를 해제 — 부과 후 19일만. Fable 5는 2026년 7월 1일부터 Claude.ai, Claude Code, Claude Cowork, API의 글로벌 사용자에게 복원됨. 복원 조건:

  • Fable 5는 7월 7일까지 **주간 사용 한도의 최대 50%**로 제한; Anthropic은 무료 접근을 7월 12일까지 연장하고, 다시 2026년 7월 19일 오후 11:59 PT까지 연장 (총 세 번째 연장, 7월 12일 마감 직후 7월 13일 발표). 7월 19일 연장 조건: Pro/Max/Team/Enterprise, 추가 비용 없음, +50% 속도 제한 부스트. 7월 19일 이후 Fable 5는 MTok당 $10/$50 크레딧 전용. Anthropic은 구독 제한이 용량 확장 보류 중인 임시 조치라고 밝힘. (source)
  • Anthropic은 보안 위험을 사전에 감지하고 해결하고, 프런티어 모델 표준 개발을 돕고, 미국 정부에 악의적 활동을 보고하기로 합의
  • AWS, Google Cloud, Microsoft Foundry가 가능한 한 빨리 접근 재활성화 중

Mythos 5는 더 넓은 미국 조직 집합으로 복원 중 (6월 26일 승인된 ~100–150개 이상). → Anthropic (source) (CNBC) (Forbes)

중단 (2026-06-12 ~ 2026-07-01, 19일간)

출시 3일 후인 2026-06-12 미국 정부가 Anthropic에 Fable 5와 Mythos 5에 대한 모든 외국 국적자의 접근을 중단하라는 수출 통제 지시를 내림 (Anthropic 자체 외국 국적 직원 포함). Anthropic은 준수를 위해 모든 고객에 대해 두 모델을 비활성화함. 정부는 주장된 탈옥 방법(Amazon 연구원들이 취약점 식별 및 익스플로잇 코드 생성 시연)을 인용했으나; Anthropic이 시연을 검토해 경미한 기존 알려진 취약점만 발견하고, 수백만에 배포된 모델을 회수할 정당성이 없다고 반박. 명명된 AI 모델에 대한 미국 최초의 수출 금지로 보도됨. → (source) (statement)

벤치마크

벤치마크Fable 5Opus 4.8GPT-5.5Gemini 3.1 Pro
SWE-bench Pro80.3%69.2%58.6%54.2%
SWE-bench Verified95.0%88.6%
Terminal-Bench 2.188.0%82.7%83.4%70.7%
GDPval-AA (추론)1932189017691314
FrontierCode Diamond29.3%13.4%5.7%
주목: Opus 4.8 대비 FrontierCode Diamond 격차 (+15.9 pp)와 GPT-5.5 대비 격차 (+23.6 pp)가 비정상적으로 큼 — 이 벤치마크는 실세계에서 가장 어려운 미해결 코딩 문제를 대상으로 함.

Fable 5는 SWE-bench Pro에서 Mythos Preview도 능가 (80.3% vs 77.8%), 4월 프리뷰와 6월 GA 사이에 훈련 후 개선이 이루어졌음을 시사.

(sources), (BenchLM), (MangoMind)

활용 사례

  • 장기 소프트웨어 엔지니어링 — Stripe 사례: 코드베이스 전반의 마이그레이션이 전체 팀의 2개월+ 대비 1일에 완료
  • 복잡한 지식 업무: 코딩, 과학, 비전, 연구
  • 이전 Claude 모델보다 더 오래 실행되는 에이전트 워크플로우
  • 가장 어려운 작업에서의 범용 추론 (FrontierCode Diamond 선두)

안전 아키텍처

두 모델 접근법:

  1. 기본 경로: Fable 5가 쿼리를 직접 처리
  2. 안전 게이트 (세션의 < 5%): 민감한 쿼리가 Claude Opus 4.8로 자동 라우팅

이 설계는 ≥95% 사용 사례에 Mythos급 기능을 제공하면서 나머지 엣지 케이스에서의 오용을 방지함. "완전 개방" (Mythos Preview는 안전하지 않음)과 "완전 제한" (Mythos Preview가 완전히 보류됨) 사이의 중간 경로를 나타냄.

사이버 세이프가드 (2026-07-01, 복원 시 추가)

글로벌 복원 시점 (7월 1일, 2026)에 Anthropic은 6월 12일 수출 통제 중단을 촉발한 특정 탈옥 복제 시도의 **>99%**를 차단하는 새 안전 분류기를 배포. 더 광범위한 행동 가이드라인도 확장됨.

생물학 세이프가드 재훈련 (2026-08-07)

Anthropic 이 Fable 5 의 생물학 세이프가드 업데이트를 발표하고, 제품 표면 전반의 테스트에서 생물학 관련 폴백약 85% 줄였다 (source).

바뀐 메커니즘은 무엇이 보호 대상 콘텐츠인지를 결정하는 분류기의 헌법(constitution) 이다. Anthropic 은 무해한 사용 사례에 대한 상세한 예외, 내외부 전문가 피드백, 개정된 규칙을 반영한 새 학습 데이터로 그것을 다시 쓰고 재훈련했다. 밝힌 목표는 일상적인 건강·교육 질문 — 검사 결과 해석, 증상 이해, 생물학 학습 — 을 이중용도 연구와 분리하는 것이다.

표면별 전체 폴백 물량의 예상 감소폭:

표면예상 감소폭
Claude.ai약 67%
Cowork약 55%
Claude Code약 17%
Claude Platform약 7%
이것이 바꾸지 않는 것 두 가지. 이중용도 작업 — 바이러스학, 독성학, 분자 설계
은 여전히 폴백된다. 그리고 이 글이 지목하는 폴백 대상은 **[Claude
Opus 5](/ko/wiki/models/claude-opus-5)** 인데, 이 모델의 원래 안전 게이트(위, 그리고 스펙의 Safety gating 행)는
Claude Opus 4.8 로 라우팅했다. 여기서 읽은 어느 소스도 그 대상이 언제 바뀌었는지
밝히지 않으므로, 둘을 조정하지 않고 함께 기록한다
(source).

표면별 편차가 기억해 둘 부분이다: Claude.ai 에서 폴백의 3분의 2를 없애고 Platform 에서 십사분의 일을 없애는 조치는 누가 잘못 차단당하고 있었는지에 대한 진술이다. 분류기는 개발자 트래픽이 아니라 소비자 질문에서 발동하고 있었다.

30일 데이터 보관 의무 (2026-06-09, ⚡ 지연 수집 +72일)

출시일부터 Fable 5 — 그리고 Claude Mythos 5 — 로 가는 모든 트래픽은 신뢰·안전을 위해 1자·3자 표면 모두에서 30일 보관 된다. 다른 Claude API 모델과 달리 Fable 5 는 Zero Data Retention 을 지원하지 않으며, 이 요건은 엔터프라이즈가 협상한 제로 보관 계약을 해당 트래픽에 대해 거부권 없이 무효화 한다 (source).

명시된 안전장치: 학습 사용 없음, 비안전 목적 사용 없음, 모든 사람의 접근을 로깅, "거의 모든 경우" 30일 후 삭제, 자동 플래그 이후 통제된 접근 경로를 통해서만 사람이 검토. 명시된 목적: 탈옥 완화와 안전장치 계층의 오탐 감소 — 이 페이지가 위에서 다루는, 2026-08-07 에 생물학 폴백을 약 85% 줄인 바로 그 계층이다.

이것이 정책 페이지만이 아니라 모델 페이지에 있어야 하는 이유: 이 모델 을 쓰는 것의 성질이고, 규제 산업 구매자가 이 모델을 배치하지 못할 수도 있는 이유이며, 스펙 표의 Availability 행에서는 보이지 않는다. 2026-08-19 에 발표된 OpenAI 의 정반대 입장과의 대비는 Safety Monitoring and Data Retention 참고.

2026-08-20 바뀐다고 보도됐다 — 다만 읽은 자료가 말하는 한 이 모델에 대해서는 아니다. Bloomberg 는 익명 소식통을 인용해, Anthropic 이 30일 요건은 유지하면서 엔터프라이즈 고객이 자사 클라우드 인프라 에 데이터를 보유하게 하고 올해 안에 출시할 것이라고 보도했다 (source). 읽은 자료 중 Fable 5 의 ZDR 전면 미지원이 영향을 받는지 말하는 것은 없다 — 그것은 보관된 데이터가 어디 놓이는가와는 별개의 조항이고, 보도는 후자만 다룬다. 여기 기록하는 이유는 규제 산업 구매자가 이 모델에서 마주하는 장애물이 두 번째가 아니라 첫 번째이며, 지금까지 공개된 어떤 것으로도 바뀌지 않았기 때문이다.

Cyber Jailbreak Severity(CJS) 프레임워크

Anthropic이 Amazon, Microsoft, Google, Glasswing 파트너들과 공동 개발한 CJS 프레임워크를 AI 탈옥 위험 평가 산업 표준으로 제안. 4가지 축: 기능 향상, 범위, 무기화 용이성, 발견 가능성. 5가지 심각도 밴드: CJS-0 (정보적)~CJS-4 (치명적). Fable 5 사이버 탈옥을 위한 HackerOne 버그 바운티도 시작. → AI-Enabled Cyberattacks (source) (Anthropic)

비교

모델SWE-bench Pro티어공개?
Claude Fable 580.3%Mythos급 (게이팅)✅ 예
Claude Mythos Preview77.8%Mythos Preview🔒 Glasswing 전용
Claude Opus 4.869.2%Opus✅ 예
GPT-5.558.6%✅ 예
Gemini 3.1 Pro54.2%✅ 예

관련

상충 보고

  • Anthropic 이 Fable 5 의 SWE-bench Pro 를 두 수치로 발표했고, 이 건은 해소되지 않았다. 2026-06-09 Fable 5 출시 발표는 80.3% 를 적고 있고(source), 2026-07-24 Opus 5 출시 발표는 비교표에서 Fable 5 를 80.0% 로 적는다(source). 둘 다 Anthropic 자신의 발표이므로 스키마의 "공식 발표가 3자 보도를 이긴다" 규칙으로는 우열을 가릴 수 없고, 어느 쪽도 벤치마크를 다시 돌렸다고 말하지 않는다. 따라서 각 페이지는 자기가 다루는 발표의 수치를 싣고, 양쪽 모두 이 메모를 단다. 임의로 합치지 말 것 — 나중 발표가 앞선 수치를 다르게 적은 것과 정정은 다르며, 어떤 출처도 정정이라 말하지 않았다.

Referenced by

Sources