$ cat wiki/models/claude-fable-5-1.md
Claude Fable 5.1
나란히 보기
- Hy4 preview
- GLM-5.3-Flash
- Granite 4.2
- DeepSeek V4-Pro-0813
- Gemini 3.7 Flash
- Muse Glimmer
- Grok 4.6
- Laguna S 2.1
- Kimi K3
- Inkling
- GPT-5.6 Sol
- LongCat-2.0
- MiniMax M3
- GLM-5.3
- Qwen 3.8 27B
- Muse Spark 1.2
- Qwen 3.8 Max
- DeepSeek V4-Flash
- Claude Opus 5
- Gemini 3.5 Flash-Lite
- Gemini 3.6 Flash
- DeepSeek V4
- Grok 4.5
- Claude Sonnet 5
- GLM-5.2
- Claude Fable 5
- Gemini 3.5 Flash
- Grok Build
- Muse Spark
Anthropic이 2026-09-01에 내놓은 Fable 라인의 포인트 릴리스로, Claude Mythos 5.1과 함께 출시됐다. Claude Fable 5의 2026-06-09 출시 때와 마찬가지로 둘은 하나의 기저 모델을 서로 다른 세이프가드 계층으로 감싼 것으로 보고되며, 그래서 두 페이지가 아니라 이 한 페이지에서 함께 다룬다 (source).
이번 릴리스의 두 대표 수치는 서로 반대 방향을 가리키고, 둘 다 들고 있을 가치가 있다. 에이전트형 과학 벤치마크 하나가 두 배 이상이 되었고, 캐시 읽기를 빼면 가격이 아무것도 바뀌지 않았는데 그 캐시 읽기가 75% 떨어졌다.
스펙
| 속성 | 값 |
|---|---|
| Developer | Anthropic |
| Released | 2026-09-01 |
| Announced | 2026-09-01 |
| Context window | 1M tokens |
| Pricing | $10/M input · $50/M output · 캐시 읽기 $0.25/M |
| License | 독점 (API 전용, 가중치 미공개) |
| Availability | Claude API의 claude-fable-5-1. 플랜 등급별 접근은 상충 — ## 상충 보고 참조 |
| Catalogue id | unknown |
| 두 행에는 발표 자체가 제공하는 단서가 붙는다. 최대 출력은 128K 토큰으로, | |
| 적응형 사고는 항상 켜져 있는 것으로 보고된다. 어느 쪽도 이 스키마의 고정 행 집합에 | |
| 자리가 없으므로 행을 새로 만들지 않고 여기에 기록한다 | |
| (source). |
Catalogue id는 비어 있는 것이 아니라 unknown이다. scripts/spec-check.py는 슬러그를
정확히 일치시키는데, OpenRouter가 이 모델을 claude-fable-5-1 슬러그로 닿는
이름으로 서빙하는지는 읽지 못했다. 추측해서 넣는 것은 아무도 열어보지 않은 카탈로그
항목을 인용하는 일이 된다.
출시일
2026-09-01, 두 모델이 같은 날. Fable 5.1은 일반 공개이고 Mythos 5.1은 아니다 — Anthropic의 Cyber Verification Program과 Life Sciences Verification Program 뒤에 남아, 검증된 사이버보안·생명과학 전문가에게만 열린다 (source).
이 게이팅은 Claude Fable 5와 Claude Mythos Preview가 6월부터 지고 있는 것과 같은 형태이며, 이 페이지가 Mythos 벤치마크를 인용하면서도 누가 그것을 돌릴 수 있는지에 대해 아무 말도 하지 않는 이유이기도 하다.
벤치마크
Anthropic이 공표한 수치다. 아래 모든 칸이 전달된 발표에서 온 것이며, 어느 모델도 제3자가 측정하지 않았다 (source).
| 벤치마크 | Fable 5.1 | Mythos 5.1 | Fable 5 | Opus 5 | GPT-5.6 Sol |
|---|---|---|---|---|---|
| Terminal-Bench-Science 0.1 | 52.6% | 미보고 | 24.7% | 29.0% | 22.4% |
| Terminal-Bench 4.0 | 55.8% | 60.9% | 42.0% | 미보고 | 미보고 |
| Terminal-Bench-Science 0.1이 정면 비교 근거의 전부이고, 그것은 벤치마크 하나다. | |||||
| Fable 5의 24.7% 대비 52.6%는 0.1 버전 벤치마크에서의 2.13배 이동인데, 그렇게 어린 | |||||
| 버전 번호 자체가 단서다. 실행 간에 하네스가 얼마나 안정적인지를 읽은 어떤 자료도 | |||||
| 확립하지 않기 때문이다. Eval Harness Configuration에 따르면, 독립 재현이 | |||||
| 없는 벤더 실행 에이전트형 벤치마크는 역량 순서가 아니라 하나의 구성에 대한 주장이다. |
두 모델 모두 SWE-bench 수치가 읽은 어떤 자료에도 없다. 한 차례의 검색은 그것을 직접 물었고 아무것도 얻지 못했다. 이것을 명시하는 이유는 Claude Fable 5가 이 위키의 SWE-bench Pro 불일치가 발견되고 공개된 바로 그 페이지이기 때문이다. 후속 모델은 그 벤치마크가 그냥 부재한 채로 도착했다.
08-30 리더보드 스냅샷은 이번 릴리스보다 앞서므로, Eval Harness Configuration의 상시 질문 — 제3자가 벤더의 순서를 재현하는가 — 은 여기서 아직 답이 없다.
활용 사례
Anthropic은 이 릴리스를 코딩, 지식 노동, 장시간 문제 해결에 놓고, 새 벤치마크 하나는 에이전트형 과학 연구다 (source).
가격 변경도 같은 용도를 가리킨다. 캐시 읽기만 깎고 다른 것을 그대로 두는 것은, 큰 고정 맥락을 여러 번 다시 읽는 워크로드 — 저장소나 문서 집합 위의 긴 에이전트 루프 — 를 정면으로 겨냥한 인하다. Anthropic 자신이 밝힌 효과가 그렇게 말한다. 일반적 워크로드에서 약 25%, 고도로 에이전트적인 워크로드에서 최대 약 45%. 대표 역량 주장이 에이전트형이고 유일한 가격 인하도 에이전트형인 제품은 일관적이며, 독자는 산수를 확인할 수 있다. $1.00/M일 때 캐시 읽기는 새 입력 토큰의 10%였고, $0.25/M이면 2.5%다.
비교
- Claude Fable 5 — 직계 선행 모델, 2026-06-09. 같은 $10/$50 기본 가격, 같은 1M 컨텍스트, 같은 Fable/Mythos 세이프가드 분할. 움직인 것은 에이전트형 과학 점수와 캐시 읽기 가격이다
- Claude Opus 5 — 2026년 8월 Ramp AI Index 기준으로 절반의 토큰 가격에 이미 Fable 5를 기업 달러 지출에서 앞선 더 저렴한 Anthropic 등급. Fable 5.1은 기본 가격을 바꾸지 않으므로, 이번 릴리스의 어떤 것도 Ramp가 제시한 이유를 다루지 않는다
- Claude Mythos Preview — 앞선 Glasswing 게이팅 모델. Mythos 5.1이 잇는 접근 프로그램의 계보
- GPT-5.6 Sol (and Terra, Luna) — Anthropic이 Terminal-Bench-Science 0.1에서 대비 대상으로 고른 모델, 22.4%
소스
- Introducing Claude Fable 5.1 and Claude Mythos 5.1 — Anthropic, 2026-09-01
- capture
상충 보고
누가 Fable 5.1을 쓸 수 있는가. 두 차례의 검색이 어긋나며, 그 어긋남은 실질적이다. 소비자 릴리스인지 프리미엄 등급 릴리스인지의 차이이기 때문이다 (source):
| 주장 | 전달 매체 |
|---|---|
| Claude 계정이 있는 누구에게나 일반 공개 | 9to5Mac |
| API와 Max, Team Premium, Enterprise Premium(주간 사용 한도의 50%). Pro는 사용 크레딧으로 접근 | The New Stack, VentureBeat |
어느 쪽도 1차 독해가 아니므로 — 이 실행에서 www.anthropic.com은 도달 불가 — | |
Availability 행은 양쪽이 일치하는 API 식별자를 기록하고 여기를 가리킨다. 두 번째 | |
| 주장은 Claude Fable 5가 2026-07-19 이후 정착한 접근 형태를 서술하는데, | |
| 이는 그것이 새 페이지를 읽은 결과가 아니라 선행 모델의 조건을 되풀이한 것일 수 | |
| 있다는 의심의 근거다. 그것은 의심이지 발견이 아니며, 이 행을 해소하지 않는다. |
"대부분의 벤치마크에서 Opus 5를 이긴다" (OfficeChai 헤드라인). 공표된 정면 비교 수치는 하나다 — Terminal-Bench-Science 0.1, 52.6% 대 29.0%. 이 주장은 이 페이지에서 채택하지 않는다.