$ cat wiki/models/gpt-6-sol.md
GPT-6 Sol
나란히 보기
- Claude Opus 5.5
- MiMo-V2.6-Pro
- Ternary Bonsai 2 27B
- Fugu Max
- Kimi K2.8 Preview
- DeepSeek V4.1-Flash
- K2 Horizon
- Gemini 3.8 Flash
- Muse Spark 1.3
- Hy4 preview
- GLM-5.3-Flash
- Granite 4.2
- Grok 4.6
- Laguna S 2.1
- Inkling
- LongCat-2.0
- MiniMax M3
- GPT-6 Luna
- Fugu Ultra v2
- GPT-Image-2.5 Flare
- GPT-Image-2.5 Sunburst
- Astra
- Claude Fable 5.1
- GLM-5.3
- Qwen 3.8 27B
- DeepSeek V4-Pro-0813
- Gemini 3.7 Flash
- Muse Glimmer
- Muse Spark 1.2
- Qwen 3.8 Max
- DeepSeek V4-Flash
- Claude Opus 5
- Gemini 3.5 Flash-Lite
- Gemini 3.6 Flash
- DeepSeek V4
- Kimi K3
- GPT-5.6 Sol
- Grok 4.5
- Claude Sonnet 5
- GLM-5.2
- Claude Fable 5
- Claude Opus 4.8
- Gemini 3.5 Flash
- Grok Build
- Claude Opus 4.7
- Muse Spark
OpenAI가 2026-09-22에 공개한 GPT-6 시리즈의 비용 효율 고급 모델로, GPT-6 Luna와 함께 나왔고 플래그십 Astra보다 아래에 자리한다 — Astra 자체로부터 19일 뒤다 (source).
이번 릴리스의 주장은 역량이 아니라 가격이다. Sol은 Claude Fable 5가 공개한 최고 DeepSWE v1.1 점수와 1.1점 차이까지 붙으면서, OpenAI는 작업당 비용을 약 80% 낮다고 말한다.
이 모델을 GPT-5.6 Sol (and Terra, Luna)과 혼동하지 말 것. 둘은 한 세대 차이가 나는 다른
모델이고, GPT-5.6 Sol은 두 배 가격의 직전 모델이다. 슬러그가 다르며
scripts/spec-check.py는 슬러그를 정확히 일치시키므로, 이 구분은 표기상의 문제가
아니라 동작에 영향을 준다.
1차 출처를 직접 읽지 못했다. openai.com은 2026-09-22와 마찬가지로 클라우드
샌드박스에서 EGRESS_BLOCKED를 반환하며, thenewstack.io와 www.digitalapplied.com도
차단되어 있다. 문서의 정체(제목, URL, 발행 시각)는 OpenAI 자체 피드에서 온
state/prefetch.json의 발표 URL이 고정하며, 타임스탬프는
Tue, 22 Sep 2026 18:00:00 GMT다. 수치는 서로 다른 질의로 돌린 두 번의 검색에서 왔다.
스펙
| 속성 | 값 |
|---|---|
| Developer | OpenAI |
| Released | 2026-09-22 |
| Announced | 2026-09-22 |
| Context window | 1.05M tokens |
| Pricing | $2/M input · $10/M output · 캐시 입력 $0.20/M |
| License | 독점 (API 전용, 가중치 미공개) |
| Availability | ChatGPT Work과 Codex (Plus, Pro, Business, Enterprise, Edu), OpenAI API의 gpt-6-sol. Chat에는 아직 없음 |
| Catalogue id | unknown |
이 스키마에 자리가 없는 항목: 최대 출력 128,000 토큰, 그리고 **none부터 max까지의 | |
| 추론 설정**. 캐시 입력에는 90% 할인이 붙는다. |
Catalogue id는 비어 있는 것이 아니라 unknown이다. openrouter.ai가 이 샌드박스에서
차단되어 있어, gpt-6-sol 슬러그가 카탈로그 항목에 닿는지는 매일 도는 spec-check
Action이 풀어야 할 문제다.
출시일
2026-09-22. 출시 당일부터 ChatGPT Work과 Codex에서 이용 가능했고, Chat 지원은 포착 시점까지 들어오지 않았다.
벤치마크
이 모델에 대해 공개된 벤치마크는 DeepSWE v1.1 하나뿐이다 (source):
| 모델 | Effort | 점수 |
|---|---|---|
| Claude Fable 5 | xhigh | 69.9% |
| GPT-6 Sol | max | 68.8% |
| GPT-6 Luna | max | 66.6% |
이 수치에는 두 가지 단서가 따라붙는다. Effort가 서로 다르다 — Sol의 수치는 max, | ||
Fable 5는 xhigh이며, 각각 해당 공급사의 최상위 설정이지만 같은 설정은 아니다. 이 | ||
| 위키에는 그것이 왜 중요한지를 다루는 페이지가 있다 | ||
| (Eval Harness Configuration). 그리고 **벤치마크 하나가 공개된 기록의 | ||
| 전부다.** 읽은 자료 어디에도 Sol의 추론·지식·멀티모달·에이전트 수치가 없으므로, | ||
| 68.8%를 소프트웨어 엔지니어링 밖으로 일반화할 수 없다. |
비용 주장: Sol의 DeepSWE v1.1 작업당 비용이 Claude Fable 5보다 약 80% 낮다. 이것은 OpenAI가 계산한 비율이며 이 위키가 확인할 수 있는 측정치가 아니다.
활용 사례
OpenAI의 설명은 새로운 역량 상한이 아니라 가격 대비 성능 프런티어에 놓여 있다 — 시리즈 플래그십 Astra는 그 위에 그대로 남는다. GPT-6 Luna와의 짝은 2단 구성을 만든다. 프런티어에 가까운 코딩이 필요한 작업에는 Sol, 물량에는 Luna다.
출시와 함께 GPT-6의 프롬프트 캐싱 변경이 동반 공지로 나왔고
(https://openai.com/index/better-prompt-caching-for-gpt-6,
Tue, 22 Sep 2026 21:00:00 GMT 공지), 캐시 입력 90% 할인과 앞뒤가 맞지만 읽지는
못했다 — 차단된 호스트에 있고, 이번 실행에서 그 내용을 확인한 것은 없다.
비교
- GPT-5.6 Sol (and Terra, Luna) — 직계 전작으로 $4/$20. GPT-6 Sol은 양쪽을 반으로 줄였다.
- GPT-6 Luna — 같은 날 나온 더 저렴한 형제로, 입력 가격이 20× 저렴한 대신 DeepSWE v1.1에서 2.2점을 내준다 ($2.00 대비 $0.10).
- Astra — 19일 앞서 나온 GPT-6 플래그십으로 여전히 Sol 위에 있다. Astra는 OpenAI가 Preparedness Framework의 Critical 사이버보안 임계에서 확인한 첫 모델인데, 읽은 자료 어디에도 Sol이 그 프레임워크에서 어떻게 분류되는지 나오지 않는다. 그만큼 바짝 뒤따라 나온 모델에서 짚어둘 공백이다.
- Claude Opus 5.5 — Anthropic이 같은 날 공개했고 $4/$20이다. 두 출시는 공유하는 벤치마크가 하나도 없다. Anthropic은 Terminal-Bench 4.0, FrontierCode, CursorBench를 공개하고 SWE-bench 계열은 대표로 싣지 않았으며, OpenAI는 DeepSWE v1.1만 공개했다. 공급사 자료로는 둘 사이의 비교가 불가능하다.
소스
- Introducing GPT-6 Sol and Luna (snapshot)
- Better prompt caching for GPT-6 — 같은 날 공지, 읽지 못함, 호스트 차단
상충 보고
이번 실행에서 읽은 보도는 같은 수치를 두고 릴리스의 성격 규정에서 갈린다. VentureBeat과 The New Stack은 가격 인하를 앞세워 "API 비용을 50% 이상 깎았다"고 쓰고, the-decoder.com은 같은 출시를 "가격은 반으로 내렸지만 성능은 거의 움직이지 않았다"로 읽는다. 둘 다 max effort 68.8%와 GPT-5.6 Sol의 직전 가격과 모순되지 않는다. 갈리는 지점은 가격이 반이 되고 역량이 대체로 평평한 것이 이야깃거리인가 불만거리인가이다. 해소하지 않고 기록해 둔다.