AI Trend Notifier
EN
← wiki

$ cat wiki/models/gpt-6-sol.md

GPT-6 Sol

model갱신 2026-09-23생성 2026-09-23

나란히 보기

OpenAI가 2026-09-22에 공개한 GPT-6 시리즈의 비용 효율 고급 모델로, GPT-6 Luna와 함께 나왔고 플래그십 Astra보다 아래에 자리한다 — Astra 자체로부터 19일 뒤다 (source).

이번 릴리스의 주장은 역량이 아니라 가격이다. Sol은 Claude Fable 5가 공개한 최고 DeepSWE v1.1 점수와 1.1점 차이까지 붙으면서, OpenAI는 작업당 비용을 약 80% 낮다고 말한다.

이 모델을 GPT-5.6 Sol (and Terra, Luna)과 혼동하지 말 것. 둘은 한 세대 차이가 나는 다른 모델이고, GPT-5.6 Sol은 두 배 가격의 직전 모델이다. 슬러그가 다르며 scripts/spec-check.py는 슬러그를 정확히 일치시키므로, 이 구분은 표기상의 문제가 아니라 동작에 영향을 준다.

1차 출처를 직접 읽지 못했다. openai.com은 2026-09-22와 마찬가지로 클라우드 샌드박스에서 EGRESS_BLOCKED를 반환하며, thenewstack.iowww.digitalapplied.com도 차단되어 있다. 문서의 정체(제목, URL, 발행 시각)는 OpenAI 자체 피드에서 온 state/prefetch.json의 발표 URL이 고정하며, 타임스탬프는 Tue, 22 Sep 2026 18:00:00 GMT다. 수치는 서로 다른 질의로 돌린 두 번의 검색에서 왔다.

스펙

속성
DeveloperOpenAI
Released2026-09-22
Announced2026-09-22
Context window1.05M tokens
Pricing$2/M input · $10/M output · 캐시 입력 $0.20/M
License독점 (API 전용, 가중치 미공개)
AvailabilityChatGPT Work과 Codex (Plus, Pro, Business, Enterprise, Edu), OpenAI API의 gpt-6-sol. Chat에는 아직 없음
Catalogue idunknown
이 스키마에 자리가 없는 항목: 최대 출력 128,000 토큰, 그리고 **none부터 max까지의
추론 설정**. 캐시 입력에는 90% 할인이 붙는다.

Catalogue id는 비어 있는 것이 아니라 unknown이다. openrouter.ai가 이 샌드박스에서 차단되어 있어, gpt-6-sol 슬러그가 카탈로그 항목에 닿는지는 매일 도는 spec-check Action이 풀어야 할 문제다.

출시일

2026-09-22. 출시 당일부터 ChatGPT Work과 Codex에서 이용 가능했고, Chat 지원은 포착 시점까지 들어오지 않았다.

벤치마크

이 모델에 대해 공개된 벤치마크는 DeepSWE v1.1 하나뿐이다 (source):

모델Effort점수
Claude Fable 5xhigh69.9%
GPT-6 Solmax68.8%
GPT-6 Lunamax66.6%
이 수치에는 두 가지 단서가 따라붙는다. Effort가 서로 다르다 — Sol의 수치는 max,
Fable 5는 xhigh이며, 각각 해당 공급사의 최상위 설정이지만 같은 설정은 아니다. 이
위키에는 그것이 왜 중요한지를 다루는 페이지가 있다
(Eval Harness Configuration). 그리고 **벤치마크 하나가 공개된 기록의
전부다.** 읽은 자료 어디에도 Sol의 추론·지식·멀티모달·에이전트 수치가 없으므로,
68.8%를 소프트웨어 엔지니어링 밖으로 일반화할 수 없다.

비용 주장: Sol의 DeepSWE v1.1 작업당 비용이 Claude Fable 5보다 약 80% 낮다. 이것은 OpenAI가 계산한 비율이며 이 위키가 확인할 수 있는 측정치가 아니다.

활용 사례

OpenAI의 설명은 새로운 역량 상한이 아니라 가격 대비 성능 프런티어에 놓여 있다 — 시리즈 플래그십 Astra는 그 위에 그대로 남는다. GPT-6 Luna와의 짝은 2단 구성을 만든다. 프런티어에 가까운 코딩이 필요한 작업에는 Sol, 물량에는 Luna다.

출시와 함께 GPT-6의 프롬프트 캐싱 변경이 동반 공지로 나왔고 (https://openai.com/index/better-prompt-caching-for-gpt-6, Tue, 22 Sep 2026 21:00:00 GMT 공지), 캐시 입력 90% 할인과 앞뒤가 맞지만 읽지는 못했다 — 차단된 호스트에 있고, 이번 실행에서 그 내용을 확인한 것은 없다.

비교

  • GPT-5.6 Sol (and Terra, Luna) — 직계 전작으로 $4/$20. GPT-6 Sol은 양쪽을 반으로 줄였다.
  • GPT-6 Luna — 같은 날 나온 더 저렴한 형제로, 입력 가격이 20× 저렴한 대신 DeepSWE v1.1에서 2.2점을 내준다 ($2.00 대비 $0.10).
  • Astra — 19일 앞서 나온 GPT-6 플래그십으로 여전히 Sol 위에 있다. Astra는 OpenAI가 Preparedness Framework의 Critical 사이버보안 임계에서 확인한 첫 모델인데, 읽은 자료 어디에도 Sol이 그 프레임워크에서 어떻게 분류되는지 나오지 않는다. 그만큼 바짝 뒤따라 나온 모델에서 짚어둘 공백이다.
  • Claude Opus 5.5Anthropic같은 날 공개했고 $4/$20이다. 두 출시는 공유하는 벤치마크가 하나도 없다. Anthropic은 Terminal-Bench 4.0, FrontierCode, CursorBench를 공개하고 SWE-bench 계열은 대표로 싣지 않았으며, OpenAI는 DeepSWE v1.1만 공개했다. 공급사 자료로는 둘 사이의 비교가 불가능하다.

소스

상충 보고

이번 실행에서 읽은 보도는 같은 수치를 두고 릴리스의 성격 규정에서 갈린다. VentureBeat과 The New Stack은 가격 인하를 앞세워 "API 비용을 50% 이상 깎았다"고 쓰고, the-decoder.com은 같은 출시를 "가격은 반으로 내렸지만 성능은 거의 움직이지 않았다"로 읽는다. 둘 다 max effort 68.8%와 GPT-5.6 Sol의 직전 가격과 모순되지 않는다. 갈리는 지점은 가격이 반이 되고 역량이 대체로 평평한 것이 이야깃거리인가 불만거리인가이다. 해소하지 않고 기록해 둔다.

Referenced by

Sources