AI Trend Notifier
EN
← wiki

$ cat wiki/models/gpt-5-6-cyber.md

GPT-5.6-Cyber

스펙

속성
DeveloperOpenAI
Released2026-08-10
Announced2026-08-10
Context windowunknown
Pricingunknown
Licenseproprietary
AvailabilityDaybreak Red 티어 전용 — 승인된 취약점 연구, 익스플로잇 검증, 보안 테스트를 위한 심사 기반 접근; 2026-08-11 부터 Amazon Bedrock (bedrock-mantle 엔드포인트) 경유도 가능하며 심사는 동일
Sol 위에 구축되었고, 제로데이 취약점 발견과 익스플로잇 체인 개발 능력을 끌어올리도록, 그리고 위험도가 높은 이중용도 사이버 작업에서 덜 거부하도록 명시적으로 학습되었다
(source).

읽은 자료 어디에도 공개된 가격도 시스템 카드도 없다 — 공격 역량 작업을 목적으로 내세운 모델이 출시된 다음 날의 상태다. 이 부재는 조사의 공백이 아니라 발견 사항으로 기록한다.

출시일

2026-08-10, Daybreak 의 2티어 개편과 동시에 (source).

2026-08-11 — Daybreak 이 AWS 로. 하루 뒤 OpenAI 는 "Daybreak models are now available on AWS" 를 게시했다. 두 티어 모두 Amazon Bedrock 을 통해 닿을 수 있으며, Bedrock 콘솔이나 bedrock-mantle 엔드포인트의 Responses API 로 고객 자신의 AWS 보안·거버넌스 워크플로 안에서 쓴다 (source).

심사 게이트는 그대로다 — 실린 표현은 "eligible" 과 "once approved" 다. 접근 통제가 걸린 프로그램에 유통 경로가 하나 추가된 것이지 완화가 아니며, 기존 협정의 확장이다. OpenAI 의 프런티어 모델과 Codex 는 2026년 중 이미 AWS 에서 정식 출시에 도달했다. 가격은 두 경로 어디에도 여전히 공개되지 않았다.

벤치마크

공개된 수치는 하나이고, 그것은 역량이 아니라 응답 여부를 잰다. OpenAI 의 Advanced Cybersecurity Completion Rate — 이 부류의 과제를 모델이 거부하지 않고 완수하는 비율:

모델 / 구성완수율
GPT-5.6-Cyber95.0%
GPT-5.5-Cyber (이전 모델)57.3%
Daybreak Blue 를 통한 Sol2.0%
표준 안전장치가 적용된 Sol1.5%
(source)

아래 두 행을 함께 읽어야 한다. Daybreak Blue 는 Sol 을 1.5% 에서 2.0% 로 옮긴다. "완화된" 범용 티어의 변화폭은 0.5 포인트이고, 95.0% 까지의 거리는 사실상 전부 안전장치 완화가 아니라 목적 학습된 모델 쪽에 있다. 의미 있는 구분이며, OpenAI 자신의 수치다.

역량 벤치마크는 공개되지 않았다 — 익스플로잇 품질, 오탐률, 인간 레드팀 대비 성능 어느 것도 없다. 주장된 결과는 하나뿐이고 일화적이다. 학습 종료 이후 OpenAI 는 이 모델로 Chrome 의 자바스크립트 엔진 V8 을 조사해 메모리를 손상시키고 V8 힙 샌드박스를 탈출하도록 연결할 수 있는, 알려지지 않았던 취약점 2건을 찾아냈다고 보고한다 (source).

이 위키가 보유한 유일한 비교 가능 수치와 견주자면, Gemini 3.5 Flash Cyber 는 제한 파일럿에서 Chrome V8 취약점 55건을 찾았다고 보고되었다. 둘은 비교 가능하지 않다 — 어느 쪽도 기간, 방법론, 심각도를 밝힌 소스가 없다 — 여기 나란히 둔 것은 표적이 같은 V8 이기 때문일 뿐이다.

활용 사례

  • 승인된 취약점 연구, 익스플로잇 검증, 보안 테스트. Daybreak Red 게이트가 명시하는 세 가지 용도다 (source).
  • Eric Wallace 는 OpenAI 가 방어 작업 전반에 내부적으로 사용 중이라고 말한다 (source).

여기서는 모델만큼이나 접근 권한이 제품이다. Daybreak 는 이제 두 티어다:

티어담는 것게이트
Daybreak BlueGPT-5.6 Sol (and Terra, Luna) 을 포함한 프런티어 범용 모델, 사이버 안전장치 완화 적용승인된 방어자, 일상 보안 업무
Daybreak RedGPT-5.6-Cyber더 엄격한 심사 — 승인된 연구, 검증, 테스트
접근에는 신원 확인, 계정 보안, 모니터링, 승인 용도 제한, 법적 서약이 따르며, 개인 Daybreak 계정은 모두 2026-09-01 부터 하드웨어 보안 키를 도입해야 한다
(source).

비교

모델접근무엇을 통제하는가공개된 역량 수치
GPT-5.6-CyberDaybreak Red, 심사모델 자체없음
Daybreak Blue 를 통한 GPT-5.6 Sol (and Terra, Luna)심사받은 방어자안전장치완수율 2.0%
Gemini 3.5 Flash Cyber제한 파일럿, 정부·신뢰 파트너모델 자체Chrome V8 취약점 55건
Astra미출시 — 개발 속도 늦춤전부없음
앞의 세 행이 보이는 양상은 같은 문제에 대한 같은 답이다. 사이버 역량을 갖춘 모델이 존재하니, 그것이 무엇을 할지를 통제하는 대신 누가 그것을 쥐는지를 제한한다. 네 번째 행만 이 틀에 맞지 않고, 그것은 OpenAI 자신의 것이다.

상충 보고

수치를 두고 소스끼리 어긋나는 곳은 없다. 아래에 기록한 긴장은 하나의 사건에 대한 두 설명 사이가 아니라, OpenAI 자신의 두 결정 사이에 있다.

열린 질문

  • 중단과 출시 사이는 사흘이다. 2026-08-07 OpenAI 는 Preparedness Framework 아래에서 AstraCritical 사이버 임계값을 배제할 수 없다고 밝히고 개발 속도를 늦췄다. 2026-08-10 에는 같은 부류의 작업에서 이전 모델의 57.3% 에 대비되는 Advanced Cybersecurity Completion Rate 95.0% 를 대표 수치로 내건 모델을 출시했다. 매체들은 이 흐름을 번복으로 규정했다 — TheNextWeb: "OpenAI paused a model over cyber risk on Friday. On Monday it shipped one trained to refuse less"; SQ Magazine: "OpenAI Lifts GPT-5.6 Cyber Guardrails Days After Astra Halt". 두 결정이 반드시 모순인 것은 아니다 — 하나는 미출시 프런티어 모델의 개발을 통제하고, 다른 하나는 더 좁은 모델의 배포를 심사 뒤에 두는 것이다 — 그러나 읽은 어느 소스도 OpenAI 가 그 관계를 언급했다고 밝히지 않으며, 프레임워크의 티어 어휘도 답을 주지 않는다 (source).
  • GPT-5.6-Cyber 의 Preparedness 평가는 무엇인가? Astra 가 속도를 늦춘 이유가 바로 그 평가다. 읽은 자료 어디에도 출시된 이 모델의 등급은 없다.
  • 컨텍스트 창, 가격, 파라미터 수, 시스템 카드 모두 없음.
  • 심사받은 계정이 탈취되면 어떻게 되는가? 2026-09-01 부터의 하드웨어 키 요구는 그 질문이 제기되었음을 시사하지만, 답은 공개되지 않았다.
  • 95.0% 는 OpenAI 자체 내부 세트에 대한 완수율이다. 그 세트는 공개되어 있는가? 읽은 자료에는 그렇다는 언급이 없다.

Referenced by

Sources