2026년 8월 12일 · 4² AI 뉴스레터
Daybreak, 사이버보안 모델 GPT-5.6-Cyber 공개
OpenAI
파이랩 정리
Daybreak 확장: 사이버 방어의 기회 창이 좁아지다
GPT-5.6-Cyber 소개
OpenAI는 최신 사이버보안 모델인 GPT-5.6-Cyber를 공개하며, 사이버 방어의 새로운 가능성을 열었습니다. 사이버보안 환경은 빠르게 변화하고 있으며, 위협 행위자들은 AI를 사용하여 전례 없는 속도와 규모로 사이버 공격을 수행하고 있습니다. 이러한 능력이 확산됨에 따라 방어자들은 준비할 시간이 점점 줄어들고 있습니다. 이에 대한 대응으로 우리는 최첨단 지능을 신뢰할 수 있는 방어자들에게 제공하여 공격자들이 AI를 대규모로 악용하기 전에 대비할 수 있도록 하고자 합니다.
Daybreak의 두 가지 접근 방식
OpenAI는 Daybreak를 확장하여 승인된 방어자들에게 적절한 능력을 제공하기 위한 두 가지 접근 방식을 도입했습니다.
- Daybreak Blue: GPT-5.6 Sol을 포함한 최첨단 범용 모델에 접근할 수 있으며, 승인된 방어적 보안 작업에 맞춘 안전장치가 포함되어 있습니다. 이는 대부분의 방어자들에게 권장되는 시작점으로, 취약점 발견, 안전한 코드 리뷰, 악성코드 분석, 사고 대응, 패치 검증 등을 지원합니다.
- Daybreak Red: 승인된 취약점 연구, 익스플로잇 검증, 보안 테스트를 위한 목적에 맞게 훈련된 사이버보안 모델에 접근할 수 있습니다.
GPT-5.6-Cyber의 기능
Daybreak Red를 통해 제공되는 GPT-5.6-Cyber는 GPT-5.6 Sol을 기반으로 하여 여러 전문 사이버보안 작업(예: 제로데이 취약점 발견 및 익스플로잇 체인 개발)을 개선하고, 특정 고위험, 이중 사용 사이버 작업에 대한 거부를 줄이도록 훈련되었습니다.
Daybreak의 고급 사이버 기능
GPT-5.6 Sol은 사이버보안 작업에서 최첨단 성능을 제공합니다. 실제 환경에서 우리는 사이버보안 관련 요청을 차단하여 악용을 방지하는 시스템 수준의 안전장치를 배포하지만, 이는 합법적인 방어 작업도 차단할 수 있습니다. Daybreak Blue 접근은 이러한 안전장치를 제거하여 방어자들이 실제 보안 작업에서 모델을 최대한 활용할 수 있도록 돕습니다.
Daybreak Red 접근을 통해 제공되는 GPT-5.6-Cyber는 특정 작업에서 거부를 줄이고 성능을 개선하도록 훈련되었습니다. GPT-5.6-Cyber는 신뢰할 수 있는 방어자들이 합법적인 보안 활동을 수행할 수 있도록 돕습니다.
성능 평가
GPT-5.6-Cyber는 Daybreak Red 접근을 통해 제공되며, 익스플로잇 체인 개발, 인증 우회, 권한 상승 등 고급 사이버보안 시나리오에 대한 요청에 얼마나 자주 응답하는지를 측정하는 내부 평가(고급 사이버보안 완료율)를 통해 거부율이 감소했음을 확인했습니다. GPT-5.6-Cyber는 이러한 요청의 95.0%를 완료했으며, 이는 GPT-5.6 Sol의 1.5%, Daybreak Blue 접근 시 2.0%보다 훨씬 높은 수치입니다. 또한, 이전 모델인 GPT-5.5-Cyber의 57.3%보다 더 많은 요청을 완료하여, 이전 모델에서 지속적인 거부를 경험한 보안 연구자들의 피드백을 반영했습니다.
실제 소프트웨어의 취약점 발견 및 패치
GPT-5.6-Cyber의 기능은 연구 벤치마크 성능을 넘어 실제 취약점 연구로 확장됩니다. 실제 취약점 연구는 종종 큰 규모의 낯선 코드베이스에 대한 지속적인 추론을 요구합니다. 연구자들은 가설을 세우고 테스트하며, 여러 구성 요소 간의 상호작용을 추적하고, 예상치 못한 동작을 재현하며, 의심되는 취약점이 실제로 악용될 수 있는지를 판단해야 합니다.
GPT-5.6-Cyber 모델이 훈련을 마친 이후, 우리는 이를 사용하여 선택된 소프트웨어 프로젝트를 광범위하게 연구하고 개선했습니다. 예를 들어, 우리는 Chrome에서 사용되는 JavaScript 엔진인 V8을 조사하기 위해 GPT-5.6-Cyber를 사용했습니다. 이를 통해 메모리를 손상시키고 V8 힙 샌드박스를 탈출할 수 있는 두 가지 이전에 알려지지 않은 취약점을 발견했습니다. 연구자들은 이 발견을 검증하고 Google에 취약점 공개를 통해 보고했습니다. Google은 이 취약점을 수정하였고, CVE-2026-15903으로 지정했습니다.
이 외에도 GPT-5.6-Cyber를 사용하여 인기 있는 데이터베이스와 모바일 운영 체제 등 다양한 소프트웨어에서 고위험 취약점을 식별했습니다. 우리는 Daybreak 파트너 및 오픈 소스 커뮤니티와 긴밀히 협력하여 이러한 모바일 OS, 데이터베이스 및 커널 취약점을 공개하고 수정하고 있습니다.
접근 및 안전장치
안전장치가 줄어든 모델은 오용이나 잘못된 사용으로 인한 위험을 수반합니다. 이러한 위험에도 불구하고, 방어자들에게 최첨단 지능에 대한 접근을 민주화하는 것이 사이버 방어를 가속화하고 자동화하는 데 중요하다고 믿습니다.
Daybreak Blue와 Daybreak Red 접근은 승인된 개인 및 조직에게 제공되며, 신원 확인, 계정 보안, 모니터링, 승인된 사용 제한, 법적 증명을 통해 접근을 제어합니다. 우리는 사이버 모델의 안전한 사용을 가능하게 하기 위해 추가적인 조치를 취하고 있습니다.
- Daybreak 고객이 Codex를 사용할 때 전체 접근 모드에서 자동 검토 모드로 전환하도록 강력히 권장하고 있습니다. 자동 검토는 실행 전에 높은 권한이 필요한 작업을 평가하고, 파괴적 행동의 위험이 있는 요청을 차단할 수 있습니다.
- 2026년 9월 1일부터 Daybreak의 모든 개인 계정은 하드웨어 보안 키를 채택해야 합니다.
- 추가 보안 조치를 적극적으로 개발 중이며, 향후 몇 주 내에 이를 도입할 계획입니다.
- 향후 Daybreak 릴리스를 위한 정렬 훈련 및 테스트를 우선시하고 있습니다.
- Codex 문서의 안전 모범 사례를 업데이트하여 팀이 사이버 기능 에이전트를 의도된 보안 경계 내에 유지할 수 있도록 돕고 있습니다.
Daybreak 시리즈를 사용할 때의 모범 사례는 다음과 같습니다.
- 샌드박스 및 격리: 민감한 생산 시스템이나 인터넷에 접근하지 않고 제어된 환경에서 보안 작업을 수행합니다. 샌드박스 경계를 정기적으로 테스트합니다.
- 에이전트 행동 모니터링: Codex 샌드박스 외부에서 도구 호출을 검토하기 위해 자동 검토 모드를 사용합니다. 고위험 작업에 대한 추가 모니터링 및 인간의 감독을 추가합니다.
- 범위 정의: 승인된 시스템 및 작업을 명확히 정의합니다. 범위가 지정된 권한 프로필을 사용하여 이러한 경계를 강화합니다.
조직은 특정 워크플로에 대한 검토 정책을 사용자 정의할 수 있습니다. 대부분의 방어자에게는 Daybreak Blue를 시작점으로 추천합니다. 승인된 작업에 고급 취약점 연구, 익스플로잇 개발, 또는 레드 팀 활동이 포함된 팀은 Daybreak Red 접근을 요청할 수 있습니다. 프로그램에 참여하려면 openai.com/daybreak/partners에서 신청하십시오.