모델AI 안전 🇩🇪 10.08.2026 21:02

OpenAI, GPT-5.6-Cyber 공개: 새로운 AI 모델, 공격자보다 먼저 취약점을 찾도록 방어자 지원 목표

OpenAIOpenAI
OpenAI는 두 가지 액세스 등급과 새로운 AI 모델 GPT-5.6-Cyber를 도입하여 Daybreak 사이버 보안 프로그램을 확장합니다. 이 프로그램은 방어 작업을 위한 Daybreak Blue와 공격적 보안 연구를 위한 Daybreak Red를 포함하며, GPT-5.6-Cyber는 Red 등급을 통해 제공되어 민감한 보안 질문의 95%에 답변합니다.
OpenAI는 Daybreak 프로그램을 두 가지 액세스 등급과 'GPT-5.6-Cyber'라는 새로운 특화 모델로 확장하고 있습니다. 이 모델은 공격자가 AI 기반 공격 도구를 대규모로 배포하기 전에 방어자가 취약점을 찾고 익스플로잇을 개발할 수 있도록 설계되었습니다. OpenAI에 따르면 위협 행위자들은 점점 더 AI를 사이버 공격에 사용할 것이며, 완전 자율적인 형태를 포함하여 방어자가 대비할 시간이 줄어들 것입니다. 그 예로 OpenAI가 실수로 자사의 모델이 Hugging Face 및 다른 서비스를 해킹하게 한 사건이 있습니다. Daybreak Blue는 취약점 탐지, 악성코드 분석, 사고 대응과 같은 승인된 방어 작업을 위해 조정된 가드레일을 갖춘 GPT-5.6 Sol에 대한 액세스를 제공합니다. Daybreak Red는 취약점 연구, 익스플로잇 검증, 침투 테스트를 수행하는 보안 연구자를 대상으로 합니다. 두 등급 모두 신원 확인, 계정 보안, 모니터링 및 법적 선언이 필요합니다. 2026년 9월 1일부터 모든 Daybreak 계정에는 하드웨어 보안 키가 필수입니다. OpenAI는 또한 보안 워크플로우를 격리된 샌드박스 환경에서 실행하고 Codex의 자동 검토 모드를 사용할 것을 권장합니다. GPT-5.6-Cyber는 GPT-5.6 Sol을 기반으로 하며 Red 등급을 통해 이용할 수 있으며, 익스플로잇 체인 개발, 인증 우회, 권한 상승과 같은 시나리오를 다루는 내부 벤치마크 '고급 사이버 보안 완료율'에서 95%의 쿼리에 응답합니다. 대조적으로, 가드레일이 있는 GPT-5.6 Sol은 1.5%, Daybreak Blue는 2%, 이전 모델인 GPT-5.5-Cyber는 57.3%를 달성했습니다. 구체적인 테스트에서, Daybreak Red를 통한 GPT-5.6-Cyber만이 WebSocket 인증 우회를 위한 기능적인 익스플로잇 코드를 생성했으며, 다른 변형들은 거부했습니다. ExploitGym에서 GPT-5.6-Cyber는 GPT-5.6 Sol과 GPT-5.5-Cyber 모두를 능가합니다. OpenAI는 실제 취약점 연구에 GPT-5.6-Cyber를 사용하여 Chrome의 V8 JavaScript 엔진에서 두 가지 이전에 알려지지 않은 취약점을 발견했습니다. 이 취약점은 연결되어 메모리 손상을 일으키고 V8 힙 샌드박스를 우회할 수 있으며, Google은 이를 CVE-2026-15903으로 수정했습니다. 또한 GPT-5.6-Cyber는 '널리 사용되는 모바일 운영 체제'에서 최소 5가지 취약점을 발견했는데, 여기에는 앱 권한을 관리자로 승격시킬 수 있는 체인도 포함됩니다. OpenAI는 Daybreak 파트너 및 오픈 소스 커뮤니티와 협력하여 공개합니다. OpenAI의 대비 프레임워크에 따라 GPT-5.6-Cyber는 사이버 보안 능력에서 '높음' 등급으로 평가되며, Astra 모델이 달성할 수 있는 '심각' 임계값에는 도달하지 않습니다.
출처: The Decoder (DE) — 원문
관련 게시물 ↓
새로운 뉴스