GPT-5, Claude, Gemini의 아키텍처 결함 노출
OpenAI
Anthropic
Google/DeepMind
국제 연구팀이 GPT-5, Claude, Gemini 등 주요 AI 모델의 암호화된 사고 연쇄 추론 블록에서 아키텍처 결함을 발견했습니다. 동일한 공급업체의 더 작은 자매 모델을 사용하면 공격자가 전체 추론 과정을 해독하고 읽을 수 있어 민감한 데이터가 노출될 위험이 있습니다.
국제 연구팀이 GPT-5, Claude, Gemini와 같은 최상위 AI 시스템의 암호화된 추론 블록에서 심각한 구조적 취약점을 발견했습니다. 이러한 시스템들은 답변을 하기 전에 내부적으로 사고의 연쇄(Chain of Thought)를 생성하며, 업체들은 이를 암호화하여 클라이언트에 보내고, 후속 질문과 함께 반환받습니다. 연구팀은 OpenAI, Anthropic, Google이 자사 모델 제품군에 대해 전역 암호화 키를 사용한다는 사실을 발견했습니다. 즉, 암호화된 추론 블록이 특정 사용자, 세션 또는 모델에 연결되어 있지 않습니다. 이를 통해 공격자는 플래그십 모델의 암호화된 추론 블록을 가로채서 덜 제한된 소규모 자매 모델에 제출하여, 해당 모델이 이를 복호화하고 전체 추론 과정을 출력하게 할 수 있습니다. 연구팀은 공개 저장소와 로그를 분석하여 315,320개의 암호화된 추론 블록을 발견했고, 개인 식별 정보, API 키, 비밀번호, 이메일 주소를 성공적으로 복호화했습니다. 이 취약점은 또한 숨겨진 프롬프트 주입과 모델 능력의 무단 복제를 가능하게 합니다. 연구팀은 영향을 받은 기업들에 이러한 사실을 공개했으며, 해당 기업들은 대응 조치를 시작했습니다. 그러나 암호화가 특정 세션에 엄격히 결속될 때까지 사용자는 보호를 보장받을 수 없습니다.
출처: Heise online —
원문
