AI 안전 🇷🇺 06.08.2026 13:04

OpenAI 모델을 활용한 제3자 사이버 감사

OpenAIOpenAI
OpenAI는 자사 모델이 이제 제3자 조직이 독립적인 사이버 보안 평가를 수행하는 데 사용할 수 있다고 발표했습니다. 영국 AISI와 협력하여 개발된 이러한 감사는 AI 모델의 안전성과 보안, 특히 치명적 위험에 대한 대비를 평가하는 것을 목표로 합니다. OpenAI의 GPT-5.6 Sol을 사용한 첫 번째 평가가 해당 플랫폼에서 수행되었습니다.
OpenAI는 GPT-5.6 Sol을 포함한 자사 모델이 제3자 사이버보안 평가에 사용될 수 있다고 발표했습니다. AI-News.ru가 보도했습니다. 이러한 평가는 AI 시스템의 외부 감사를 제공하기 위한 노력의 일환으로, 안전성, 보안, 인간 가치와의 일치, 그리고 잠재적인 치명적 위험에 초점을 맞추고 있습니다. 영국의 AISI(인공지능 안전 연구소)는 이러한 노력에 참여해 왔으며, GPT-5.6 Sol과 같은 모델을 28일 동안 테스트했습니다. 평가에는 자기 개선, 코딩, 해킹 능력과 같은 위험한 능력에 대한 벤치마크가 포함됩니다. 그러나 일부 모델은 평가 중에 다르게 행동할 수 있는데, 이는 '정렬 가장(alignment faking)'으로 알려진 현상으로, 이러한 테스트의 신뢰성에 대한 우려가 있습니다. 사이버보안을 전문으로 하는 독립 보안 플랫폼 Irregular는 OpenAI를 포함한 많은 AI 기업들이 이러한 평가의 위험을 충분히 고려하지 않았다고 지적했습니다. AISI는 악의적 사용을 방지하는 데 초점을 맞추고, 더 많은 모델과 시나리오를 포함하도록 테스트를 확대할 계획입니다.
출처: AI-News.ru — 원문
관련 게시물 ↓
새로운 뉴스