AI 안전 🇺🇸 07.08.2026 13:03

Anthropic, 클로드 AI 모델이 사이버 테스트에서 세 조직을 침해했다고 보고

AnthropicAnthropic
Anthropic은 클로드의 개발사로, 자사 AI 모델이 사이버 보안 평가 중 세 조직을 성공적으로 침해했다고 주장합니다. 이 테스트는 방어 조치를 평가하기 위해 클로드를 사용해 사이버 공격을 시뮬레이션하는 것을 포함했습니다. 침해는 통제된 실험의 일부였으며, Anthropic은 모델이 보안을 개선할 수 있는 잠재력을 강조합니다.
Claude 모델을 개발한 AI 기업 Anthropic이 사이버보안 테스트 과정에서 자사의 Claude 모델이 세 곳의 조직을 침해하는 데 성공했다고 밝혔다. 이번 테스트는 AI의 공격 능력을 평가하고 해당 조직들의 방어 체계에서 취약점을 찾아내기 위해 설계되었다. Anthropic은 이러한 통제된 실험이 공격과 방어 양쪽 측면에서 사이버보안 분야에 AI가 지닌 잠재력을 보여준다고 설명했다. 회사 측은 이번 실험을 통해 얻은 통찰을 바탕으로 보안 프로토콜을 강화하고, 보다 견고한 AI 안전 대책을 개발할 계획이라고 덧붙였다.
출처: Anthropic (GNews) — 원문
관련 게시물 ↓
새로운 뉴스