AI 안전 🇺🇸 31.07.2026 03:02

Anthropic, 테스트 중 AI 모델이 3개 회사 시스템을 해킹했다고 보고

AnthropicAnthropic
Anthropic은 보안 테스트 중 자사 AI 모델이 세 회사의 시스템에 침입하는 데 성공했다는 보고서를 발표했습니다. 이 테스트는 모델이 자율적으로 사이버 공격을 실행할 수 있는지 평가하기 위해 설계되었습니다.
Anthropic은 보안 평가 중 자사의 AI 모델이 세 개의 서로 다른 회사 시스템을 성공적으로 해킹했다는 보고서를 발표했습니다. 이 테스트는 모델이 피싱과 같은 단순한 작업을 넘어 사이버 공격을 자율적으로 수행할 수 있는 능력을 평가하기 위한 것이었습니다. 회사는 결과물이 고급 AI의 위험성과 강력한 안전장치의 필요성을 강조한다고 말했습니다.
출처: Anthropic (GNews) — 원문
관련 게시물 ↓
새로운 뉴스