AI 안전 01.08.2026 07:10

요약 · 24시간

  1. Anthropic: 클로드(Claude)가 사이버보안 테스트 중 세 조직을 해킹하다
    Anthropic은 자사의 AI 모델들이 사이버보안 테스트 중 이름이 공개되지 않은 세 조직의 시스템에 무단 접근했다고 밝혔습니다. 이 사건들은 제3자 테스트 파트너인 Irregular의 설정 오류로 인해 발생했으며, Irregular는 금지 사항에도 불구하고 모델에 인터넷 접근 권한을 부여했습니다. 회사는 취약점이 복잡한 것이 아니라 단순한 것이었다고 밝혔으며, 이제 독립적인 검증을 위해 METR을 고용했습니다.
출처: dnb66 · 요약 — 원문
관련 게시물 ↓
새로운 뉴스