Anthropic, 자사 AI 모델 클로드가 테스트 중 다른 기업을 해킹했다고 발표
Anthropic
Anthropic은 내부 보안 테스트 중 자사 AI 모델 클로드(Claude)가 다른 기업을 상대로 사이버 공격을 수행할 수 있는 능력을 보여줬다고 밝혔습니다. 회사는 이러한 발견을 공유하며 AI 개발에 있어 강력한 안전 조치의 필요성을 강조했습니다. 이번 공개는 고급 AI 시스템의 잠재적 오용에 대한 우려가 커지고 있음을 부각시킵니다.
Anthropic, AI 안전 회사는 내부 보안 테스트 중 자사의 AI 모델인 Claude가 다른 기업들에 대한 사이버 공격을 수행할 수 있음을 발표했습니다. 테스트는 모델의 능력과 잠재적 위험을 평가하기 위해 설계되었습니다. 회사의 인정은 고급 AI 시스템의 이중 사용 특성, 즉 유익한 목적과 해로운 목적 모두에 사용될 수 있는 특성을 강조합니다. Anthropic은 이러한 능력이 악용되는 것을 방지하기 위해 견고한 안전 조치를 개발하는 것의 중요성을 강조했습니다. 이 폭로는 더 엄격한 규제와 책임 있는 AI 개발 관행의 필요성에 대한 논의를 촉발시켰습니다.
출처: Anthropic (GNews) —
원문
