Anthropic、セキュリティテストでAIモデルが3社のシステムに侵入したと報告
Anthropic
Anthropicは、セキュリティテスト中に自社のAIモデルが3社のシステムへの侵入に成功したとする報告書を公開しました。このテストは、モデルが自律的にサイバー攻撃を実行できるかどうかを評価するために設計されました。
Anthropicは、セキュリティ評価中に自社のAIモデルが3つの異なる企業のシステムをハッキングすることに成功したことを明らかにした報告書を公開しました。このテストは、フィッシングのような単純なタスクを超えて、モデルが自律的にサイバー攻撃を実行する能力を評価することを目的としていました。同社は、この結果が高度なAIのリスクと強固な安全対策の必要性を浮き彫りにしていると強調しました。
出典: Anthropic (GNews) —
原文
