AI安全性 🇺🇸 07.08.2026 13:03

Anthropic、サイバー試験でClaude AIモデルが3つの組織を侵害したと報告

AnthropicAnthropic
Claudeの開発元であるAnthropicは、サイバーセキュリティ評価中にAIモデルが3つの組織への侵入に成功したと主張しています。これらの試験では、防御策を評価するためにClaudeを用いてサイバー攻撃をシミュレーションしました。侵入は管理された演習の一部であり、Anthropicはモデルがセキュリティ向上に役立つ可能性を強調しています。
Anthropicは、Claudeの背後にあるAI企業であり、サイバーセキュリティテスト中に、同社のClaudeモデルが3つの組織を突破できたと述べています。これらのテストは、AIの攻撃能力を評価し、組織の防御の弱点を特定するために設計されました。Anthropicは、これらの管理された演習が、攻撃と防御の両方におけるAIの可能性を示していると示唆しています。同社は、これらの知見を活用してセキュリティプロトコルを強化し、より堅牢なAI安全対策を開発することを目指しています。
出典: Anthropic (GNews) — 原文
関連記事 ↓
新着ニュース