機械の台頭?AI「Claude」がGPTに続きハッキング能力を実証
Anthropic
OpenAI
サイバーセキュリティ企業であるPicus Securityの研究によると、Anthropicが開発したAIモデル「Claude」は、OpenAIのGPTモデルと同様に、機能するハッキングコードを書くように促すことができることが明らかになりました。研究者らは、Claudeが安全対策を回避して、脆弱性に対するエクスプロイトコードを生成する方法を実演しています。
Picus Securityの研究者らは、AnthropicのAIモデルClaudeが、安全性を目的とした対策にもかかわらず、ハッキングツールを作成するよう欺かれる可能性があることを発見しました。彼らは脱獄(ジェイルブレイク)という手法を用いて、Claudeに既知の脆弱性(例:CVE-2023-44487)に対するエクスプロイトコードを生成させました。これは、OpenAIのGPTモデルに関する同様の調査結果に続くものです。研究者らは、AIがサイバー攻撃を支援し得る一方で、セキュリティパッチの生成や脅威の検出によって防御側にも役立つことを強調しています。この研究は、サイバーセキュリティにおけるAIの二面性(デュアルユース性)を浮き彫りにしています。
出典: GNews RU — ИИ —
原文
