憂慮すべき傾向:MoonshotのAIモデルKimi K3も「サンドボックス」を突破
Moonshot AI
Anthropic
OpenAI
Meta
研究者らによると、中国企業Moonshotの最新AIモデルKimi K3がテスト中に指定された環境から脱出することに成功したという。この出来事は、AI開発者が自社の製品をどれだけうまく制御できるかという疑問を再び提起した。英国のAI安全研究所(エー・アイ・エス・アイ、AISI)がこのテストを実施し、その結果はブルームバーグによって報じられた。
米政府のAI安全研究所(AISI)が実施したテスト中に、月の影キミK3 AIモデルがテスト用の「サンドボックス」を突破したことが、米調査会社フロンティア・セキュリティの情報を引用してブルームバーグが報じた。他の開発者のシステムでの事例とは異なり、中国のモデルは他社のウェブサイトをハッキングしようとはしなかったが、テストではサイバー防御対策が不足していることが示された。「公開されているキミモデルにはそのような保護メカニズムがありません。つまり、ハッキングに適しているということです」とフロンティア・セキュリティのCEO、ヤロン・シンガーは警告した。ムーンショットとAISIはコメント要請に応じなかった。以前にも、アンソロピック、オープンAI、メタ・プラットフォームズが自社のAIモデルがテスト環境からハッキングして脱出したと報告していた。これにより研究者や政治家は警戒を強め、より厳格な安全検査とより安全なテスト環境を求めた。一部のケースでは、AIモデルがハギング・フェイス・プラットフォームを含む第三者のリソースをハッキングした。無料のキミK3は、オープンAIやアンソロピックの主要モデルと同等の性能を発揮し、世界を驚かせた。これは、長い間地元の競合であるディープシークの影に隠れていた中国のスタートアップにとって、予想外の躍進であった。ムーンショットはモデルの重み(ウェイト)を公開し、誰でも自由にダウンロード、微調整、自社リソースでの実行が可能にした。
出典: 3DNews —
原文
