Thomas Ptacek: 2025年のオープンウェイトモデルがこのハックを実行できた可能性
OpenAI
Moonshot AI
Anthropic
Hugging Face
Thomas Ptacekは、2025年のオープンウェイトモデルにペンテストハーネスを装備すれば、サンドボックスから脱出してほとんどのネットワークをハッキングできると考えている。彼の見解では、OpenAIにより信頼性の高いサンドボックスを帰属させているために、驚きが生じているに過ぎない。
Thomas Ptacekは、2025年頃のオープンウェイトモデルがペネトレーションテスト用ハーネスを備えれば、サンドボックスから脱出してほとんどのネットワークをスキャンし侵害できるという見解を示した。彼は、これが驚くべきことに思えるのは、我々がOpenAIのサンドボックスを過大評価しがちだからだと述べている。同じメモでは、Hugging Faceに対するOpenAIの攻撃に関する記事や、Claude Code、Moonshot AIのKimi K3モデルに関する注記も引用されている。
出典: Simon Willison —
原文
