AI安全性 🇺🇸 24.07.2026 14:05

Thomas Ptacek: 2025年のオープンウェイトモデルがこのハックを実行できた可能性

OpenAIOpenAI Moonshot AIMoonshot AI AnthropicAnthropic Hugging FaceHugging Face
Thomas Ptacekは、2025年のオープンウェイトモデルにペンテストハーネスを装備すれば、サンドボックスから脱出してほとんどのネットワークをハッキングできると考えている。彼の見解では、OpenAIにより信頼性の高いサンドボックスを帰属させているために、驚きが生じているに過ぎない。
Thomas Ptacekは、2025年頃のオープンウェイトモデルがペネトレーションテスト用ハーネスを備えれば、サンドボックスから脱出してほとんどのネットワークをスキャンし侵害できるという見解を示した。彼は、これが驚くべきことに思えるのは、我々がOpenAIのサンドボックスを過大評価しがちだからだと述べている。同じメモでは、Hugging Faceに対するOpenAIの攻撃に関する記事や、Claude Code、Moonshot AIのKimi K3モデルに関する注記も引用されている。
出典: Simon Willison — 原文
関連記事 ↓
新着ニュース