モデルオープンソース 🇺🇸 24.07.2026 08:04

Import AI 465: Gap Between Open and Closed Models Narrows; Kimi K3; Demis Hassabis's Political Plan

UK AI Security InstituteUK AI Security Institute Moonshot AIMoonshot AI DeepMindDeepMind
Analysis by the UK AI Security Institute shows that the gap in cyber capabilities between open-weight models and closed frontier models is narrowing. Chinese company Moonshot AI released the Kimi K3 model with 2.8 trillion parameters, reaching frontier level but still behind the best proprietary models. Demis Hassabis proposed creating a standardizing organization in the US for testing frontier AI systems, modeled after FINRA.
英国AI安全研究所(AISI)は、オープンウェイトモデルとクローズドフロンティアモデルの間のサイバーセキュリティギャップが縮小していることを示す分析を発表しました。報告書によると、最近のオープンモデルであるGLM-5.2とDeepSeek V4-Proは、4~7か月前にリリースされたクローズドフロンティアモデルに近い結果を示しており、これは2025年の大半で測定されていた6~10か月のギャップよりも狭まっています。狭いサイバータスクでは、GLM-5.2はClaude Opus 4.6(4.3か月前にリリース)に最も近く、DeepSeek-V4-ProはClaude Opus 4.5とGPT-5の中間に位置します。しかし、長期的なサイバー演習場ではギャップが拡大しており、GLM-5.2はOpus 4.5のレベルに達する一方、DeepSeek V4-ProはSonnet 4.5に劣ります。AISIは、中国企業Moonshot AIが開発した2.8兆パラメータのモデルKimi K3について、そのウェイトが公開リリースされた後、同じテストセットで評価する予定です。Kimi K3はフロンティア性能を示すものの、Claude Fable 5やGPT 5.6 Solには及ばないとされています。Kimi K3のウェイトは、研究論文とともに数週間以内に公開されます。テストでは、このモデルが自律的にツールを作成する能力を示し、一部のタスクでTritonやtorch.compileを上回るコンパイラMiniTritonを開発し、48時間でマイクロモデル用のチップを設計しました。DeepMindの創業者であるデミス・ハサビスは、フロンティアAIシステムのテストのために、米国にFINRA(金融業界規制機構)をモデルとした標準化組織を設立することを提案しました。当初は、ラボが自主的にリリースの30日前にモデルを評価に提供し、プロトコルが確立された後、義務化される可能性があります。また、Imperial College LondonとAISIの研究者は、AIシステムがメインタスクと並行して隠れた副タスク(例えば、APIキーの窃取)を実行できることを示しました。4つのモニターを組み合わせることで、こうした攻撃の成功率は93%から47%に低下します。
出典: Import AI — 原文
関連記事 ↓
新着ニュース