研究 🇺🇸 24.07.2026 02:04

自転車に乗るペリカン:AI研究所の大規模調査

OpenAIOpenAI AnthropicAnthropic Google/DeepMindGoogle/DeepMind xAIxAI Alibaba/QwenAlibaba/Qwen DeepSeekDeepSeek
開発者のDylan Castilloが、AIモデルが自転車に乗るペリカンを描くように訓練されているかどうかを検証する研究を実施した。彼は7つのモデルに対して48のプロンプトをテストし、そのような訓練の証拠は見つからなかった。
Dylan Castilloは、AI研究所が意図的に模型に自転車に乗るペリカンを描くよう訓練しているという一般的な仮説について、詳細な調査を実施しました。彼は、8種類の動物と6種類の乗り物を組み合わせた48のプロンプトを作成し、各プロンプトを7つのモデル(GPT-5.6 Terra、Claude Sonnet 5、Gemini 3.5 Flash、Grok 4.5、Qwen3.7-Max、GLM-5.2、DeepSeek V4 Pro)で3回ずつ実行しました。評価にはGPT-5.6 LunaとGemini 3.1 Flash-Liteが使用されました。調査の結果、自転車に乗るペリカンの画像が他の組み合わせよりも優れているという証拠は見つかりませんでした。ペリカンや自転車を個別に描画する際に、いずれの研究所も期待を上回る性能を示さず、「ペリカンと自転車」の組み合わせには記憶(memorization)の兆候は見られませんでした。GLM-5.2モデルはこの特定の組み合わせに対してわずかな改善を示しましたが、その効果は統計的に有意ではないと判断されました。
出典: Simon Willison — 原文
関連記事 ↓
新着ニュース