Riset 🇺🇸 24.07.2026 02:04

Pelikan di Atas Sepeda: Investigasi Skala Besar Laboratorium AI

OpenAIOpenAI AnthropicAnthropic Google/DeepMindGoogle/DeepMind xAIxAI Alibaba/QwenAlibaba/Qwen DeepSeekDeepSeek
Pengembang Dylan Castillo melakukan studi untuk memeriksa apakah model AI dilatih untuk menggambar pelikan di atas sepeda. Dia menguji 48 prompt pada 7 model dan tidak menemukan bukti pelatihan semacam itu.
Dylan Castillo melakukan investigasi mendalam terhadap hipotesis umum bahwa laboratorium AI sengaja melatih model untuk menggambar pelikan di atas sepeda. Dia menyusun 48 prompt, menggabungkan 8 jenis hewan dan 6 jenis kendaraan, dan menjalankan masing-masing tiga kali melalui 7 model: GPT-5.6 Terra, Claude Sonnet 5, Gemini 3.5 Flash, Grok 4.5, Qwen3.7-Max, GLM-5.2, dan DeepSeek V4 Pro. Untuk evaluasi, digunakan GPT-5.6 Luna dan Gemini 3.1 Flash-Lite. Studi ini menemukan tidak ada bukti bahwa gambar pelikan di atas sepeda terlihat lebih baik daripada kombinasi lainnya. Tidak ada laboratorium yang melampaui ekspektasi dalam menggambarkan pelikan atau sepeda secara individu, dan kombinasi 'pelikan-sepeda' tidak menunjukkan tanda-tanda penghafalan. Model GLM-5.2 menunjukkan sedikit peningkatan untuk pasangan spesifik ini, tetapi efeknya dianggap tidak signifikan secara statistik.
Sumber: Simon Willison — asli
Postingan kami sebelumnya tentang topik ini ↓
Berita terbaru