Bồ nông trên xe đạp: Một cuộc điều tra quy mô lớn về các phòng thí nghiệm AI
OpenAI
Anthropic
Google/DeepMind
xAI
Alibaba/Qwen
DeepSeek
Nhà phát triển Dylan Castillo đã tiến hành một nghiên cứu để kiểm tra xem các mô hình AI có được huấn luyện để vẽ bồ nông trên xe đạp hay không. Ông đã thử nghiệm 48 lời nhắc trên 7 mô hình và không tìm thấy bằng chứng nào về việc huấn luyện như vậy.
Dylan Castillo đã tiến hành một cuộc điều tra chuyên sâu về giả thuyết phổ biến rằng các phòng thí nghiệm AI cố tình huấn luyện mô hình để tạo ra hình ảnh con bồ nông trên xe đạp. Anh ấy đã soạn 48 prompt, kết hợp 8 loại động vật và 6 loại phương tiện, và chạy mỗi prompt ba lần qua 7 mô hình: GPT-5.6 Terra, Claude Sonnet 5, Gemini 3.5 Flash, Grok 4.5, Qwen3.7-Max, GLM-5.2 và DeepSeek V4 Pro. Để đánh giá, GPT-5.6 Luna và Gemini 3.1 Flash-Lite đã được sử dụng. Nghiên cứu không tìm thấy bằng chứng nào cho thấy hình ảnh bồ nông trên xe đạp đẹp hơn các tổ hợp khác. Không phòng thí nghiệm nào vượt quá kỳ vọng trong việc tạo ra bồ nông hoặc xe đạp riêng lẻ, và tổ hợp 'bồ nông-xe đạp' không có dấu hiệu ghi nhớ. Mô hình GLM-5.2 có cải thiện nhẹ cho cặp cụ thể này, nhưng hiệu ứng được coi là không có ý nghĩa thống kê.
Nguồn: Simon Willison —
bản gốc
