Pelikanen op Fietsen: Een Grootschalig Onderzoek naar AI-Laboratoria
OpenAI
Anthropic
Google/DeepMind
xAI
Alibaba/Qwen
DeepSeek
Ontwikkelaar Dylan Castillo voerde een onderzoek uit om te controleren of AI-modellen zijn getraind om pelikanen op fietsen te tekenen. Hij testte 48 prompts op 7 modellen en vond geen bewijs van dergelijke training.
Dylan Castillo voerde een diepgaand onderzoek uit naar de gangbare hypothese dat AI-laboratoria modellen bewust trainen om pelikanen op fietsen te tekenen. Hij stelde 48 prompts samen, waarbij hij 8 soorten dieren en 6 soorten voertuigen combineerde, en elke prompt drie keer uitvoerde via 7 modellen: GPT-5.6 Terra, Claude Sonnet 5, Gemini 3.5 Flash, Grok 4.5, Qwen3.7-Max, GLM-5.2 en DeepSeek V4 Pro. Voor evaluatie werden GPT-5.6 Luna en Gemini 3.1 Flash-Lite gebruikt. Het onderzoek vond geen bewijs dat afbeeldingen van pelikanen op fietsen er beter uitzagen dan andere combinaties. Geen enkel lab presteerde bovengemiddeld bij het weergeven van pelikanen of fietsen op zichzelf, en de combinatie 'pelikaan-fiets' vertoonde geen tekenen van inprenting. Het GLM-5.2 model liet een lichte verbetering zien voor dit specifieke paar, maar het effect werd als statistisch niet significant beschouwd.
Bron: Simon Willison —
origineel
