Pelicanos em Bicicletas: Uma Investigação em Larga Escala de Laboratórios de IA
OpenAI
Anthropic
Google/DeepMind
xAI
Alibaba/Qwen
DeepSeek
O desenvolvedor Dylan Castillo conduziu um estudo para verificar se os modelos de IA são treinados para desenhar pelicanos em bicicletas. Ele testou 48 comandos em 7 modelos e não encontrou evidências desse treinamento.
Dylan Castillo conduziu uma investigação aprofundada sobre a hipótese comum de que laboratórios de IA treinam intencionalmente modelos para desenhar pelicanos em bicicletas. Ele compôs 48 prompts, combinando 8 tipos de animais e 6 tipos de veículos, e executou cada um três vezes em 7 modelos: GPT-5.6 Terra, Claude Sonnet 5, Gemini 3.5 Flash, Grok 4.5, Qwen3.7-Max, GLM-5.2 e DeepSeek V4 Pro. Para avaliação, foram usados GPT-5.6 Luna e Gemini 3.1 Flash-Lite. O estudo não encontrou evidências de que imagens de pelicanos em bicicletas parecessem melhores do que outras combinações. Nenhum laboratório superou as expectativas ao renderizar pelicanos ou bicicletas individualmente, e a combinação 'pelicano-bicicleta' não apresentou sinais de memorização. O modelo GLM-5.2 mostrou uma ligeira melhora para esse par específico, mas o efeito foi considerado estatisticamente insignificante.
Fonte: Simon Willison —
original
