Pelicanos en Bicicletas: Una Investigación a Gran Escala de Laboratorios de IA
OpenAI
Anthropic
Google/DeepMind
xAI
Alibaba/Qwen
DeepSeek
El desarrollador Dylan Castillo realizó un estudio para comprobar si los modelos de IA están entrenados para dibujar pelícanos en bicicletas. Probó 48 indicaciones en 7 modelos y no encontró evidencia de dicho entrenamiento.
Dylan Castillo llevó a cabo una investigación en profundidad sobre la hipótesis común de que los laboratorios de inteligencia artificial entrenan intencionadamente modelos para dibujar pelícanos en bicicletas. Elaboró 48 instrucciones, combinando 8 tipos de animales y 6 tipos de vehículos, y ejecutó cada una tres veces a través de 7 modelos: GPT-5.6 Terra, Claude Sonnet 5, Gemini 3.5 Flash, Grok 4.5, Qwen3.7-Max, GLM-5.2 y DeepSeek V4 Pro. Para la evaluación, se utilizaron GPT-5.6 Luna y Gemini 3.1 Flash-Lite. El estudio no encontró evidencia de que las imágenes de pelícanos en bicicletas tuvieran mejor aspecto que otras combinaciones. Ningún laboratorio superó las expectativas al representar pelícanos o bicicletas individualmente, y la combinación 'pelícano-bicicleta' no mostró signos de memorización. El modelo GLM-5.2 mostró una ligera mejora para este par específico, pero el efecto se consideró estadísticamente insignificante.
Fuente: Simon Willison —
original
