⚡ ÚLTIMA HORA
¿Nuevo Opus 5 a mitad de precio y más potente que Fable 5? Pruebas explotan internet, usuarios asombrados
Anthropic
Anthropic lanzó oficialmente Opus 5, que iguala o supera a Fable 5 en múltiples evaluaciones comparativas a la mitad del precio. Los usuarios han estado probando sus capacidades en diversas tareas creativas y técnicas, desde desarrollo de juegos hasta modelado 3D, y muchos lo llaman un 'monstruo'.
Anthropic lanzó oficialmente Opus 5, superando a Fable 5 en múltiples benchmarks exigentes a la mitad de precio. En Frontier-Bench, Opus 5 superó a todos los competidores, duplicando con creces el rendimiento de su predecesor Opus 4.8. En CursorBench con el máximo esfuerzo, obtuvo solo un 0.5% por debajo del pico de Fable 5. Los usuarios reportaron resultados impresionantes en programación, modelado 3D y desarrollo de videojuegos. Pruebas destacadas incluyen un clon de Rocket League, una estructura celular en 3D, una estructura celular 3D con rotación de 360 grados, simulación de túnel de viento en tiempo real y una réplica de Minecraft. Opus 5 también mostró un sólido rendimiento en diseño asistido por computadora (CAD) y educación. En una demostración de autoverificación, Opus 5 reconstruyó un modelo 3D de un Boeing 747 extrayendo contornos y midiendo 14 parámetros específicos contra datos públicos, mientras que Fable 5 solo verificaba capturas de pantalla a simple vista. El precio de Opus 5 es de $5 por millón de tokens de entrada y $25 por tokens de salida, la mitad que Fable 5. En ARC-AGI-3, Opus 5 obtuvo un 30.2% frente al 7.8% de GPT-4.5 Sol. En el examen Human's Last Exam sin herramientas, Opus 5 alcanzó un 56.3% frente al 56.5% de Fable 5; con herramientas, Opus 5 logró un 64.7% frente al 63.9% de Fable 5. Opus 5 también obtuvo una puntuación perfecta en la Olimpiada Internacional de Matemáticas (IMO) 2026 sin herramientas externas. Además, Anthropic redujo el prompt del sistema de Claude Code en más de un 80% sin pérdida de rendimiento al aprovechar el mejor criterio de Opus 5. Elon Musk publicó un gráfico de relación costo-rendimiento en FrontierCode que muestra solo a Grok 4.5 y Opus 5 en la frontera de Pareto.
Fuente: QbitAI 量子位 —
original
