El nuevo modelo Flash de DeepSeek iguala a OpenAI GPT-5.6 Luna con costes un 60% inferiores
DeepSeek
OpenAI
DeepSeek ha lanzado la versión económica V4 Flash "0731", que ha alcanzado 50 puntos en el índice Artificial Analysis Intelligence, diez más que la versión anterior V4 Flash. El modelo se sitúa solo un punto por detrás del modelo económico de OpenAI GPT-5.6 Luna, pero cuesta aproximadamente un 60% menos por tarea gracias a un 98% de descuento en caché. Las mejoras son especialmente notables en tareas de agentes: en el benchmark GDPval, la puntuación ha pasado de 1189 a 1559 puntos Elo, y las alucinaciones son menos frecuentes.
DeepSeek ha lanzado un nuevo modelo económico, V4 Flash "0731", que obtiene 50 puntos en el índice de inteligencia de Artificial Analysis, diez puntos más que la versión anterior publicada en abril de 2026. Esto es solo un punto menos que el modelo económico de OpenAI, GPT-5.6 Luna, mientras que el coste por tarea es aproximadamente un 60 por ciento menor, incluso teniendo en cuenta el recorte del 80 por ciento en el precio de OpenAI. El factor clave es el descuento de caché del 98 por ciento de DeepSeek, significativamente superior a la media del sector, que es del 90 por ciento. El modelo también consume un doce por ciento menos de tokens que su predecesor. Las mejoras abarcan todas las categorías de pruebas, especialmente las tareas agénticas: en el punto de referencia GDPval, que mide el trabajo de oficina complejo del mundo real, la puntuación pasó de 1189 a 1559 puntos Elo, y la tasa de alucinación disminuyó. La arquitectura se mantiene sin cambios: 284 mil millones de parámetros, de los cuales 13 mil millones están activos, con una ventana de contexto de un millón de tokens. Los pesos del modelo se distribuyen bajo la licencia MIT en Hugging Face.
Fuente: The Decoder (DE) —
original
