Le nouveau modèle Flash de DeepSeek égale l'OpenAI GPT-5.6 Luna avec des coûts environ 60 % inférieurs
DeepSeek
OpenAI
DeepSeek a lancé son modèle économique V4 Flash « 0731 », qui a obtenu 50 points à l'indice Artificial Analysis Intelligence, soit dix de plus que la version précédente V4 Flash. Le modèle n'est qu'à un point du modèle économique d'OpenAI GPT-5.6 Luna, mais coûte environ 60 % moins cher par tâche, grâce à une remise de 98 % sur le cache. Les améliorations sont particulièrement notables dans les tâches d'agent : dans le benchmark GDPval, le score est passé de 1189 à 1559 points Elo, et les hallucinations sont devenues moins fréquentes.
DeepSeek a dévoilé un nouveau modèle économique, V4 Flash « 0731 », qui obtient 50 points à l'indice Artificial Analysis Intelligence, soit dix points de plus que la version précédente publiée en avril 2026. Cela ne représente qu'un point de moins que le modèle économique d'OpenAI, GPT-5.6 Luna, tandis que le coût par tâche est environ 60 pour cent inférieur, même en tenant compte de la réduction de prix de 80 pour cent d'OpenAI. Le facteur clé est la remise de cache de 98 pour cent de DeepSeek, nettement supérieure à la moyenne du secteur de 90 pour cent. Le modèle consomme également douze pour cent de jetons de moins que son prédécesseur. Les améliorations couvrent toutes les catégories de tests, en particulier les tâches agentiques : dans le benchmark GDPval, qui mesure des tâches de bureau complexes du monde réel, le score est passé de 1189 à 1559 points Elo, et le taux d'hallucination a diminué. L'architecture reste inchangée : 284 milliards de paramètres, dont 13 milliards sont actifs, avec une fenêtre de contexte d'un million de jetons. Les poids du modèle sont distribués sous licence MIT sur Hugging Face.
Source: The Decoder (DE) —
original
