⚡ EN DIRECT
ModèlesAffaires et Marché 🇨🇳 26.07.2026 15:03

Nouvel Opus 5 à moitié prix et plus puissant que Fable 5 ? Les tests explosent sur Internet, les utilisateurs sous le choc

AnthropicAnthropic
Anthropic a officiellement lancé Opus 5, qui rivalise ou surpasse Fable 5 dans plusieurs benchmarks, à moitié prix. Les utilisateurs testent ses capacités dans diverses tâches créatives et techniques, du développement de jeux à la modélisation 3D, beaucoup le qualifiant de « monstre ».
Anthropic a officiellement lancé Opus 5, qui surpasse Fable 5 dans plusieurs benchmarks exigeants, pour la moitié du prix. Sur Frontier-Bench, Opus 5 a dépassé tous ses concurrents, doublant voire triplant les performances de son prédécesseur Opus 4.8. Dans CursorBench avec le niveau d'effort maximal, il n'a obtenu qu'un score inférieur de 0,5 % au pic de Fable 5. Les utilisateurs rapportent des résultats impressionnants en codage, modélisation 3D et développement de jeux. Parmi les tests notables figurent un clone de Rocket League, une structure cellulaire 3D, une structure cellulaire 3D à rotation à 360 degrés, une simulation de soufflerie en temps réel et une réplique de Minecraft. Opus 5 montre également de solides performances en conception assistée par ordinateur (CAO) et en éducation. Dans une démonstration d'auto-vérification, Opus 5 a reconstruit un modèle 3D de Boeing 747 en extrayant les contours et en mesurant 14 paramètres spécifiques par rapport aux données publiques, tandis que Fable 5 se contentait de vérifier des captures d'écran à l'œil nu. Le prix d'Opus 5 est de 5 dollars par million de tokens en entrée et 25 dollars en sortie, soit la moitié de celui de Fable 5. Sur ARC-AGI-3, Opus 5 obtient 30,2 % contre 7,8 % pour GPT-4.5 Sol. Sur l'examen final de l'humanité (Human's Last Exam) sans outils, Opus 5 atteint 56,3 % contre 56,5 % pour Fable 5 ; avec outils, Opus 5 atteint 64,7 % contre 63,9 % pour Fable 5. Opus 5 a également obtenu un score parfait à l'Olympiade internationale de mathématiques (IMO) 2026 sans outils externes. De plus, Anthropic a réduit le prompt système de Claude Code de plus de 80 % sans perte de performance en exploitant le jugement amélioré d'Opus 5. Elon Musk a publié un graphique coût-performance FrontierCode montrant que seuls Grok 4.5 et Opus 5 se trouvent sur la frontière de Pareto.
Source: QbitAI 量子位 — original
Nos articles précédents sur ce sujet ↓
Infos fraîches