⚡ BREAKING
Nieuwe Opus 5 half de prijs en krachtiger dan Fable 5? Tests doen het internet ontploffen, gebruikers geschokt
Anthropic
Anthropic heeft officieel Opus 5 uitgebracht, dat in meerdere benchmarks wedijvert met of beter presteert dan Fable 5 voor de helft van de prijs. Gebruikers testen de mogelijkheden in uiteenlopende creatieve en technische taken, van game-ontwikkeling tot 3D-modellering, waarbij velen het een 'monster' noemen.
Anthropic heeft officieel Opus 5 uitgebracht, dat Fable 5 in meerdere veeleisende benchmarks verslaat voor de helft van de prijs. Op Frontier-Bench overtrof Opus 5 alle concurrenten en presteerde meer dan twee keer zo goed als zijn voorganger Opus 4.8. In CursorBench op hoogste inspanningsniveau scoorde het slechts 0,5% lager dan Fable 5's piek. Gebruikers meldden indrukwekkende resultaten op het gebied van programmeren, 3D-modellering en game-ontwikkeling. Opmerkelijke tests zijn onder andere een Rocket League-kloon, een 3D-celstructuur, een 360-graden draaiende 3D-celstructuur, real-time windtunnelsimulatie en een Minecraft-replica. Opus 5 toonde ook sterke prestaties in computer-aided design (CAD) en onderwijs. In een zelfverificatiedemonstratie bouwde Opus 5 een 3D-model van een Boeing 747 opnieuw door contourlijnen te extraheren en 14 specifieke parameters te meten aan de hand van openbare gegevens, terwijl Fable 5 alleen screenshots met het oog controleerde. De prijs van Opus 5 is $5 per miljoen invoertokens en $25 voor uitvoer, de helft van Fable 5. Op ARC-AGI-3 scoorde Opus 5 30,2% tegenover 7,8% van GPT-4.5 Sol. Op Human's Last Exam zonder hulpmiddelen behaalde Opus 5 56,3% tegenover 56,5% van Fable 5; met hulpmiddelen behaalde Opus 5 64,7% tegenover 63,9% van Fable 5. Opus 5 behaalde ook een perfecte score op de Internationale Wiskunde Olympiade (IMO) 2026 zonder externe hulpmiddelen. Daarnaast heeft Anthropic Claude Code's systeemprompt met meer dan 80% verminderd zonder prestatieverlies door gebruik te maken van Opus 5's verbeterde beoordelingsvermogen. Elon Musk plaatste een FrontierCode-kostenprestatiediagram waarop alleen Grok 4.5 en Opus 5 de Pareto-grens vormden.
Bron: QbitAI 量子位 —
origineel
