Claude Opus 5 stellt FoodTruck-Bench-Rekord auf: 75.264 $ in 30 Tagen und Strategieaufschlüsselung
Anthropic
Claude Opus 5 erzielte einen Rekord von 75.264 $ in FoodTruck Bench und übertraf GPT-5.5 um 13,6 %. Das Modell gewann durch Preisstrategie statt durch Volumen, mit einem durchschnittlichen Bestellwert von 12,69 $ gegenüber 11,86 $. Es entdeckte auch optimale Standorte am ersten Tag und führte ein detailliertes Notizbuch.
Claude Opus 5 hat die 30-tägige FoodTruck-Bench-Simulation mit einem Endkapital von 75.264 Dollar abgeschlossen, dem besten Ergebnis aller Zeiten. Damit wurde der bisherige Rekord um 13,6 % und GPT-5.5 um 41,4 % übertroffen. Das Modell operierte über die Anthropic-API mit der Denkstufe „xhigh“ und verursachte API-Gebühren in Höhe von 26,88 Dollar. Es verkaufte 8.434 Portionen zu einem Durchschnittspreis von 12,69 Dollar, verglichen mit GPT-5.5s 8.303 Portionen zu 11,86 Dollar. Einzigartig an Opus 5 ist, dass es bereits am ersten Morgen seinen optimalen Standort wählte und dabei Miete, Wettbewerber, Zielpublikum sowie Tageswochenfaktoren berücksichtigte, während andere Modelle gute Plätze erst später durch Versuch und Irrtum fanden. Sein Notizblock enthielt eine selbst hergeleitete Nachfrageformel, eine Karte der Engpässe bei Zutaten und ein geplantes Experiment mit Abbruchbedingungen – alles verfasst ohne Zugriff auf die zugrundeliegenden Simulationsmechaniken. Das Modell erstellte außerdem ein eigenes „Gesetzbuch“ und einen Nachfragekoeffizienten und reflektierte über Preisobergrenzen. Es suchte konsequent denselben Standort auf, um einen Ruf aufzubauen, und endete mit 204 Bewertungen an seinem Hauptstandort im Vergleich zu 3 für Innenstadtstandorte, die von anderen Modellen genutzt wurden.
Quelle: Habr — хаб ИИ —
Original
