Claude Opus 5 bat le record du FoodTruck Bench : 75 264 $ en 30 jours et analyse de la stratégie
Anthropic
Claude Opus 5 a atteint un record de 75 264 $ sur FoodTruck Bench, surpassant GPT-5.5 de 13,6 %. Le modèle a gagné grâce à une stratégie de prix plutôt qu'au volume, avec un ticket moyen de 12,69 $ contre 11,86 $. Il a également découvert des emplacements optimaux dès le premier jour et tenu un carnet de bord détaillé.
Claude Opus 5 a terminé la simulation FoodTruck Bench de 30 jours avec un capital final de 75 264 $, le meilleur résultat jamais obtenu, battant le précédent record de 13,6 % et GPT-5,5 de 41,4 %. Le modèle fonctionnait via l'API Anthropic avec un niveau de réflexion xhigh, pour un coût de 26,88 $ en frais d'API. Il a vendu 8 434 portions au prix moyen de 12,69 $, contre 8 303 portions à 11,86 $ pour GPT-5,5. Fait unique, Opus 5 a choisi son emplacement optimal dès le premier matin, en tenant compte du loyer, des concurrents, du public et des multiplicateurs selon le jour de la semaine, tandis que les autres modèles ont trouvé de bons emplacements plus tard par essais et erreurs. Son bloc-notes contenait une formule de demande qu'il avait lui-même dérivée, une carte des goulots d'étranglement en matière d'ingrédients et une expérience planifiée avec des conditions d'abandon, le tout rédigé sans accès aux mécanismes sous-jacents de la simulation. Le modèle a également créé son propre « livre des lois » et un coefficient de demande, et a raisonné sur les prix plafonds. Il s'est rendu régulièrement au même endroit pour se constituer une réputation, terminant avec 204 avis sur son emplacement principal contre 3 pour les sites du centre-ville utilisés par les autres modèles.
Source: Habr — хаб ИИ —
original
