模型智能体 🇷🇺 27.07.2026 18:01

Claude Opus 5 在 FoodTruck Bench 创下纪录:30天收入75,264美元及策略拆解

AnthropicAnthropic
Claude Opus 5 在 FoodTruck Bench 实现了 75,264 美元的创纪录收入,超过 GPT-5.5 达 13.6%。该模型依靠定价策略而非销量获胜,平均客单价为 12.69 美元,而对比模型为 11.86 美元。它还在第一天就发现了最佳位置,并维持了详细的草稿记录。
Claude Opus 5在为期30天的FoodTruck Bench模拟中,以75,264美元的最终资本收官,创下有史以来最佳战绩,较此前纪录提升13.6%,比GPT-5.5高出41.4%。该模型通过Anthropic API运行,思考等级设为xhigh,API费用为26.88美元。共售出8,434份餐食,平均售价12.69美元,相比之下GPT-5.5售出8,303份,平均售价11.86美元。尤为独特的是,Opus 5在首个早晨便选定了最优位置——综合考虑租金、竞争对手、受众及星期系数等因素——而其他模型则是通过后期试错才找到合适地点。其思维草稿中包含自行推导的需求公式、食材瓶颈地图以及带终止条件的计划实验,所有内容均在未了解底层模拟机制的情况下完成。该模型还自创了一部“法则书”和一个需求系数,并对价格上限进行了推理。它始终光顾同一地点以积累声誉,最终在其主站点收获204条评价,而其他模型使用的市中心站点仅有3条评价。
来源: Habr — хаб ИИ — 原文
我们之前关于此话题的帖子 ↓
最新新闻