xAI发布Grok 4.5,挑战OpenAI和Anthropic
xAI
OpenAI
Anthropic
xAI推出了Grok 4.5,将其定位为迄今最先进的模型,并采用激进定价策略以低于竞争对手。该模型每百万输入代币收费2美元,每百万输出代币收费6美元。基准测试显示其性能接近顶尖竞争对手,且在编码任务的执行成本上显著更低。
xAI现已并入SpaceX,推出了其迄今最强大的模型Grok 4.5,同时正式发布了GPT-5.6的多个版本。该公司强调成本效益,将该模型定价为每百万输入代币税前2美元,每百万输出代币税前6美元。相比之下,Anthropic最先进的模型每百万输入代币可达5美元,每百万输出代币可达25美元,而OpenAI的高端模型根据访问级别仍保持较高价格。Artificial Analysis的编码代理指数早期评估显示,Grok 4.5在Grok Build中的表现略逊于Claude Code中的Fable 5,但与Codex中的GPT-5.5相当,且执行成本显著更低,每任务2.49美元,而GPT-5.5为5.07美元,Fable 5为11.80美元。JP Data首席执行官Anand Joshi表示,现在判断Grok 4.5是否改变游戏规则还为时过早,但指出其基准测试令人印象深刻,低代币消耗将对企业具有吸引力。Grok 4.5针对软件开发、应用创建、研究和业务流程自动化进行了优化,并声称比竞争对手生成更少的代币。该模型使用Cursor进行训练,Cursor是一款流行的AI辅助编程平台,SpaceX最近宣布计划以600亿美元收购。埃隆·马斯克将Grok 4.5描述为与Anthropic顶级模型相当,但速度更快、成本更低,尽管基准测试显示其在某些复杂编程任务上仍落后。在SWE Bench Pro上,Grok 4.5每个任务平均生成15954个输出代币,而Claude Opus 4.8则超过67000个,相差近四倍。然而,分析师警告称,代币价格本身并不能衡量实际价值;Forrester的Biswajeet Mahapatra建议关注每项成功结果的成本,而非每代币成本。Omdia的Lian Jye Su强调实际工作完成才是真正的价值,而Counterpoint Research的Neil Shah指出,自主代理的大量代币消耗会导致账单冲击,促使企业转向更经济的模型。Anand Joshi重申,开发者的日常使用将检验该模型的竞争力。
来源: Le Monde Informatique — IA —
原文
