xAI, Grok 4.5 출시로 OpenAI 및 Anthropic에 도전
xAI
OpenAI
Anthropic
xAI가 Grok 4.5를 출시하며, 이 모델을 지금까지 가장 진보된 모델로 포지셔닝했습니다. 공격적인 가격 책정을 통해 경쟁사들을 견제하려는 전략입니다. 이 모델은 입력 토큰 100만 개당 2달러, 출력 토큰 100만 개당 6달러의 비용이 듭니다. 벤치마크 결과 최상위 경쟁사들과 근접한 성능을 보였으며, 코딩 작업의 실행 비용은 눈에 띄게 낮습니다.
现已并入SpaceX的xAI推出了其迄今最强大的模型Grok 4.5,同时正式发布了多个GPT-5.6版本。该公司强调成本效益,将该模型定价为每百万输入代币税前2美元,每百万输出代币税前6美元。相比之下,Anthropic最先进的模型每百万输入代币可达5美元,每百万输出代币25美元,而OpenAI的高端模型根据访问级别仍更昂贵。在Artificial Analysis的编码智能体指数上的早期评估显示,Grok 4.5在Grok Build中略微落后于Claude Code中的Fable 5,但与Codex中的GPT-5.5相当,且其每次任务的执行成本显著更低,为2.49美元,而GPT-5.5为5.07美元,Fable 5为11.80美元。JP Data首席执行官Anand Joshi表示,现在说Grok 4.5改变游戏规则还为时过早,但他指出基准测试令人印象深刻,较低的代币消耗量将吸引企业用户。Grok 4.5针对软件开发、应用创建、研究和业务流程自动化进行了优化,声称比竞争对手生成更少的代币。它使用Cursor(一个流行的AI辅助编程平台)进行训练,SpaceX最近宣布计划以600亿美元收购该平台。埃隆·马斯克将Grok 4.5描述为与Anthropic顶级模型相当,但速度更快、成本更低,不过基准测试显示它在某些复杂编程任务上仍落后。在SWE Bench Pro上,Grok 4.5每个任务平均生成15,954个输出代币,而Claude Opus 4.8则超过67,000个,相差近四倍。然而,分析师警告称,代币价格并不能衡量真实价值;Forrester的Biswajeet Mahapatra建议关注每次成功结果的成本,而不是每代币成本。Omdia的Lian Jye Su强调,实际完成的工作才是真正的价值,而Counterpoint Research的Neil Shah指出,自主智能体大量消耗代币会导致账单冲击,促使企业转向更经济的模型。Anand Joshi重申,开发人员的日常使用将验证该模型的竞争力。
출처: Le Monde Informatique — IA —
원문
