xAI ra mắt Grok 4.5 để cạnh tranh với OpenAI và Anthropic
xAI
OpenAI
Anthropic
xAI đã giới thiệu Grok 4.5, định vị đây là mô hình tiên tiến nhất của họ, với mức giá cạnh tranh nhằm phá giá các đối thủ. Mô hình có giá 2 USD cho mỗi triệu token đầu vào và 6 USD cho mỗi triệu token đầu ra. Các điểm chuẩn cho thấy hiệu suất gần bằng các đối thủ hàng đầu, với chi phí thực thi cho các tác vụ lập trình thấp hơn đáng kể.
xAI,现已被SpaceX吸收,发布了其迄今为止最强大的模型Grok 4.5,同时正式推出了多个GPT-5.6版本。该公司强调成本效益,将该模型定价为每百万输入代币2美元(税前)和每百万输出代币6美元(税前)。相比之下,Anthropic最先进的模型每百万输入代币可达5美元,每百万输出代币可达25美元,而OpenAI的高端模型根据访问级别仍更为昂贵。Artificial Analysis的编程智能体指数早期评估显示,Grok 4.5在Grok Build中略微落后于Claude Code中的Fable 5,但可与Codex中的GPT-5.5相媲美,且其每次任务的执行成本显著更低,为2.49美元,而GPT-5.5为5.07美元,Fable 5为11.80美元。JP Data首席执行官Anand Joshi表示,现在说Grok 4.5改变游戏规则还为时过早,但指出其基准测试令人印象深刻,低代币消耗将对企业具有吸引力。Grok 4.5针对软件开发、应用程序创建、研究和业务流程自动化进行了优化,并声称比竞争对手生成更少的代币。它使用了Cursor(一个流行的AI辅助编程平台)进行训练,SpaceX最近宣布计划以600亿美元收购该平台。埃隆·马斯克将Grok 4.5描述为与Anthropic顶级模型相当,但速度更快、成本更低,尽管基准测试显示它在一些复杂编程任务上仍落后。在SWE Bench Pro上,Grok 4.5每个任务平均生成15,954个输出代币,而Claude Opus 4.8则超过67,000个,相差近四倍。然而,分析师警告说,仅凭代币价格并不能衡量真实价值;Forrester的Biswajeet Mahapatra建议关注每次成功结果的成本,而不是每个代币的成本。Omdia的Lian Jye Su强调实际完成的工作才是真正的价值,而Counterpoint Research的Neil Shah指出,自主智能体的大量代币消耗会导致账单冲击,促使企业转向更经济的模型。Anand Joshi重申,开发者的日常使用将验证该模型的竞争力。
Nguồn: Le Monde Informatique — IA —
bản gốc
