SpaceXAI发布Grok 4.6人工智能模型,对标GPT-5.6 Sol和Claude Fable 5
OpenAI
Anthropic
Moonshot AI
SpaceXAI推出了其新版Grok 4.6人工智能模型,声称该模型可与OpenAI的GPT-5.6 Sol和Anthropic的Claude Fable 5相媲美。在人工分析情报指数中,Grok 4.6获得61分,超越了Moonshot的Kimi K3,在推理能力上与GPT-5.6 Sol持平,而略逊于Fable 5 Max。该模型现已在Cursor、Grok Build以及通过SpaceXAI、OpenRouter、Vercel和Cloudflare的应用程序编程接口(API)中提供。
SpaceXAI推出了Grok 4.6,这是一款新的旗舰AI模型,公司称其在能力上与OpenAI的GPT-5.6 Sol和Anthropic的Claude Fable 5相当。Grok 4.6专为“长生命周期”智能体设计,能够自主长时间处理任务,自行重启并朝着目标推进,处理不熟悉的代码库,并测试自身结果。在Artificial Analysis Intelligence Index中,Grok 4.6获得61分,超越了月之暗面(Moonshot AI)的开源权重模型Kimi K3,并追平了GPT-5.6 Sol的最高推理水平,仅比Fable 5 Max低一分。与Grok 4.5相比,新版本在CursorBench、FrontierCode、APEX-Agents和Terminal-Bench等所有列出的基准测试中均有提升,这得益于更长的训练周期、更好的工程数据,以及针对编程和知识工作的强化学习扩展。该模型在代码开发、终端操作、信息处理和智能体性能方面也表现出显著进步,同时API定价维持在每百万输入标记2美元和每百万输出标记6美元,在主要专有模型和开源模型中定位为中端价格。Grok 4.6现已可在Cursor、Grok Build以及通过SpaceXAI、OpenRouter、Vercel和Cloudflare的API使用。
来源: 3DNews —
原文
