模型智能体 🇺🇸 13.08.2026 10:02

SpaceXAI 发布 Grok 4.6:50 万上下文、新 xhigh 推理等级,对标 GPT-5.6 Sol Max

OpenAIOpenAI AnthropicAnthropic
SpaceXAI 已发布 Grok 4.6,这是对 Grok 4.5 的一次后训练升级,具备 50 万 token 的上下文窗口和新的 xhigh 推理努力等级。该模型在人工分析智能指数上取得小幅提升,但在关键编码基准上仍落后。它通过 API、Cursor 和 Grok Build 提供,定价层级在提示 token 超过 20 万后翻倍。
SpaceXAI 推出了 Grok 4.6,作为 Grok 4.5 的后训练升级版本,保持基础模型不变,通过更长的补充训练运行、重新生成的监督微调轨迹以及在智能体环境中的强化学习进行改进。该模型在人工智能分析智能指数上得分 61 分,高于此前的 56 分,与 GPT-5.6 Sol Max 持平,但在编码基准测试方面仍落后,例如 DeepSWE(65.9% 对 73%)和 Terminal-Bench(26%,尽管是 Grok 4.5 的 15.7% 的两倍)。上下文长度为 500,000 个令牌,支持文本和图像输入以及纯文本输出,并新增了 xhigh 推理努力级别。它可通过 xAI API 以 grok-4.6 的名称使用,也可在 Grok Build、Cursor、OpenRouter、Vercel 和 Cloudflare 中使用,但不提供开放权重或自行托管。定价方面,对于低于 200,000 个提示令牌的部分,输入费用为每百万令牌 2 美元,缓存输入费用为每百万令牌 0.50 美元,输出费用为每百万令牌 6 美元;超过该阈值后费用翻倍。文章指出,在 GDPval-AA 和 AA-Briefcase 上的加粗胜出属于置信区间内的统计并列,并且比较排除了 Claude Opus 5。
来源: MarkTechPost — 原文
我们之前关于此话题的帖子 ↓
最新新闻