模型AI安全 🇺🇸 13.08.2026 16:04

Grok 4.6 在综合智能评测中追平 GPT-5.6 Sol——但 SpaceXAI 仍未说明其自主能力

xAIxAI
根据一份报告,Grok 4.6 在综合智能基准测试中追平了 GPT-5.6 Sol。然而,SpaceXAI 仍不愿记录其模型的自主能力。
据forkast.news报道,Grok 4.6在综合智能指标上已与GPT-5.6 Sol持平。尽管达到了这一性能里程碑,SpaceXAI尚未就模型自主执行的任务提供官方文档。透明度不足引发了对模型自主行为的担忧。
来源: xAI Grok (GNews) — 原文
我们之前关于此话题的帖子 ↓
最新新闻