2026年最智能神经网络:Claude Fable 5领跑,但GPT-5.6 Sol是大多数人的最佳选择
Anthropic
OpenAI
Moonshot AI
Google/DeepMind
截至2026年7月22日,Anthropic的Claude Fable 5以60分的综合基准测试得分位居榜首,成为原始算力最强的模型。然而,OpenAI于2026年7月9日发布的GPT-5.6 Sol Max得分为59分,但成本显著更低(每个任务1.04美元对2.75美元),并内置了互联网搜索、编程和图像生成工具。其他值得关注的模型包括Moonshot AI的Kimi K3(57分,擅长网页开发)和Google的Gemini 3.6 Flash(50分,但速度关键任务中每秒304个token)。没有单一模型适合所有任务;专家建议根据具体需求选择。
截至2026年7月22日,Anthropic的Claude Fable 5在Artificial Analysis的聚合基准测试中排名第一,得分为60分,以微弱优势领先所有竞争对手。它在多步推理、处理数十份文档、发现矛盾以及制定连贯计划方面表现出色,但每次任务的成本约为2.75美元。OpenAI于2026年7月9日发布的GPT-5.6 Sol Max得分为59分,每次任务成本仅为1.04美元,内置了网页搜索、代码执行、图像生成和电子表格处理等工具,成为大多数用户的最佳通用选择。Moonshot AI的Kimi K3得分为57分,根据用户测试,它在网站和网页界面创建方面领先。Google的Gemini 3.6 Flash在智能测试中得分约为50分,但每秒可生成304个token,非常适合对速度要求高的任务,如批量文件分析或在Google生态系统内工作;它还包括Nano Banana图像生成器。专家指出,领先者之间的差异仅为几个百分点,而快速的发展可能在数周内重塑排名。
来源: Hi-News.ru —
原文
