⚡ 突发新闻
模型商业与市场 🇨🇳 26.07.2026 15:03

新Opus 5性能超Fable 5,价格仅一半?测试引爆网络,用户震惊

AnthropicAnthropic
Anthropic正式发布Opus 5,在多项基准测试中与Fable 5持平或超越,价格仅为后者一半。用户在游戏开发、3D建模等创意和技术任务中测试其能力,许多人称其为“怪兽”。
Anthropic 正式发布 Opus 5,以一半的价格在多项硬核基准测试中击败 Fable 5。在 Frontier-Bench 上,Opus 5 超越所有竞争对手,性能较前代 Opus 4.8 提升一倍以上。在最高努力程度的 CursorBench 中,其得分仅比 Fable 5 峰值低 0.5%。用户报告在编程、三维建模和游戏开发方面取得令人印象深刻的结果。值得注意的测试包括:火箭联盟克隆版、三维细胞结构、360 度旋转三维细胞结构、实时风洞模拟以及我的世界复刻版。Opus 5 在计算机辅助设计(CAD)和教育领域也表现出色。在一次自我验证演示中,Opus 5 通过提取轮廓线并针对公开数据测量 14 个特定参数,重建了一个三维波音 747 模型,而 Fable 5 仅通过肉眼检查截图。Opus 5 的价格为每百万输入 token 5 美元、每百万输出 token 25 美元,是 Fable 5 的一半。在 ARC-AGI-3 上,Opus 5 得分为 30.2%,而 GPT-4.5 Sol 为 7.8%。在人类最后一次考试(无工具)中,Opus 5 获得 56.3%,Fable 5 为 56.5%;使用工具后,Opus 5 达到 64.7%,Fable 5 为 63.9%。Opus 5 还在没有外部工具的情况下在 2026 年国际数学奥林匹克(IMO)中获得满分。此外,Anthropic 利用 Opus 5 改进的判断力,将 Claude Code 的系统提示词缩减了 80% 以上,同时未损失性能。埃隆·马斯克发布了一张前沿代码(FrontierCode)成本-性能图,显示只有 Grok 4.5 和 Opus 5 位于帕累托前沿上。
来源: QbitAI 量子位 — 原文
我们之前关于此话题的帖子 ↓
最新新闻