DeepSeek 发布改进版 V4-Pro 模型,上调 API 价格并开源其智能体软件
DeepSeek
OpenAI
Anthropic
MiniMax
Alibaba/Qwen
Moonshot AI
DeepSeek 推出了其 V4-Pro 模型的更新版本,在智能体基准测试中提升了性能,但仍落后于 Claude Opus 5 等顶尖模型。该公司还开源了 DeepSeek Harness(一个模块化智能体框架),并公布了新的 API 定价,包括高峰和低谷费率。
DeepSeek发布了其V4-Pro模型的更新版本,代号V4-Pro-0813,现已通过deepseek-v4-pro端点提供。虽然模型名称、参数数量和上下文窗口保持不变,但新版本原生支持OpenAI的Responses API与Codex集成,并允许将推理力度设置为低、高或最大。在DeepSeek自己的基准测试中,Terminal Bench 2.1得分从72.1升至87.9,DeepSWE从12.8升至62.7,在多项代理测试中超过了Claude Opus 4.8。然而,Artificial Analysis显示差距依然存在:V4-Pro的智能指数从45升至53,与GLM-5.2持平,但仍落后于Muse Spark 1.2(57)、Qwen3.8 Max(58)、Kimi K3(60)和Claude Opus 5(63)。新版本的权重尚未发布。此次更新紧随V4 Flash模型7月31日的更新之后,该模型以极低的价格几乎达到了Pro预览版的水平。此外,DeepSeek还以MIT许可证发布了DeepSeek Harness v0.1作为开发者预览版,基于Cordis插件系统构建,提供了OpenAI Codex和Claude Code的替代方案。该软件具有可扩展的插件架构和会话日志,用于恢复或分叉运行。最后,DeepSeek宣布自8月16日16:00 UTC起实施新的API定价,分为高峰和低谷时段。在低谷时段,V4-Pro输入成本为每百万token 0.66美元(原为0.435美元),输出为1.98美元(原为0.87美元);高峰时段价格分别为1.32美元和3.96美元。缓存命中价格从0.003625美元大幅上涨至低谷时段的0.022美元和高峰时段的0.044美元,显著降低了缓存折扣。这在一定程度上收回了5月份的降价,而此时DeepSeek正在寻求新融资并准备IPO。
来源: The Decoder (DE) —
原文
