DeepSeek发布更新版V4 Pro模型,提升编程能力
DeepSeek
DeepSeek已更新其旗舰V4 Pro模型(版本0813),针对复杂任务、编程和AI智能体进行了优化,内部基准测试显示性能显著提升,并在部分独立测试中超越GLM-5.2。该模型拥有1.6万亿参数,其中490亿为活跃参数,支持100万token的上下文窗口,每百万输入token成本为0.435美元。
DeepSeek发布了其旗舰型号V4 Pro的0813版本,据公司文档所述,该版本面向复杂任务、编程和AI代理工作。在独立的Artificial Analysis平台上,新版本得分高于Z.ai的GLM-5.2,后者是中国最强的编程AI模型之一。据DeepSeek表示,V4 Pro在内部测试中的得分显著提升:在Terminal-Bench 2.1(命令行任务)中从72.1%升至87.9%,在CyberGym(漏洞处理)中从52.7%升至83.3%,在DeepSWE(编程)中从12.8%升至62.7%。该模型拥有1.6万亿参数,其中活跃参数为490亿,上下文窗口为100万token,最大输出长度为384,000 token。定价为每百万输入token 0.435美元(无缓存),每百万输出token 0.87美元。V4 Pro最初于2026年4月在聊天机器人和Hugging Face上推出;8月13日发布的更新版本可通过应用、网页版以及Codex、Claude Code和OpenCode等工具获取。8月初,DeepSeek宣布计划提高价格,彭博社报道该公司正在中国北方建设一个大型数据中心。
来源: Rusbase (RB.RU) —
原文
