模型商业与市场 🇩🇪 01.08.2026 00:08

DeepSeek新Flash模型与OpenAI GPT-5.6 Luna持平,成本约低60%

DeepSeekDeepSeek OpenAIOpenAI
DeepSeek公司发布了经济型模型V4 Flash "0731",在Artificial Analysis Intelligence指数中获得50分,比上一版V4 Flash高出十分。该模型仅比OpenAI GPT-5.6 Luna的经济型模型低一分,但每项任务的成本大约低60%,这得益于98%的缓存折扣。改进在代理任务中尤为明显:在GDPval基准测试中,得分从1189升至1559个Elo点,且幻觉现象减少。
DeepSeek发布了一款新的经济型模型V4 Flash“0731”,在人工智能分析指数上得分为50分,比2026年4月发布的上一版本高出10分。这比OpenAI的经济型模型GPT-5.6 Luna仅少1分,而每项任务的成本却低了约60%,即便考虑到OpenAI已降價80%。关键因素在于DeepSeek的98%缓存折扣,显著高于行业平均的90%。该模型消耗的令牌数也比前代减少了12%。各项测试类别的性能均有所提升,尤其是智能体任务:在衡量复杂现实办公工作的GDPval基准测试中,得分从1189 Elo点上升至1559 Elo点,且幻觉率有所下降。架构保持不变:2840亿参数,其中130亿为激活参数,上下文窗口为100万令牌。模型权重依据MIT许可证在Hugging Face上分发。
来源: The Decoder (DE) — 原文
我们之前关于此话题的帖子 ↓
最新新闻