智能体模型 🇷🇺 05.08.2026 13:03

一美元代理:Hermes Agent与DeepSeek V4 Flash组合的经济学

DeepSeekDeepSeek
一张广泛传播的截图声称,使用开源Hermes Agent在DeepSeek V4 Flash上处理了数亿个Token,成本仅略超一美元。本条新闻解析了如此低成本背后的机制,重点介绍了自动前缀缓存,并指出了哪些操作会破坏缓存以及供应商的相关声明。
八月初,一张截图在X平台上流传,展示了一个仪表盘,上面显示处理了数亿个令牌,账单却只有一美元多一点,据报道这是在使用开源的Hermes Agent于DeepSeek V4 Flash模型上产生的。Hermes Agent由Nous Research开发,采用MIT许可证,可与任何兼容OpenAI的端点配合使用,并具备闭环学习功能,可将学到的技能保存在Markdown文件中。DeepSeek V4 Flash自7月31日起公开测试,采用了与四月份预览版相同的架构,但经过微调后,代理能力有所提升。主要的成本节约并非来自低基本费率,而是来自自动前缀缓存:重复的提示前缀按低数十倍的价格计费。代理循环几乎完美契合了这一机制,因为每次调用都会重新发送相同的系统提示和历史记录,仅附加几行新内容。然而,如果提示头部元素发生变化,例如时间戳、会话标识符或动态重排的工具列表,这种节约就会失效。供应商声称,较小的模型在代理基准测试中优于较大的预览模型,但建议在需要大量推理时使用V4-Pro。高峰时段附加费已公布但尚未生效,而升级到Pro的混合路由会重置缓存。文章提供了定价费率,列出了常见的缓存破坏因素,并就速率限制和安全边界等规划和运营注意事项提出了建议。
来源: Habr — хаб ИИ — 原文
我们之前关于此话题的帖子 ↓
最新新闻