内存。架构包含 284B 参数,每个 token 激活 13B,上下文长度为 1M token,混合注意力机制结合了 CSA 和 HCA,并采用流形约束的超连接。基准测试显示 V4-Flash-0731 在所有智能体基准上优于 V4-Pro(预览版),但这些数字均为 DeepSeek 在未发布的测试框架上报告的。DSpark 通过 vLLM 标志启用,模型使用编码文件夹而非 Jinja 聊天模板。