Muse Code:Meta 对 OpenAI 和 Anthropic 编程代理的回应
Meta
Anthropic
OpenAI
Meta 正凭借新的编程代理 Muse Code 挑战 Anthropic 和 OpenAI。这款测试版终端代理基于专为编程任务优化的新语言模型 Muse Spark 1.2,并以相对较低的价格提供。
Meta的新编程代理Muse Code使用并行后台代理和语言模型Muse Spark 1.2,价格相对较低。该测试版终端代理可以分析软件项目、规划变更、编写代码,并通过命令行用测试检查结果。Muse Spark 1.2与Muse Code联合训练,并与其工具对齐。与Anthropic的Claude Code和OpenAI的Codex竞争,Meta专注于低使用成本。多个后台代理在整个会话期间保持活跃,收集信息、处理子任务,并将结果报告给主代理。本地事件日志记录模型调用、工具调用、批准和变更,使代理在崩溃后能精确地从停止处恢复。Meta提供两个价格层级:一个大幅折扣的贡献者计划,带有有限的令牌配额,仅在选定的国家可用;以及一个常规的基于使用量的API计划。独立的基准测试平台Artificial Analysis将Muse Spark 1.2列为同性能级别中成本效益最高的模型之一,得分54分,大致与Grok 4.5和GPT-5.5相当,但落后于Anthropic和OpenAI的顶级模型。在编码基准测试中,结果好坏参半,该模型在一个测试中比其前代略好,在另一个测试中则略差。Artificial Analysis在其测试环境中测试了Muse Spark 1.2,而不是作为完整产品的Muse Code。整个方案在日常使用中与Claude Code和Codex的竞争力如何,仍悬而未决。凭借由Meta Superintelligence Labs开发的Muse Spark,Meta旨在迎头赶上最强大的AI系统。Muse Spark 1.2是继最初的Muse Spark和7月份的Muse Spark 1.1之后的第三次发布。与Llama不同,Meta不发布模型权重。
来源: Heise online —
原文
