智能体开源 🇺🇸 07.08.2026 09:02

微软开源代码测试生成器:多语言单元测试智能体任务完成率达92.1%,对比原版Copilot的78.9%

MicrosoftMicrosoft
微软已开源代码测试生成器(code-testing-generator),这是一个用于编写和验证单元测试的智能体。在微软内部包含152个任务的基准测试中,其任务完成率达到92.1%,而原版GitHub Copilot为78.9%,并且生成的测试数量更少,行覆盖率相同。
微软已开源code-testing-generator,这是一个多语言单元测试智能体,能够编写测试并证明其有效性。它以dotnet-test插件的形式发布在MIT许可的dotnet/skills仓库中。该智能体解决了编程助手不指定测试框架、文件位置或断言的问题。它首先读取仓库,然后规划、编写、运行和检查测试。在微软内部的152任务基准测试中,它完成了140个任务(92.1%),而标准GitHub Copilot完成了120个任务(78.9%),使用相同的模型和提示,失败次数减少了63%。改进主要集中在模糊提示(解决了79/89个任务,对比59/89个)和针对差异的任务(解决了15/15个,对比0/15个)。它生成的测试数量减少了2.3%(6,963个对比7,129个),行覆盖率几乎相同(72.4%对比72.2%),平均任务时间快5.5%。该智能体通过研究-计划-实施流水线协调工作,检测语言和测试框架,查找构建和测试命令,并且从不修改生产代码。它在报告完成前运行五项验证检查,包括轻量级变异测试方法。该智能体是一个带有技能的智能体定义,不是托管服务,因此它可以在现有的编程智能体中运行,并保持代码本地化。
来源: MarkTechPost — 原文
我们之前关于此话题的帖子 ↓
最新新闻