并非必须使用Claude Code:这位开发者为何钟情于中国AI模型
基准测试显示,中国的AI模型(如GLM-5.2、Kimi K3和Qwen3.8-Max)在部分任务上现已与美国主流模型持平甚至更优,且成本往往显著更低。文章重点介绍了一位偏爱这些中国模型的开发者。
Moonshot AI
Alibaba/Qwen
t3n03.08 · 11:02
基准测试显示,中国的AI模型(如GLM-5.2、Kimi K3和Qwen3.8-Max)在部分任务上现已与美国主流模型持平甚至更优,且成本往往显著更低。文章重点介绍了一位偏爱这些中国模型的开发者。
Moonshot AI
Alibaba/Qwen
Cogent AI 发布了针对网络安全专门进行后训练的推理模型 VR-1,同时发布了基准测试 IntrusionBench 以及受治理的运行时 Cogent AI Harness。该模型仅通过 Cogent Frontier Access Program 提供给经过审核的组织,主要面向大型企业和政府机构。Cogent 报告称,与 Kimi K3、Claude Opus 4.8 和 GLM-5.2 等基线相比,VR-1 验证的攻击路径数量约为其两倍,而成本约为其四分之一。
Cogent AI
Moonshot AI
Anthropic