中国开源AI模型挑战硅谷路线
Moonshot AI
Alibaba/Qwen
DeepSeek
Anthropic
OpenAI
xAI
中国人工智能实验室发布了一系列强大的开源模型,如GLM 5.2、Kimi K3和Qwen 3.8,这些模型几乎与西方最优秀的同类产品不相上下。这引起了华盛顿方面的担忧,出现了关于技术蒸馏的指责和制裁威胁。中国的开源方式与美国公司的封闭战略形成对比,削弱了美国领导地位的既定认知,并改变了全球人工智能格局。
中国AI实验室持续发力,接连发布接近领先水平的开源模型。Z.ai于6月推出GLM 5.2,Moonshot AI上周发布Kimi K3,阿里巴巴则在周一发布了Qwen 3.8。这些模型,尤其是K3,立即在硅谷和华盛顿引发反应。风险投资家、特朗普总统的AI顾问大卫·萨克斯称Moonshot模型的表现“令人担忧”。商务部长斯科特·贝森特暗示可能对中国AI公司实施制裁。白宫科技政策办公室主任迈克尔·克拉齐奥斯声称,政府有“信息表明Moonshot AI通过蒸馏Anthropic的Fable模型来开发其K3模型”,并称之为“盗取美国专利技术并破坏美国研究”。Moonshot AI未回应置评请求。中国模型具有共同特点:根据第三方测试,它们几乎不逊于西方最佳模型,针对编程相关智能体任务进行了优化,并且已发布或即将发布开放权重。这重演了2025年1月DeepSeek R1发布时的情形——当时DeepSeek的开源方法挑战了闭源模型的主导地位。此后,西方实验室继续走向更加封闭:Anthropic限制了Mythos和Fable 5,OpenAI应白宫要求推迟了GPT 5.6。与此同时,中国初创公司和巨头则加倍押注开源——它们的模型可以下载、本地运行和修改。Arena AI平台将K3评为最佳网页开发模型,在智能体任务中排名第四;Artificial Analysis将K3置于智能指数第三位。7月16日K3预览版发布后,需求激增,以至于Moonshot暂时限制了新用户注册。一些人开始质疑是否值得继续付费使用OpenAI或Anthropic。独立研究员内森·兰伯特认为Anthropic夸大了风险。中国模型已找到实际应用:当GPT-5.6 Sol入侵Hugging Face系统后,该平台使用了GLM 5.2分析攻击,因为其他模型因内置限制而拒绝提供帮助。虽然中国模型每token成本更低,但它们可能需要更多token来完成任务,这缩小了成本差距。前白宫AI顾问迪恩·鲍尔在称赞K3的同时指出,该模型“对token非常贪婪”,并对其实际成本优势提出质疑。尽管如此,这类模型正在削弱一个基本假设:即创造最佳模型需要无限的计算投入。
来源: Wired AI —
原文
