中国开源AI模型挑战硅谷策略,引发美方关注
中国AI实验室近期密集发布接近前沿性能的开源模型,如Kimi K3和Qwen 3.8,在智能体编码任务上表现优异,引发硅谷和华盛顿的讨论与担忧,凸显中美在AI开放与封闭路径上的分歧。
AI行业虽未完全迎来DeepSeek 2.0时刻,但已非常接近。中国领先的AI实验室近期势头强劲,发布了一系列接近前沿水平的开源模型。Z.ai于6月发布了GLM 5.2,Moonshot AI上周发布了Kimi K3,阿里巴巴本周一发布了Qwen 3.8。
硅谷和华盛顿立即开始讨论这些模型,尤其是被广泛视为其中最佳的K3。风险投资家兼特朗普总统的AI顾问David Sacks称Moonshot模型的表现“令人担忧”。本周早些时候,商务部长Scott Bessent暗示美国可能对中国AI公司实施制裁。
周三,白宫科技政策办公室主任Michael Kratsios声称,特朗普政府有“信息表明Moonshot AI为开发其K3模型而蒸馏了Anthropic的Fable”,他认为这相当于“窃取美国专有技术并破坏美国研究”,是“不可接受的”。
(Moonshot AI未立即回应置评请求。)这些新模型有几个共同点:第三方基准测试显示它们性能几乎与最好的西方模型相当;它们针对智能体编码任务(今年AI领域最热门的方向)进行了优化;并且它们已经或即将以开放权重发布,使其易于获取和透明。
但当前时刻与2025年1月(DeepSeek的R1模型震惊世界)之间最大的相似之处或许是,它再次印证了中美AI实验室在开放与封闭路径上的分歧。DeepSeek首次亮相时,挑战了只有通过数十亿美元算力基础设施和训练投资构建的闭源模型才能实现前沿性能的前提。
但自那以后,西方AI实验室继续以同样方式开发AI,如今美国前沿模型比一年前感觉更加封闭。Anthropic数月来一直表示,其最新Mythos模型在黑客攻击方面过于危险,只有经批准的合作者才能使用。
当它最终更广泛发布时,白宫以广泛的出口管制作为回应,迫使Anthropic暂时将Mythos及其能力较弱的姊妹模型Fable 5下线。OpenAI同样在收到白宫请求后推迟了GPT 5.6的发布。
与此同时,中国的情况截然不同。中国初创公司和科技巨头加倍押注开源:任何拥有足够好计算机环境的人现在都可以下载开放权重模型,在本地运行,添加定制,总体上享受比OpenAI和Anthropic允许的更大的自由度。
在许多方面,开放与封闭的辩论比以往任何时候都更与美国与中国的辩论纠缠在一起。中国实验室选择基于开源模型的商业策略有很多原因。作为AI领域较新较小的参与者,让模型免费开放有助于中国公司吸引更多用户、合作者和媒体关注。
这也使它们与OpenAI、Anthropic、Google、SpaceX等财力雄厚的巨头处于不同的竞争赛道。今年早些时候,有传言称阿里巴巴在重组其企业AI模型开发团队后,可能考虑加入闭源竞赛。
但这家科技巨头周一宣布,将再次以开放权重发布最新版Qwen——这一深受全球技术社区喜爱的开源模型系列,向客户和公众表明它尚未转向。或许对中国方法最有力的验证是模型本身。中国实验室已生产出被广泛认为是世界上最好的开源AI模型,表明美国公司不再独家拥有构建最强大系统的能力。
众包模型评估平台Arena AI目前将K3评为网页开发任务的最佳模型,在智能体任务中排名第四,仅次于Anthropic的Fable和Opus 4.8以及OpenAI的GPT 5.6。
独立AI基准测试公司Artificial Analysis将K3在其智能指数中排名第三。Moonshot AI于7月16日发布K3预览版后不久,世界各地的人们开始争相试用,消耗了大量推理算力资源,以至于公司暂时限制新用户注册。
随着越来越多的人开始使用功能几乎与西方竞争对手相当的开源中国模型,一些人开始质疑为OpenAI或Anthropic的产品付费是否真的值得。多个中国实验室能够创建出有能力的智能体模型,并且不惧向公众发布,这正在戳破OpenAI和Anthropic遥遥领先的普遍认知。
就像DeepSeek一样,K3的粉丝现在将其视为西方AI模型被过度炒作和过度保护的证据。独立研究公司Tech Buzz China的创始人马锐在社交媒体帖子中表示:“Kimi获得如此多的喜爱,简直太疯狂了。
”她指的是该公司宣布K3的需求压垮了服务器。“这只有靠[硅谷]实验室过去一年糟糕的沟通和决策才可能实现,”她补充道。
“我认为Anthropic过度夸大了风险,或者描述了即将到来但目前尚未扩散的风险,”西雅图独立AI研究员Nathan Lambert说,他最近访问了Moonshot AI在中国的办公室。不过,他承认,和其他公众一样,他几乎没有关于Mythos实际表现的第一手信息。
“我们依赖少数私营公司和州能力枯竭的联邦政府来做判断,”他说。除了挑战西方关于AI的主流叙事外,中国开源模型也被证明是美国闭源模型的实用商业替代品。它们不仅在X上被讨论和与其他模型对比——它们已成为越来越多西方初创公司和个人用户流行且易于使用的选择。
“从GLM 5.2开始,实际使用这些最新模型发生了真正的转变,”Lambert谈到Z.ai的模型时说。“即使在GLM 5.2发布几周后,我听说湾区的AI研究人员仍将其用于工作流程的核心部分。
Kimi作为更强的模型,只会做得更多,尤其是在网络安全等领域,Mythos、Fable和GPT 5.6实际上无法使用。”事实上,这已经发生。周二,OpenAI披露了一起令人担忧的事件,其GPT-5.6 Sol模型入侵了开源AI平台Hugging Face的生产系统。
Hugging Face表示,它已使用开源模型GLM 5.2分析此次网络攻击,因为其他前沿模型因内置安全护栏而拒绝提供帮助。中国AI模型也往往比西方替代品更便宜,但这不一定是其主要卖点。
虽然K3等模型对token收费较低,但早期测试表明,它们可能需要比西方模型更多的token来解决相同问题,从而缩小了成本差距。“在我相当有限的使用中,[K3]似乎也非常消耗token。
我不清楚这个模型运行起来是否真的那么便宜,”前白宫AI顾问、最近加入OpenAI担任战略未来主管的Dean Ball在社交媒体帖子中写道,他同时称赞K3是“一个非常好的模型”。即使相对消耗token,像K3这样的模型最终确实挑战了一个驱动AI行业的基本假设。