Mozilla 报告:开源 AI 现状——开放权重崛起与运营挑战
Mozilla 发布《开源 AI 现状》报告,指出开放权重模型已缩小与闭源模型的能力差距,占据多数推理 token 份额,但运营工具和信任仍是生产部署的主要障碍。
开源 AI。V1.0 · 持续更新 · 2026 年 7 月来自我们 CTO Raffi Krikorian 的一封信“在新西兰最北端,一家毛利广播公司正在训练毛利语的语音模型——这种语言对任何市场来说都太小——其许可证确保数据保留在族人手中。
普华永道,全球最大的会计师事务所之一,在金融语言上微调了一个开放模型,如今在其自有硬件上为数百名客户运行,没有按 token 计费。洛桑的研究人员与红十字会共同构建了一个开放医疗模型,并根据其人道主义指南进行调整,正在国内和坦桑尼亚准备临床试验。
在东非,农民使用一款在手机上离线运行的模型诊断木薯病害,这片区域云从未触及。在瑞士,一个公共联盟在公共超级计算机上训练了一个国家模型,并发布了全部内容:权重、数据、训练代码。他们没有人请求许可,也没有人能租用这些。
他们拥有它——这就是全部理念。我们以前经历过。Mozilla 的存在是因为一家公司试图掌控互联网的入口,而一个开放社区奋起确保它永远无法做到。二十五年后,有人正在重演同样的剧本。我们第一次押注开放。
开放赢了。团结起来,我们可以再次做到。我们的信念很简单:前进的道路是竞争和互操作性。
我们相信一个由多种型号组成的世界,将它们组合在一起的标准方法,以及随时离开任何供应商的自由。Open在这里有记录。它扩大了蛋糕,让更多的人拥有其中的一部分。阅读以下内容作为地图:开放人工智能在哪里获胜--一些数字甚至让我们感到惊讶--以及它暴露在哪里。
一个隐藏其弱点的案例是广告。”开放权重缩小了能力差距,而情报价格暴跌。0%与顶级封闭模型的能力差距-编码同等,推理落后0×36个月内GPT-4级推断成本下降:20美元-0美元。每100万个代币40个01开源人工智能的现状开放重量不再是一种妥协。
它们是工作发生的地方:大多数生产代币现在都经过它们,OpenRouter上的五个最高批量模型都是开放的。封闭模型在推理和多模式方面仍然处于前沿地位,但前沿并不是大多数工作负载所需要的。商品投入品不拥有定价权。
价值上升,到达代理人的背带。能力差距:8。04% → 0。5% → 3。3%Chatbot Arena在24个月内的开放与封闭差距。到2024年8月,差距已暴跌至0。5%,2025年2月DeepSeek-R1短暂与美国顶级型号匹敌。
到2026年3月,已重新开放至3. 3%,封闭推理模型领先。但3.
3%是参差不齐的前沿的平均水平:开放性在编码、描述遵循和常识方面处于或接近同等水平,而差距集中在推理、长上下文检索和代理任务方面。问题不再是开放模型是否足够好。这是您工作量所需的。悬停在积分上。
推理在36个月内下降了50倍GPT-4-每100万个代币的等效价格-比互联网时代的带宽或PC计算价格曲线更快。原木规模。开放重量赢得代币通过开放权重模型在OpenRouter上路由的代币份额从微不足道的基数增长到2025年底的三分之一,到2026年中期的大多数。
OpenRouter实时排行榜-上个月,路由的代币五款销量最高的车型均为未平仓重量。Anthropic的封闭Claude车型是下一个美国制造的参赛者。开放体重关闭开放部署困难。数据来自Firefox/ SlashData 2026开发者调查。
开放模型领先采用:添加人工智能功能的开发人员中,79%使用它们,而关闭的开发人员中,71%使用它们,两者在很大程度上是互补的,一半的开发人员同时使用两者。但生产是团队停滞的地方:只有51%的开放模型团队达到了生产,而封闭模型团队的这一比例为63%。
差距在于运营工具和信任,而不是模型能力。开放模式处于领先地位,并且大多与封闭模式共存目前使用每种模型类型的应用程序中添加人工智能功能的开发人员比例,以及两者如何重叠。
开放模式79%封闭模型71%它们如何结合仅29%OS50%两者仅21%CS开放采用达到顶峰,封闭采用仍处于边缘按地区划分的开放模式采用情况。大中华区和东亚地区领先89%;南美洲和西欧是仅有的两个封闭采用超过开放采用的地区。
按公司规模划分的生产率如果差距与资源有关,规模就会缩小差距,但事实并非如此。随着规模的增加,封闭式上升54%-73%。开放几乎没有变化:53%-57%。封闭模型开放模型团队为何流失:开放模型的挑战Δ =搅拌-仍在使用,以百分点为单位。
最大的差距(性能、集成、维护)是运营,而不是能力。悬停在栏杆上。仍在使用openChurned away同样的挑战,无处不在:是什么阻碍了区域开放按地区列出的当前和流失的开放模式开发人员对每个挑战的命名比例。
更温暖的细胞意味着更多的开发人员被阻止。最上面的几行是在每个地区的运营情况:基础设施成本、安全性和合规性、维护、部署复杂性。南亚最依赖安全和支持;只有北美和大中华区超过15%的人表示没有重大挑战。
02开源人工智能堆栈运营低。堆栈的9个层和48个组件符合10个标准(1-5)。单击一个层以打开其组件:每个组件都有自己的标准分数、成熟度等级、开放与封闭的平价判决,并展示一些最受欢迎的开源项目。
将鼠标悬停在任何单元格上以获取详细信息。强大可行,但碎片化早期强(等于4。0)3. 5-3. 93. 0-3. 42. 5-2. 9弱(<2。
5)运营差距=标准化+企业准备就绪03谁在打赌开放重量人工智能是一个规模达数千亿美元的商业市场,由受资助的公司建设,由全球企业生产运营。数据库超过了5美元。4 B运行率;Mistral在12个月内将ARR规模扩大了20倍,达到约4亿美元;
DeepSeek ARR规模达到约2.2亿美元,最近筹集了7美元。4 B,估值超过500亿美元。五种收入模式已得到大规模验证:托管推理、企业平台、本地许可、微调服务和利用工具。风险投资资助的开源生态系统:披露的资金总额,百万美元随着您滚动,条会增长。
按公司地区划分的颜色。北美中国欧洲和世界其他地区开放生态系统的财务成熟度对持有公开股票的公司的资金、估值和收入拉动力。该生态系统已从赠款转向风险规模,再转向公开市场。计量模式大规模突破封闭前沿模型是以代币形式销售的--在生产规模上,电表就成为了问题。
五分之一的使用量,4%的收入在OpenRouter上(2025年5月至9月),封闭模型占据了约80%的使用量和约96%的收入。价格驱动力:按约90%平价计算,每次通话关闭成本约为6倍。~ 24美元。
8B未实现的年度节省-Linux基金会对开放与封闭价格不对称进行的Nagle-Yue研究估计,具有可比能力的每次通话成本约为6倍04为什么它无处不在这是一个主权选择。超过70项国家人工智能战略已上线。
战略问题已经从是否制定国家人工智能政策转向一个国家可以拥有哪一层。单击下面的标记或国家/地区。开放的理由是选择性2026年6月,选择性不再是抽象的,也不再是一个采购问题。克劳德寓言5上市三天后,一项政府的出口命令迫使Anthropic切断地球上所有外国人的准入。
没有咨询其他首都。没有一个可能。选择性合规是不可能的,因此模型在下午5:21对所有人来说都关闭了。周五。任何建立在该模型之上的人都会继承一次没有警告的关闭,