Mozilla 基金会于 7 月发布 2026 年版《开源 AI 现况报告》(State of Open Source AI),由 Mozilla 技术长 Raffi Krikorian 领衔。报告称,开源与封闭模型之间的能力差距,已从 2024 年 1 月的 8.04% 一度收敛到同年 8 月的 0.5%,到 2026 年 3 月又因封闭推理模型进展,回升至 3.3%。
报告提到,开源模型在编码与指令遵循任务上已达到与封闭模型相当的水平,但在推理和长上下文任务上仍然落后。
推理成本 3 年下降 50 倍,开源模型占据主流平台多数流量
报告显示,GPT-4 级别的推理定价已从 3 年前每百万 token 20 美元降至目前的 0.40 美元,降幅达到 50 倍。Mozilla 认为,这一下降速度高于传统摩尔定律下的降价节奏。
以 OpenRouter 这类主流推理代理平台为例,开源权重模型的流量占比已从 2025 年底约三分之一,上升到 2026 年年中超过一半,当前流量最大的前 5 个模型全部是开源权重模型。整体开发者采用方面,开源模型采用率为 79%,也高于封闭模型的 71%。
中国模型在 OpenRouter 继续扩张
报告特别点出中国开源生态的扩张速度。根据报告数据,中国模型在 2026 年 4 月已占 OpenRouter 流量的 45% 以上,前十大最常用模型中有 61% 来自中国。
其中,阿里巴巴的 Qwen 在 2026 年 2 月的月下载量,已超过接下来 8 家组织的总和。DeepSeek 目前则拥有 26,000+ 家企业账号,58% 的新 AI 初创公司在自身产品中整合了 DeepSeek。
Mozilla 认为,这与中国“AI+”战略在 2025 年 8 月推出,以及“十五五”在 2026 年 3 月将开源权重列为国家层级战略、用于对冲半导体出口管制有关。
采用率高于封闭模型,但生产部署仍落后
报告同时指出,开源模型当前面临的关键问题是“部署鸿沟”。虽然开源模型的采用率达到 79%,高于封闭模型的 71%,但真正成功推向生产环境的团队只有 51%,低于封闭模型的 63%。
报告将这一差距归因于模型能力之外的因素,包括基础设施成本、信息安全与合规要求、部署复杂度,以及后续运维压力。
在策略建议上,报告提出,业界应争取 harness、内存、权限系统这几层的所有权,尤其是在这些环节上开源仍保有优势的阶段。同时,报告将“代理权限模型”(write surface)列为当前最具杠杆但仍未解决的问题。

