OpenRouter——全球最大的中立LLM路由器——最新数据透露一个惊人信号:截至2026年5月,来自中国的开放权重模型已吃下平台约61%的token消耗,仅DeepSeek单周就占17.6%。而两年前,开放权重的王座还属于Meta的Llama,如今Llama已彻底跌出榜单。
格局翻转背后是长期被低估的事实:开放权重模型的智能水平稳定维持在美国前沿实验室身后3到6个月,这道差距并未扩大。对任何摊开云账单的组织来说,将工作负载从前沿模型迁移至开放权重,省下的都是真金白银。
DeepSeek把价格打到地板
DeepSeek V4 Flash是首个被直接投入真实agentic流程、当作Anthropic或OpenAI级替代品使用的开放权重模型。更大版本的V4 Pro在SWE-bench Verified上拿下80.6%,为开放权重最高分。价格方面,DeepSeek系列极具���争力:V4 Flash缓存命中输入每百万token仅0.0028美元,输出0.28美元;V4 Pro缓存未命中输入0.30美元,输出0.50美元;深度推理模型R1输出2.19美元。
GLM接下品质王座
由z-ai发布的GLM 5.2在Artificial Analysis Intelligence Index v4.1中获51分,位列开放权重第一,领先Nemotron 3 Ultra的48分、MiniMax M3与DeepSeek V4 Pro的44分,仅比封闭的Claude Fable 5低约5分。在更贴近真实场景的agentic评测GDPval-AA上,其水平约与GPT-5.5同级。GLM 5.2擅长规划与长程任务,代价是推理成本较高:输入每百万token约0.447美元,输出3.31美元。
更值得玩味的是发布时间——GLM 5.2登场前几天,美国一纸出口管制指令逼得Anthropic为防外国国民存取而广泛停用Fable 5与Mythos 5。一边是封闭模型因地缘政治说停就停,一边是MIT授权、接近前沿、可自架的开源模型。
美国队:辉达Nemotron 3 Ultra
开放权重不只有中国力量。辉达近期释出的Nemotron 3 Ultra在同样榜单获48分,是最强的美国开放权重模型。5500亿参数、550亿active,混合Mamba-2与Transformer架构,采用OpenMDW授权——不仅开放权重,连训练数据、配方、评测工具一起开源。辉达的算盘非常直白:开放模型用得越多,跑这些��型的Blackwell芯片、CUDA及企业服务就卖得越多。

