DeepSeek V4 在2026年4月24日发布预览版,包含1.6万亿参数的Pro版和2840亿参数的Flash版,核心卖点是百万上下文——所有官方服务免费。几乎同时,OpenAI推出GPT-5.5,标准版每百万输入Token收费5美元,输出30美元;Pro版输入30美元,输出180美元。而DeepSeek V4-Flash缓存命中输入每百万Token仅0.2元人民币,输出2元;V4-Pro缓存未命中输入12元,输出24元。价格差距悬殊,但竞争早已从模型能力延伸至商业模式。
乌兰察布的冷风
V4发布前不久,DeepSeek招聘启事中出现“数据中心高级交付经理”与“高级运维工程师”职位��月薪最高3万元,14薪,驻场内蒙古乌兰察布。这家曾标榜“极简、纯粹”的算法公司,因美国出口管制收紧——H100、H800断供,降级版H20也被列入管控名单——不得不转向华为升腾生态。V4的庞大规模需要成千上万张升腾芯片和配套机房,从轻资产转型为自建基础设施的重资产玩家。
200亿美元的妥协
4月,DeepSeek传出启动首次外部融资,目标估值3000亿元人民币(约440亿美元),计划增资500亿,其中对外募资300亿,腾讯与阿里竞相入局。融资的直接驱动力除了买芯片,更是应对人才流失:从2025年下半年起,至少5名核心研发成员被大厂挖走——王炳宣去腾讯,罗福莉被雷军千万年薪挖至小米,郭达雅加盟字节跳动Seed团队。梁文锋不得不通过融资保住研发队伍,但代价是稀释了“不受外部压力干扰的研究自由”。
电力即算力
乌兰察布数据中心依赖当地丰富的绿电:装机容量1940.2万千瓦,占比约65.9%,电价较东部便宜约50%。年均气温仅4.3℃,自然冷却期近10个月,设备节能20%~30%。算力的尽头是电力——中国庞大的特高压输电网络与廉价电力,成了DeepSeek对抗硅谷的物理外挂。
端侧与开源双重突围
对抗算力封锁的另一条路径是端侧AI。中国手机厂商小米、OPPO、vivo将蒸馏后的大模型植入手机,模型体积压缩至1.2~2.5GB,即使离线也能运行。同时,开源模型渗透全球南方:乌干达的非政府组织Sunbird AI基于阿里巴巴Qwen微调出Sunflower系统,将支持的本地语言从6种扩展至31种,用于农业推广。马来西亚科技公司微调出符合伊斯兰教法的AI模型。OpenRouter数据显示,某一周全球前10大热门模型消耗8.7万亿Token,其中中国模型占比约61%,首次超过美国。
梁文锋将这场竞争比作“修自来水而非商品房”:“算力的围墙建得再高,也挡不住流向低处的自来水。”

