DeepSeek 创始人梁文锋在内部沟通中亲口确认,新一代旗舰模型 V4 将于 4 月下旬正式发布。据《新浪财经》引用知情人士消息,官方虽未公布确切日期,但开发者社群已感受到暖身信号:V4-Lite 变体正在 API 节点测试,推理速度较上一代提升 30%,128K tokens 上下文召回率达 94%。
万亿参数、百万 token 窗口
根据目前流出的非官方信息,V4 沿用 Mixture-of-Experts(MoE)架构,总参数量约 1 万亿,但每个 token 实际激活的参数仅约 370 亿,在算力效率上维持 DeepSeek 一贯的“精算师”风格。上下文窗口方面,V4 通过全新的 Engram 模块,有望支持 100 万 tokens 的超长上下文。Engram 的核心是条件记忆查询,让模��能以 O(1) 复杂度存取知识,而非随序列长度线性膨胀。
基准测试泄露数据显示,HumanEval 达 90%、SWE-bench Verified 超过 80%。若数据属实,其编程能力直逼现有主流旗舰模型。模态方面,V4 原生支持文字、图片与视频输入,定价约 $0.30/MTok(输入),延续 DeepSeek 低价策略。
完全运行在华为芯片上:最大的地缘政治信号
技术规格之外,最受关注的是硬件策略的彻底转向:官方称整个模型将完全执行于华为升腾 950 PR 芯片,不依赖任何英伟达 GPU。这一决定的影响远超 DeepSeek 本身。阿里巴巴、字节跳动、腾讯已陆续大量采购华为次世代芯片。若 V4 成功验证升腾可以撑起顶级旗舰模型的训练与推理需求,将是中国 AI 产业链在芯片自主化上迄今最具说服力的实战案例。
美国对英伟达出口的管制措施,在这个脉络下反而可能成为加速中国自主生态成熟的催化剂。

