DeepSeek于7月24日正式发布DeepSeek V4 Preview,两款模型均开源并支持100万token上下文。在代码能力基准测试中,V4以83.7%的分数压倒Claude Opus 4.6(80.9%)和GPT-5.2(80%),但未超越最新旗舰模型。
V4-Pro:1.6万亿参数MoE架构
V4系列包含两个版本:V4-Pro(1.6万亿参数,每次推理激活490亿)和V4-Flash(2840亿参数,激活130亿)。架构采用混合专家模型(MoE),按需调用部分“专家”神经元,在保证回答质量的同时大幅降低算力消耗。100万token的上下文窗口可一次消化整部《哈利波特》七部曲加大量代码库。
代码跑分领先,Agentic表现紧追第一梯队
除代码外,DeepSeek-V4-Pro Max在知识推理方面接近GPT-5.4、Gemini-3.1-Pro和Opus-4.6;在Agentic任务上表现突出。具体在SWE Verified测试中得80.6分,几乎与Gemini-3.1-Pro持平,略低于Opus-4.6;BrowseComp得分83.4,仅输给Gemini的85.9;MCPAtlas Public得分73.6,接近Opus-4.6的73.8,领先GPT-5.4与Gemini。不过在高难推理榜单上,仍被GPT-5.4、Gemini-3.1-Pro或Opus-4.6压过一头。
成本屠榜:输入价格仅为对手的1/27
DeepSeek V4每百万token输入定价约0.3美元,相比性能相近的闭源模型便宜约27倍。目前V4-Pro受限于算力,预计下半年升腾950芯片批量上市后价格有望进一步下调。
完全跑在华为升腾950芯片上
V4完全运行于华为升腾950 PR芯片,不依赖英伟达CUDA生态。在美国出口管制持续收紧的背景下,这不仅是工程选择,更是长期生存策略。DeepSeek用V4给出了第一个规模化可用的纯国产芯片大模型方案。

