DeepSeek V4四月下旬发布 百万token上下文完全跑在华为芯片

DeepSeek V4四月下旬发布 百万token上下文完全跑在华为芯片

N
News Editor 01
2026-07-23 08:45:14
DeepSeek 创始人梁文锋证实新一代旗舰模型 V4 将于四月下旬发布。模型采用万亿参数 MoE 设计,支持百万 tokens 上下文,推理速度提升 30%,并完全运行于华为升腾 950 PR 芯片,被视为中国 AI 摆脱英伟达依赖的关键一步。
DeepSeekV4华为升腾芯片AI大模型

DeepSeek 创始人梁文锋在内部沟通中亲口确认,新一代旗舰模型 V4 将于 4 月下旬正式发布。据《新浪财经》引用知情人士消息,官方虽未公布确切日期,但开发者社群已感受到暖身信号:V4-Lite 变体正在 API 节点测试,推理速度较上一代提升 30%,128K tokens 上下文召回率达 94%。

万亿参数、百万 token 窗口

根据目前流出的非官方信息,V4 沿用 Mixture-of-Experts(MoE)架构,总参数量约 1 万亿,但每个 token 实际激活的参数仅约 370 亿,在算力效率上维持 DeepSeek 一贯的“精算师”风格。上下文窗口方面,V4 通过全新的 Engram 模块,有望支持 100 万 tokens 的超长上下文。Engram 的核心是条件记忆查询,让模��能以 O(1) 复杂度存取知识,而非随序列长度线性膨胀。

基准测试泄露数据显示,HumanEval 达 90%、SWE-bench Verified 超过 80%。若数据属实,其编程能力直逼现有主流旗舰模型。模态方面,V4 原生支持文字、图片与视频输入,定价约 $0.30/MTok(输入),延续 DeepSeek 低价策略。

完全运行在华为芯片上:最大的地缘政治信号

技术规格之外,最受关注的是硬件策略的彻底转向:官方称整个模型将完全执行于华为升腾 950 PR 芯片,不依赖任何英伟达 GPU。这一决定的影响远超 DeepSeek 本身。阿里巴巴、字节跳动、腾讯已陆续大量采购华为次世代芯片。若 V4 成功验证升腾可以撑起顶级旗舰模型的训练与推理需求,将是中国 AI 产业链在芯片自主化上迄今最具说服力的实战案例。

美国对英伟达出口的管制措施,在这个脉络下反而可能成为加速中国自主生态成熟的催化剂。

本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.
100

免责声明:

本平台展示的市场信息、项目资料与第三方内容仅用于行业信息分享,不构成任何形式的投资建议或收益承诺。

加密资产交易具有较高风险,用户应充分评估自身风险承受能力并独立作出决策,相关盈亏及法律责任由用户自行承担。