DeepSeek将国产芯片训练列为核心押注,仍在使用英伟达
据 The Information 援引知情人士消息,DeepSeek CEO 梁文锋在最新闭门投资人会上表示,用华为等国产芯片训练大模型是公司最大的押注之一,并称此事必须成功。DeepSeek预计最早在今年第四季度拿到新一批可用于训练的华为芯片,型号和数量未披露。梁文锋还称,华为芯片只需几年有望追上英伟达,但公司目前训练模型仍使用英伟达芯片。

据 The Information 援引知情人士消息,DeepSeek CEO 梁文锋在最新闭门投资人会上表示,用华为等国产芯片训练大模型是公司最大的押注之一,并称此事必须成功。DeepSeek预计最早在今年第四季度拿到新一批可用于训练的华为芯片,型号和数量未披露。梁文锋还称,华为芯片只需几年有望追上英伟达,但公司目前训练模型仍使用英伟达芯片。

马来西亚正评估将主权 AI 计划交由华为 Ascend 910C 芯片支撑,项目预算据称高达 20 亿马币,约合 4.94 亿美元。彭博称,若最终拍板,这可能成为全球首个政府层级在相关项目中弃用美国方案、转向中国芯片的案例。争议焦点包括美国出口管制、Cloud Act 对数据主权的影响,以及华为方案与英伟达方案之间的成本与性能权衡。

据彭博援引知情人士消息,DeepSeek计划在内蒙古乌兰察布建设AI数据中心,部署至少16万张华为Ascend 950DT芯片,这将成为最大的华为AI芯片集群之一。受限于华为产能,完整交付或超一年,这批芯片主要用于运行模型而非训练,核心训练仍依赖英伟达GPU。

阿里巴巴、字节跳动、腾讯三家巨头批量采购华为升腾950PR芯片,合计数十万颗,价格涨20%。这批芯片将用于部署DeepSeek V4。DeepSeek在V4发布前只开放给华为,拒绝英伟达和AMD。

DeepSeek 创始人梁文锋在投资人会议上表示,中美 AI 的核心差距在算力资源,而非人才或模型能力。会议纪要显示,DeepSeek 正与华为合作优化升腾生态,并用自研 TileLang 与编译器降低对 NVIDIA CUDA 的依赖。分析师 Jukan 认为,一旦中国实现算力自主,NVIDIA 对训练与推理市场的生态绑定可能被削弱,Google TPU、Amazon Trainium 以及 Neocloud 的竞争格局也会随之变化。

Citrini 分析师 Jukan援引 DeepSeek 创始人梁文锋的观点称,AI 驱动的代码生成和 TileLang 等高级编程语言正在降低 CUDA 生态门槛。DeepSeek 已通过自研编译器和 TileLang 减少对英伟达软件生态的依赖,并与华为推进适配。Jukan 据此认为,CUDA 的开发者护城河正在被侵蚀,这对英伟达构成压力,也可能推动 AMD 的 ROCm 生态缩小差距。

DeepSeek 创始人梁文锋证实新一代旗舰模型 V4 将于四月下旬发布。模型采用万亿参数 MoE 设计,支持百万 tokens 上下文,推理速度提升 30%,并完全运行于华为升腾 950 PR 芯片,被视为中国 AI 摆脱英伟达依赖的关键一步。

特斯拉在加州和得克萨斯州完成AI5芯片设计审查,公司称其为重大进步。后续将迅速开发AI6和AI7,AI8预计实现突破性能力,推动自动驾驶和机器人技术跨越发展。
