项目聚焦模型推理,已启动约一年
据路透社援引知情人士消息,中国 AI 大模型公司 DeepSeek 正在秘密研发自有 AI 推理芯片。该项目据称已于约一年前启动,当前主要目标是服务模型推理需求,而非训练环节。这意味着其芯片方向更偏向实际部署与调用场景,而不是大规模模型预训练所需的算力投入。
近几个月持续招聘芯片设计工程师
报道称,DeepSeek 在过去几个月一直招聘芯片设计工程师,以推进相关项目研发。此举显示公司已在组织层面持续投入资源,尝试建立更自主的硬件能力。对于大模型厂商而言,自研推理芯片若顺利推进,通常有望在部署效率、供应链稳定性以及单位算力成本上带来一定改善。
当前仍依赖英伟达与华为,项目处于早期阶段
目前,DeepSeek 的模型训练及推理主要依赖英伟达和华为提供的芯片。若自研推理芯片最终落地,公司对外部供应商的依赖有望下降,同时增强硬件成本控制能力。不过,报道也提到,该项目仍处于早期阶段,且面临美国出口管制带来的现实约束,尤其是在芯片制造与内存获取方面仍存在限制。
本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.

