DeepSeek称正训练2万亿参数模型,并规划8万亿参数版本

DeepSeek称正训练2万亿参数模型,并规划8万亿参数版本

N
News Editor
2026-09-22 01:51:56
DeepSeek CEO 梁文锋向投资人透露,公司正在训练一个 2 万亿参数模型,后续还计划开发 8 万亿参数模型。其现有旗舰 V4-Pro 总参数为 1.6 万亿,已开源并公开 490 亿激活参数。公开权重的超大模型中,Moonshot AI 的 Kimi K3 总参数为 2.8 万亿,采用 MoE 架构,每个 Token 激活 1040 亿参数。DeepSeek 于 7 月完成超 500 亿元融资,估值超 500 亿美元。

ChainCatcher 消息,DeepSeek CEO 梁文锋向投资人透露,公司正在训练一个 2 万亿参数模型,后续还计划开发一个 8 万亿参数模型。

DeepSeek 现有旗舰模型 V4-Pro 总参数为 1.6 万亿。公开信息显示,V4-Pro 已开源,总参数为 1.6 万亿,激活参数为 490 亿。

公开权重模型参数对比

目前已公开权重的超大模型中,Moonshot AI 的 Kimi K3 总参数达到 2.8 万亿。该模型采用 MoE 架构,在 2.8 万亿总参数中,每个 Token 激活 1040 亿参数。

按这一口径看,DeepSeek 规划中的 8 万亿参数模型,规模接近 Kimi K3 的近 3 倍。

融资与估值信息

DeepSeek 于 7 月完成超 500 亿元融资,估值超过 500 亿美元。

本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.
100

免责声明:

本平台展示的市场信息、项目资料与第三方内容仅用于行业信息分享,不构成任何形式的投资建议或收益承诺。

加密资产交易具有较高风险,用户应充分评估自身风险承受能力并独立作出决策,相关盈亏及法律责任由用户自行承担。