DeepSeek 发布 V4.1 Flash:552B 架构输入仅激活 8B

DeepSeek 发布 V4.1 Flash:552B 架构输入仅激活 8B

N
News Editor
2026-09-10 06:03:55
DeepSeek 正式发布 V4.1 Flash。该模型总参数为 552B,采用新的 Causal-Encoder-Decoder 架构,并原生支持图片理解。官方称,模型在读取输入时仅激活 8B 参数、生成回答时激活 16B,以压低推理成本。DeepSeek 还表示,V4.1 Flash 在官方基准中已超过 V4 Pro,并同步上线 API,调用模型名已更新为 deepseek-flash。

DeepSeek 正式发布 V4.1 Flash。该模型总参数为 552B,采用全新的 Causal-Encoder-Decoder 架构,并原生支持图片理解。

新架构将输入与输出分开处理

按照 DeepSeek 的说法,V4.1 Flash 是这套新架构系列中目前最小的模型。与此前方案不同,这套架构把输入和输出分开处理:读取输入时只激活 8B 参数,生成回答时激活 16B 参数。DeepSeek 称,这让 552B 的大模型也能把推理成本压下来。

预训练、强化学习和资源占用变化

DeepSeek 表示,经过新的预训练和更大规模强化学习后,V4.1 Flash 在官方基准中已经超过 V4 Pro。与此同时,缓存也被大幅压缩。相比上一代,V4.1 Flash 对 HBM 显存的需求降至 1/4,SSD 存储需求降至 1/8,主要用于降低长上下文和 Agent 反复调用时的成本。

API 已同步上线

V4.1 Flash 已同步上线 API,调用时将模型名改为 deepseek-flash 即可。

本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.
800

免责声明:

本平台展示的市场信息、项目资料与第三方内容仅用于行业信息分享,不构成任何形式的投资建议或收益承诺。

加密资产交易具有较高风险,用户应充分评估自身风险承受能力并独立作出决策,相关盈亏及法律责任由用户自行承担。