DeepSeek 正式发布 V4.1 Flash。该模型总参数为 552B,采用全新的 Causal-Encoder-Decoder 架构,并原生支持图片理解。
新架构将输入与输出分开处理
按照 DeepSeek 的说法,V4.1 Flash 是这套新架构系列中目前最小的模型。与此前方案不同,这套架构把输入和输出分开处理:读取输入时只激活 8B 参数,生成回答时激活 16B 参数。DeepSeek 称,这让 552B 的大模型也能把推理成本压下来。
预训练、强化学习和资源占用变化
DeepSeek 表示,经过新的预训练和更大规模强化学习后,V4.1 Flash 在官方基准中已经超过 V4 Pro。与此同时,缓存也被大幅压缩。相比上一代,V4.1 Flash 对 HBM 显存的需求降至 1/4,SSD 存储需求降至 1/8,主要用于降低长上下文和 Agent 反复调用时的成本。
API 已同步上线
V4.1 Flash 已同步上线 API,调用时将模型名改为 deepseek-flash 即可。
本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.

