DeepSeek V4.1 Flash第三方实测未登顶国模榜首,但成本仅约为竞品七分之一

DeepSeek V4.1 Flash第三方实测未登顶国模榜首,但成本仅约为竞品七分之一

N
News Editor
2026-09-11 05:11:13
第三方机构 Artificial Analysis 对 DeepSeek V4.1 Flash 完成独立测试,其综合智能指数为 40 分,高于自家 V4 Pro 0813 的 36 分,但低于 Kimi K3 的 44 分和 GLM-5.3 的 45 分。价格方面,V4.1 Flash 跑完单个 Intelligence Index 任务平均成本仅 0.27 美元,约为 Kimi K3 和 GLM-5.3 的七分之一。该模型输出速度达到 197 Token/s,在 Agent 与长上下文测试中也拿到较高分数,但单任务平均输出约 8.9 万 Token,削弱了部分价格优势。

第三方评测机构 Artificial Analysis 已完成对 DeepSeek V4.1 Flash 的独立测试。结果显示,该模型综合智能指数为 40 分,高于 DeepSeek 自家 V4 Pro 0813 的 36 分,但仍低于 Kimi K3 的 44 分和 GLM-5.3 的 45 分。按这份第三方榜单,DeepSeek 暂未拿回国产模型第一的位置。

成本与速度差距明显

价格方面,V4.1 Flash 跑完一个 Intelligence Index 任务的平均成本为 0.27 美元。相比之下,Kimi K3 和 GLM-5.3 都在 2 美元左右,差距约 7 倍。

输出速度上,V4.1 Flash 达到 197 Token/s,也明显高于 Kimi K3 的约 36 Token/s 和 GLM-5.3 的约 58 Token/s。

Agent 与长上下文表现较强

Agent 仍是 V4.1 Flash 最突出的部分。在 AutomationBench-AA 测试中,该模型拿到 69%,追平 GPT-6 Astra,并超过 GLM-5.3 的 62%。在长上下文测试 AA-LCR 中,V4.1 Flash 取得 84%。

输出过长削弱部分价格优势

不过,这一模型的短板也较明显。根据 Artificial Analysis 的测试,在 AA 测试中,V4.1 Flash 单任务平均输出约 8.9 万 Token,比 V4 Pro 多 62%。这也吃掉了它的一部分价格优势。

本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.
100

免责声明:

本平台展示的市场信息、项目资料与第三方内容仅用于行业信息分享,不构成任何形式的投资建议或收益承诺。

加密资产交易具有较高风险,用户应充分评估自身风险承受能力并独立作出决策,相关盈亏及法律责任由用户自行承担。