第三方评测机构 Artificial Analysis 已完成对 DeepSeek V4.1 Flash 的独立测试。结果显示,该模型综合智能指数为 40 分,高于 DeepSeek 自家 V4 Pro 0813 的 36 分,但仍低于 Kimi K3 的 44 分和 GLM-5.3 的 45 分。按这份第三方榜单,DeepSeek 暂未拿回国产模型第一的位置。
成本与速度差距明显
价格方面,V4.1 Flash 跑完一个 Intelligence Index 任务的平均成本为 0.27 美元。相比之下,Kimi K3 和 GLM-5.3 都在 2 美元左右,差距约 7 倍。
输出速度上,V4.1 Flash 达到 197 Token/s,也明显高于 Kimi K3 的约 36 Token/s 和 GLM-5.3 的约 58 Token/s。
Agent 与长上下文表现较强
Agent 仍是 V4.1 Flash 最突出的部分。在 AutomationBench-AA 测试中,该模型拿到 69%,追平 GPT-6 Astra,并超过 GLM-5.3 的 62%。在长上下文测试 AA-LCR 中,V4.1 Flash 取得 84%。
输出过长削弱部分价格优势
不过,这一模型的短板也较明显。根据 Artificial Analysis 的测试,在 AA 测试中,V4.1 Flash 单任务平均输出约 8.9 万 Token,比 V4 Pro 多 62%。这也吃掉了它的一部分价格优势。
本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.

