DeepSeek 已悄然把 deepseek-v4-pro 更换为「0813」正式版。这是该模型自 4 月以来以预览形式运行后的正式发布。根据 Decrypt 报道,DeepSeek 这次主打的信息很直接:性能只比 Anthropic 的 Claude Fable 5 低约 5%,价格却只有后者的四十几分之一。
基准测试显示平均落后约 5.3%
按照 DeepSeek 公布的基准测试数据,这款支持 100 万 token 上下文的 V4 Pro,在九项代理(agent)基准测试中,平均落后 Claude Fable 5 约 5.3%,其中两项成绩还高于 Claude Fable 5。
不过,文中也提到,这组「差 5%、便宜 46 倍」的对照数据由 DeepSeek 自行公布,实际表现仍有待第三方验证。
价格差距远大于性能差距
真正拉开差距的是定价。DeepSeek 的收费约为每百万输入 token 0.43 美元、每百万输出 token 0.87 美元;Claude Fable 5 的价格则是每百万输入 token 10 美元、每百万输出 token 50 美元。按文中换算,DeepSeek 的成本大约只有 Claude Fable 5 的 1/46。
正式版编码与代理能力较预览版明显提升
和此前的预览版相比,正式版在几项指标上的提升较为明显。Terminal Bench 2.1 从 72.1 升至 87.9,DeepSWE 从 12.8 提高到 62.7,DSBench-FullStack 也从 41.8 升至 71.1。这几项变化对应的,是编码能力与代理能力的增强。
ABMedia 在文中提到,这也让 DeepSeek 加入近期这场以价格挑战前沿模型的竞争。链新闻当天还报道过 xAI 的 Grok 4.6,主打同价升级、对标前沿模型。
低价模型竞争继续升温
报道指出,随着开源与低价阵营持续逼近顶级闭源模型的性能,OpenAI 和 Anthropic 面临的定价压力只会越来越大。至于 DeepSeek 的来历与争议,原文提到可另参阅链新闻整理的 DeepSeek 完整指南。

