DeepSeek V4 正式版发布时间进一步临近。根据目前流出的信息,V4 最早可能于明日发布,最迟也就在最近几天,部分用户已经拿到 DeepSeek V4(GA)灰度测试权限。
这次灰度阶段共出现两个版本:DeepSeek V4 Flash 和 DeepSeek V4 Pro。
灰度测试开始放量,用户用 CoT 开头判断是否切到 V4
围绕 DeepSeek V4“满血版”,外界最关心的问题之一,是自己是否已经被灰度到新版。博主 AiBattle 给出了一套民间判断方法:观察思维链(CoT)的第一人称写法。

如果模型在思考过程中的开头是“I'm”“I'll”,而不是老版本常见的“Let me”,就大概率已经用上了 V4 GA 版。
开发者体验流出,性能评价出现分化
在 Fable 5 与 GPT-5.6 Sol 持续竞争的背景下,市场对开源 AI 新模型的关注度持续升温。开发者 Pankaj Kumar 在体验后,对 V4 的表现给出了一组总结:
- 整体表现接近 Opus 4.8 级别,编码能力接近 GPT-5.6 Sol;
- Agent 能力明显增强,3D 和 SVG 生成效果提升;
- 面对同一任务,V4 所需的迭代轮数比 Fable 5 更多。
他还表示,从当前生态位看,V4 大概率打不过刚发布的 Kimi K3,但价格会明显更低。如果这一性能水平最终对应这一价格,市场可能再次看到一次“DeepSeek 时刻”。

首轮测试 demo 外流,外界反馈不一
目前,DeepSeek V4(GA)首轮测试 demo 已开始流出,外界评价并不一致。有人认为它已经能够打平 Claude 5,但也有开发者指出,Pro 版相比 Flash 版的领先幅度并不明显。
流出的 demo 中,包括一款由 V4 Pro 生成的 3D 模拟射击游戏,核心玩法是操控攻城弩车进行打靶训练,基础 UI 功能已经具备。
另一个由 V4 正式版生成的示例,是一款融合《我的世界》和《无人深空》风格的 HTML 游戏,具备较高可玩度。

此外,经典游戏“割绳子”也被展示为由 V4 一次生成完成。流出内容中还包括一些其他 demo,例如 Xbox 手柄 SVG 测试和游戏生成结果。
GA 上线后将调整 API 定价,首次引入“峰谷计费”
价格仍是 DeepSeek V4 这次发布中最受关注的变量之一。多方爆料都指向同一个结论:性能未必排在第一,但价格会明显更低。
据称,上个月底 DeepSeek 已向全部 API 用户发送邮件,表示将在 7 月中旬上线 V4 正式版。GA 发布后,API 定价会同步调整,并首次引入“峰谷计费”。
其中,deepseek-v4-pro 的定价为:每百万输出 tokens 平时 0.87 美元,高峰时段 1.74 美元;缓存未命中的输入平时 0.435 美元。
deepseek-v4-flash 的价格更低:每百万输出 tokens 平时 0.28 美元,高峰时段 0.56 美元;缓存命中的输入 0.0028 美元。
这也是 DeepSeek 首次在自身算力价格体系中加入时段计价。报道认为,这对个人用户影响不大,但对那些在工作时间持续运行 Agent 的团队来说,需要重新计算成本。与此同时,缓存命中价格仍维持在较低水平,把批量任务、评测跑分和数据生成安排在高峰之外,仍有机会压低整体开支。
与 Fable 5 相比仍有价格优势,官方自测数据也被提及
按照文中披露的数据,相较于 Fable 5 每百万输出 50 美元的定价,V4 在性价比上仍然非常突出。
文中还提到,在 V4 预览版发布时,官方自测的 SWE-bench Verified 中,DeepSeek-V4-Pro-Max 与 Claude Opus 4.6 Max 仅相差 0.2 个百分点,价格却只有后者的七分之一。
不过,在长上下文检索、专业软件工程以及部分知识推理评测中,Opus 仍然保持领先。

旧模型将于 7 月 24 日下线
除了新版本即将发布,deepseek-chat 和 deepseek-reasoner 两个老模型名也将于 7 月 24 日正式下线。
从目前流出的信息看,DeepSeek V4 大概率不会成为“全项第一”的模型。Fable 5、GPT-5.6 Sol 和 Kimi K3 已经占据各自位置,但 DeepSeek 这次的核心看点,仍然是把 Opus 级能力压到更低价格区间。

