社区测试指向 DeepSeek-V4-Pro 差异或来自 Agent 环境

社区测试指向 DeepSeek-V4-Pro 差异或来自 Agent 环境

N
News Editor
2026-08-15 03:14:58
AI 社区近日围绕 DeepSeek-V4-Pro 是否存在多个隐藏版本展开讨论。测试者称,同一 API 接口在更换 IP 或新建会话后会出现三种不同推理风格,社区一度怀疑后端存在多模型路由。结合 DeepSeek Harness 8 月 10 日的一次代码更新和多组环境测试结果,另一种解释浮现:差异更可能与 Agent 运行环境有关,而非简单存在三个隐藏模型。该说法目前尚未获得 DeepSeek 官方确认。

BlockBeats 消息,8 月 15 日,AI 社区近日围绕 DeepSeek-V4-Pro 是否存在多个版本持续讨论。部分用户称,在调用 deepseek-v4-pro 接口时,如果更换 IP 或重新创建会话,模型会呈现出三种不同的「推理风格」。

社区描述的第一类风格,常以「Let me」开头,被认为接近此前的 V4 Pro Preview;第二类经常出现「The user wants me」,被指类似 V4 Flash;第三类则大量使用「we」,被部分用户称为能力更强的「神版 V4 Pro」。

由于同一会话一旦进入某种模式,后续表现通常会保持稳定,社区一度猜测 DeepSeek 是否在 API 背后隐藏了多个模型,并通过路由机制进行分发。

代码更新带来另一种解释

随着对 DeepSeek Harness 源码的进一步分析,社区提出了另一种解释:这些差异未必来自不同模型权重,也可能来自 Agent 运行环境的不同。

社区注意到,8 月 10 日,DeepSeek Harness 官方仓库新增了一条关键 commit:「fix(preset): align minimal agent with RL composition」。按社区解读,这次更新的目标,是让 Minimal Agent 与强化学习(RL)训练时使用的 Agent 环境保持一致。

官方文档显示,Minimal preset 包含极简 system prompt、persistent Bash 环境、指定编辑工具,以及 RL 训练使用的 compaction policy,同时移除了额外身份提示、Web 提示和工具说明。

按这一说法,DSH Minimal 可能并不是 Standard 版本的「阉割版」,而是在模拟模型训练阶段真实接触的 Agent 环境。

社区测试结果

社区测试也给出了与上述判断一致的结果。同一个 DeepSeek V4 Pro 在不同 Harness 环境中的表现分别为:

  • DSH Standard:91 分
  • DSH PTC:92 分
  • DSH Minimal:99/96 分

随后,测试者又开发了一个名为「Anchored Standard」的插件。该插件在首次请求时先模拟 Minimal 环境,只开放 shell 和 read 工具,在完成第一次工具调用后,再恢复 Standard 的完整工具集。

按测试者披露,这种设置连续获得了 98/99 分。

争议焦点落在首次接触的 Agent Scaffold

测试者认为,影响 V4 Pro Agent 能力发挥的关键,未必是模型最终拥有多少工具,而是模型第一次看到的内容,也就是 System Prompt、Tool Schema 和 Agent Scaffold 的组合。

基于这一判断,所谓「三个 DeepSeek 模型」的现象,可能是两层因素叠加后的结果:一层是 API 服务环境、部署配置或灰度实例的差异;另一层是模型是否进入了更接近 RL 训练分布的 Agent 环境。

官方尚未确认多模型路由

不过,上述说法目前还没有得到 DeepSeek 官方确认。官方 API 文档显示,deepseek-v4-pro 对应的是 DeepSeek-V4-Pro-0813 正式版本,并未公布多模型自动路由机制。

就目前信息看,DeepSeek-V4-Pro 的不同表现,更可能是模型权重、推理环境和 Agent 框架共同作用的结果,而不是简单存在三个隐藏模型。

本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.
360

免责声明:

本平台展示的市场信息、项目资料与第三方内容仅用于行业信息分享,不构成任何形式的投资建议或收益承诺。

加密资产交易具有较高风险,用户应充分评估自身风险承受能力并独立作出决策,相关盈亏及法律责任由用户自行承担。