DeepSeek-V4-Pro 现三种推理风格,社区疑为 Agent 环境差异
事件
8月15日,AI 社区发现调用
deepseek-v4-pro 接口时,更换 IP 或重建会话后出现三种推理风格:- 常以「Let me」开头,接近 V4 Pro Preview
- 常出现「The user wants me」,类似 V4 Flash
- 大量使用「we」,被部分用户称为「神版 V4 Pro」
关键线索
曾引发「多模型路由」猜测,但 DeepSeek Harness 源码更新揭示了另一可能。8月10日仓库 commit 显示:Minimal Agent 与强化学习(RL)训练环境对齐,Minimal preset 非 Standard 阉割版,而是在模拟模型训练的 Agent 环境。
社区测试
同一 V4 Pro 在不同 Harness 环境下得分:
- DSH Standard:91 分
- DSH PTC:92 分
- DSH Minimal:99/96 分
测试者开发「Anchored Standard」插件,模拟 Minimal 环境后恢复完整工具集,连续获得 98/99 分。
结论
所谓「三个模型」或为 API 部署差异与 Agent 环境叠加所致,DeepSeek 官方尚未确认,未公布多模型路由机制。