测试结果

安全公司 Aikido 用 8 款前沿模型测试 32 个真实漏洞,DeepSeek-V4-Pro-0813 三轮合并后找回 28 个漏洞,覆盖率达 87.5%,排名第一。

对比数据

  • Claude Opus 5:81.3%

  • Qwen3.8 Max:81.3%

  • DeepSeek 单跑平均:58.3%


成本优势

DeepSeek 每找到一个漏洞平均成本 7.34 美元,仅为 Claude Opus 5(66.97 美元)的约 1/9

代价与特点

DeepSeek 单跑表现不稳,但多轮叠加后覆盖面超所有对手。代价是误报率高,报出问题中仅 65.6% 被确认为真漏洞,在 8 款模型中最低。