星期三
08 / 13
DeepSeek-V4-Pro越跑越猛:三轮找回87.5%漏洞,超过Claude Opus 5和Qwen3.8 Max
星期三 2026-08-13 11:28

据动察 Beating 监测,安全公司 Aikido 用 8 款前沿模型测试 32 个真实漏洞。DeepSeek-V4-Pro-0813 单跑平均只能找出 58.3%,但连续跑 3 次再合并结果,直接找出 28 个,覆盖 87.5%,冲到第一。Claude Opus 5 和 Qwen3.8 Max 都只有 81.3%。

更夸张的是成本。DeepSeek 每找到一个漏洞平均只花 7.34 美元,Opus 5 要 66.97 美元,前者只有后者约 1/9。

DeepSeek 的表现也很反常:单跑不稳,多跑几次反而最能挖。它每一轮会找到不同的漏洞,三轮叠加后覆盖面超过所有对手。代价是误报很多,它报出来的问题里只有 65.6% 最终被确认是真漏洞,在 8 款模型中最低。