DeepSeek-V4-Pro越跑越猛:三轮找回87.5%漏洞,超过Claude Opus 5和Qwen3.8 Max
BiRun 讯,安全公司 Aikido 用 8 款前沿模型测试 32 个真实漏洞。DeepSeek-V4-Pro-0813 单跑平均只能找出 58.3%,但连续跑 3 次再合并结果,直接找出 28 个,覆盖 87.5%,冲到第一。Claude Opus 5 和 Qwen3.8 Max 都只有 81.3%。
更夸张的是成本。DeepSeek 每找到一个漏洞平均只花 7.34 美元,Opus 5 要 66.97 美元,前者只有后者约 1/9。
DeepSeek 的表现也很反常:单跑不稳,多跑几次反而最能挖。它每一轮会找到不同的漏洞,三轮叠加后覆盖面超过所有对手。代价是误报很多,它报出来的问题里只有 65.6% 最终被确认是真漏洞,在 8 款模型中最低。
pilvar
更夸张的是成本。DeepSeek 每找到一个漏洞平均只花 7.34 美元,Opus 5 要 66.97 美元,前者只有后者约 1/9。
DeepSeek 的表现也很反常:单跑不稳,多跑几次反而最能挖。它每一轮会找到不同的漏洞,三轮叠加后覆盖面超过所有对手。代价是误报很多,它报出来的问题里只有 65.6% 最终被确认是真漏洞,在 8 款模型中最低。
pilvar
评论
0/500
登录 后参与讨论
免责声明:本文内容仅供参考,不构成任何投资建议。
更多快讯