选项
首页
快讯
内容
MichaelMartinez
MichaelMartinez
2026-06-04

一场耗时两小时、费用为1,500美元的网络安全测试让各大大型语言模型与一个被黑客入侵且Firebase凭证暴露的Android应用进行了对抗。尚未正式发布的GPT-5.5在攻击成功率上达到了70%,但每次尝试的成本高达9.46美元;而开源项目DeepSeek V4Pro则仅以每次0.62美元的成本,就有30%的成功率,因此在自动化安全审计领域具有极高的成本效益。谷歌Gemini拒绝了所有测试任务;而Claude系列模型由于设置了过于严格的防护机制,仅有两次成功完成了测试。

一场耗时两小时、费用为1,500美元的网络安全测试让各大大型语言模型与一个被黑客入侵且Firebase凭证暴露的Android应用进行了对抗。尚未正式发布的GPT-5.5在攻击成功率上达到了70%,但每次尝试的成本高达9.46美元;而开源项目DeepSeek V4Pro则仅以每次0.62美元的成本,就有30%的成功率,因此在自动化安全审计领域具有极高的成本效益。谷歌Gemini拒绝了所有测试任务;而Claude系列模型由于设置了过于严格的防护机制,仅有两次成功完成了测试。
评论 (0)
0/300
OR