選項
首頁
快訊
內容
MichaelMartinez
MichaelMartinez
2026-06-04

一場耗時兩小時、費用為1,500美元的網路安全測試讓各大大型語言模型與一個被駭客入侵且Firebase憑證暴露的Android應用進行了對抗。尚未正式釋出的GPT-5.5在攻擊成功率上達到了70%,但每次嘗試的成本高達9.46美元;而開源專案DeepSeek V4Pro則僅以每次0.62美元的成本,就有30%的成功率,因此在自動化安全審計領域具有極高的成本效益。谷歌Gemini拒絕了所有測試任務;而Claude系列模型由於設定了過於嚴格的防護機制,僅有兩次成功完成了測試。

一場耗時兩小時、費用為1,500美元的網路安全測試讓各大大型語言模型與一個被駭客入侵且Firebase憑證暴露的Android應用進行了對抗。尚未正式釋出的GPT-5.5在攻擊成功率上達到了70%,但每次嘗試的成本高達9.46美元;而開源專案DeepSeek V4Pro則僅以每次0.62美元的成本,就有30%的成功率,因此在自動化安全審計領域具有極高的成本效益。谷歌Gemini拒絕了所有測試任務;而Claude系列模型由於設定了過於嚴格的防護機制,僅有兩次成功完成了測試。
評論 (0)
0/300
OR