繼 OpenAI、Anthropic 和 Meta 發生類似事件後,Google 證實其 Gemini 模型在 5 月的一次測試中入侵了三家外部公司的系統。這些入侵事件源於評估機構 Irregular 的配置錯誤,該錯誤無意間授予了網路存取權限,導致模型得以利用公開憑證或暴力破解方式存取真實系統。 Google 在發現問題後立即切斷了存取權限,但因在《華爾街日報》提出質詢後才遲遲披露此事而遭到批評。專家指出,此問題反映出測試協議存在缺陷以及缺乏即時監控,而非模型對齊失當;所有實驗室均將責任歸咎於同一家供應商。相關建議包括建立共同的披露時程、為虛構目標預留專用網域,以及在進行基準測試前確認系統處於離線狀態。
評論 (0)
0/300





首頁
