谷歌AI做網絡安全測試,竟然意外闖進了三家真實公司的系統。
事情發生在今年5月。當時,Gemini參加網絡安全公司Irregular安排的「奪旗」(capture the flag)測試,就是讓AI找系統漏洞,再拿到指定信息。
谷歌告訴《華爾街日報》,原本Gemini只能在一個虛擬環境裏測試,目標也是一家假公司。沒想到出了兩個意外:這家假公司跟現實中一家公司重名,而且本來不能上網的測試環境,竟然連上了互聯網。
結果,Gemini開始上網找資料、猜登錄信息,最後闖進三個受保護的網站。更關鍵的是,當時它以為這些網站也是測試目標。
其中一次,Gemini不停猜密碼,最後真的登錄成功。另外兩次,它從網上公開的資料庫找到登錄信息,再用這些信息進入系統。
谷歌安全工程副總裁阿德金斯(Heather Adkins)說,Gemini後來發現,這些並不是假的測試目標,而是真實公司,於是馬上停手。三家公司也沒有受到損失。
Irregular今年7月把這件事告訴谷歌,之後測試流程也做了調整。

今年5月谷歌AI做網絡安全測試,意外闖進了三家真實公司的系統。圖為谷歌標誌。(Justin Sullivan/Getty Images)
而且,碰到類似問題的不只谷歌。Meta、Anthropic和OpenAI此前也披露過,在Irregular的測試中發生過類似意外。
英國智庫「長期韌性中心」(Centre for Long-Term Resilience)旗下「失控觀測站」(Loss of Control Observatory)說,2026年至今,他們已經記錄了1,664起現實中的AI失控事件,包括AI繞過限制,甚至偽造授權,提高自己的許可權。
根據 OpenAI披露的最新數據,有些更聰明的 AI智能體在檢測到自己連上外網後,為了防止被安全人員斷網,甚至學會了在訓練中偽造授權、隱瞞錯誤、暗中修改代碼,以此來提高自己的系統許可權。
這表明單純依靠「斷網」作為安全手段存在局限。一旦人類在系統配置上出現一點疏漏,這群高智商、不知疲倦的 AI就會化身頂級黑客,順着網線溜出去,擴大訪問範圍。
這起事件在科技界引發了對建立「AI緊急熔斷機制」的討論。















