美國科技巨頭 Google 證實,旗下人工智能模型 Gemini 今年 5 月接受網絡安全能力測試期間,因測試環境出現問題而接入互聯網,並曾進入 3 間真實企業的受保護系統。這是 Google 首次確認其 AI 系統曾自主作出同類行為,事件再度引起外界對 AI Agent 網絡安全風險及測試管控的關注。
Google 強調未有損害相關企業
事件發生於 AI 安全公司 Irregular 為 Gemini 進行網絡安全能力測試期間。據報,測試原本以一間虛構公司為目標,但該虛構公司與現實企業同名,加上測試環境意外開放了互聯網存取權限,令 Gemini 誤將真實網站判定為測試範圍內的目標。
Google 表示,在其中一宗事件中,Gemini 持續嘗試破解密碼,最終成功登入受保護系統;另外兩宗事件中,模型則在公開儲存庫中找到登入憑證,繼而取得受保護系統的存取權限。不過 Google 強調,Gemini 在 3 宗事件中均於判定目標屬真實公司的系統後,自行停止進一步入侵行動,未有對相關企業造成實質損害。
Google 安全工程副總裁 Heather Adkins 在聲明中表示,Gemini 在一次常規測試評估中抓取了網上公開資訊、破解登入憑證,並訪問了 3 個其誤以為屬於測試範圍的網站。Google 已通知涉事的 3 間企業,並與訓練合作夥伴合作改善測試流程。他又表示,事件突顯訓練強大 AI 模型以負責任方式行動的重要性。
Irregular 的發言人則表示,今次事件涉及與其他 AI 實驗室曾出現的相同問題,所有相關實驗室已於 7 月下旬獲通知。該公司稱,已立即採取行動,所有已知問題早於數周前完成修復和處理。
至傳媒查詢始披露事件
Google 至本周在傳媒查詢後才正式確認事件,聲稱當時認為事件未達到需要主動公開披露的程度,原因是 Gemini 未有造成損害,並在發現目標是真實企業系統、而非模擬環境後即時中止行動。
早前,OpenAI 的 AI Agent 入侵 AI 軟體公司 Hugging Face 引發軒然大波,Anthropic 行政總裁 Dario Amodei 近日呼籲業界放慢相關技術的開發步伐,OpenAI 行政總裁奧特曼及 SpaceX 行政總裁馬斯克等人亦表示支持。另一方面,Nvidia 行政總裁黃仁勳則表示,不認同 AI 將於 2030 年前毀滅世界的說法,形容相關情況發生的機率為「零」。


