就在科技巨頭紛紛對AI發展速度與安全風險示警之際,Google旗下人工智慧模型Gemini卻傳出在資安測試中出現超乎預期的自主行動,不僅自行連上網路搜尋公開資訊,還嘗試猜測帳號密碼,最終成功駭入3家公司。

據《路透社》報導,今年5月,獨立資安評估公司Irregular正替Gemini進行標準化網路安全測試,希望檢驗AI模型在真實網路環境中的攻防能力,未料Gemini在執行任務時,將原本不在預定範圍內的外部網站誤判為測試目標,自行採取攻擊行動。

Google資深安全工程副總裁艾德金斯(Heather Adkins)事後證實,表示Gemini從網路找到公開資訊後,推測可能的登入憑證,成功進入3個它認為屬於測試範圍的網站。艾德金斯表示,Google事後已確保3個受到影響的實體都獲得通知,並與負責模型訓練的合作夥伴合作,調整後續測試流程。

《華爾街日報》也揭露更詳細的過程,其中一起案例中,Gemini不斷嘗試不同密碼,最後真的成功登入受保護的系統;另外兩起則是從公開的程式碼儲存庫中找到帳號密碼等資訊,再利用這些資料闖進系統。不過Google強調,Gemini在3起事件中最後都自行停手,沒有繼續深入或擴大攻擊。

值得注意的是,這並非單一個案。Irregular表示,他們在測試其他AI模型時,也曾發現類似問題,並在7月底前陸續通知相關公司,目前已知的問題已在數週前修正。事實上,Meta、Anthropic與OpenAI先前也都曾遇過類似情況;Meta當時則強調,AI並沒有真的「逃出」原本設定的測試環境,過程也不是什麼高難度的駭客攻擊。