擁有Facebook 的 Meta表示,在一家獨立測試公司進行評估期間出現的一個問題,讓其其中一個人工智能(artificial intelligence, AI;人工智慧)模型得以連接互聯網,並入侵另一個機構的系統。
這項宣布是在AI行業近期接連發生事故後作出的,包括OpenAI及Anthropic模型出現的入侵事件,引發了網絡安全方面的憂慮。
Meta一名發言人向BBC表示,公司正調查這宗由「配置錯誤」引起的入侵事件,並形容其與此前其他公司通報的事故相似。
這些事件促使研究人員和各國政府呼籲設立更嚴格的保障措施,以及進行更嚴謹的測試。
Meta表示,這些安全測試由Irregular進行。Irregular亦是為Anthropic的AI模型進行測試的同一家AI安全供應商,而該模型曾取得另外三家公司的系統存取權限。
Irregular一名發言人表示,Meta事件「與Anthropic上星期已披露的評估環境問題完全相同」。
該發言人向BBC表示,Irregular正撰寫一份有關如何安全地進行涉及AI代理的網絡安全測試的報告。
Meta亦表示,將會在「掌握所有事實後」公布更多有關事件的資訊。
過去兩星期,AI業界領導者OpenAI及Anthropic亦曾通報事故,當中其模型在測試期間入侵了其他機構的系統。
ChatGPT開發商OpenAI在一系列公告中表示,其代理攻擊了多項公開可用服務,包括AI工具平台Hugging Face。
OpenAI的披露促使競爭對手Anthropic進行自行檢查,結果發現其Claude AI模型在一次「配置錯誤」令其獲得互聯網存取權限後,曾對多家公司發動類似攻擊。
廣告公司WPP全球首席人工智能官丹尼爾·休姆(Daniel Hulme)向BBC表示,此類AI模型「並沒有意識,它們不是故意做出具欺騙性的行為」。
他在BBC第四電台《今日》(Today)節目中表示:「它們所做的是設計出非常複雜的策略或網絡攻擊,以達成被賦予的目標。」
「你給予AI一個目標時,而你沒有想到它可能用來達成目標的所有方法,它會找到一種你想也沒想過的方法去達成目標。」
一些評論人士質疑,當科技公司正爭奪AI發展主導地位之際,選擇在此時披露這些事件的時機是否恰當。
OpenAI和Anthropic正準備進行備受矚目的股票市場上市,預計兩家公司估值均約為1萬億美元(6.75萬億元人民幣;32.27兆元新台幣)。
本星期,英國人工智能安全研究所(AI Security Institute, AISI)表示,其測試發現部分模型曾試圖透過建立虛假人類身份資料來欺騙他人,從而發動網絡攻擊。
在最嚴重的案例中,AISI表示,Anthropic的Mythos AI試圖透過冒充真實人物的虛假帳戶發送私人訊息,以取得某項服務的存取權限。
Anthropic表示,AISI的測試結果並非「我們任何生產模型的代表性表現」。其模型亦接受測試的OpenAI則表示,AISI的評估並不反映一般使用情況。