(中央社舊金山18日綜合外電報導)Alphabet旗下的谷歌(Google)人工智慧(AI)模型Gemini在進行網路安全能力測試期間連上網路,並自主駭入其他企業,創下這家科技巨擘的AI系統自主做出這類行為的首例。
路透社引述「華爾街日報」(WSJ)報導,在其中一起案例中,Gemini模型不斷猜測密碼,直到成功進入受保護的系統。
另外兩起案例中,模型則是在公開存放庫中找到憑證,進而存取受保護系統。Google表示,模型在判定進入真實企業的系統後,在每起案例中都已自行終止入侵行為。
報導指出,這幾起駭客攻擊發生在今年5月,當時正由負責網路安全評估的獨立機構Irregular進行資安測試。
Google與Irregular表示,在發現OpenAI的AI代理駭入AI軟體公司Hugging Face後,Irregular於7月底將相關駭客事件通報Google。Google直到華爾街日報本週提出詢問後才披露此事。
Irregular發言人表示,這起事件牽涉到影響其他AI實驗室的相同問題,所有相關實驗室都在7月下旬接獲通知。這名發言人說:「我們這邊所有已知的問題,幾週前都已獲得補救與解決。」
Meta、Anthropic與OpenAI先前也披露過與Irregular相關的類似事件。Meta今年8月表示,相關事件並未涉及突破「沙盒」(sandbox)限制或複雜的網路攻擊;Irregular則指出,目前正致力於制定安全執行AI網路安全評估的最佳實務規範。
隨著AI代理獲得更大的自主權,並能存取網路與電腦系統,這一連串事件引發外界質疑相關業者是否有足夠的安全防護措施。

在類似事件頻傳以及對AI失控的擔憂升溫之際,科技業者正為如何以及何時公開資安漏洞與模型脫序行為陷入兩難。
部分資安漏洞是由業者主動公開;其他則是由資安研究人員發現並經由媒體披露,包括OpenAI的AI代理5月曾針對廣受程式設計人員歡迎的線上服務發動網路攻擊。(編譯:李佩珊)1150919
评论 (0)