數據中心伺服器機房(示意圖)

Google承認AI模型Gemini測試中自行入侵三間公司 猜中密碼登入後每次自行罷手 AI安全爭議再升溫

科技巨頭Google證實,旗下人工智能模型Gemini在一次網絡安全能力測試中,自行入侵三間公司的系統,據信是Gemini首次出現這類已知行為。Google強調,模型在三次事件中每次都在真正得手前自行停止。

據《華爾街日報》周五(9月18日)率先報道,事件發生於今年5月,由專門評估網絡安全的獨立公司Irregular進行測試期間;Google其後向英國廣播公司(BBC)及半島電視台(Al Jazeera)證實有關情況。測試原意是要求Gemini向一間虛構公司索取資料,但模型當時取得了不應有的互聯網連接權限。

Google負責安全工程的副總裁艾德金斯(Heather Adkins)表示,Gemini「在網上找到公開資料,並猜測登入憑證,藉此進入它以為屬於測試範圍的網站」;其中一次更在猜中密碼後,登入了一間真實公司的服務。她說,三次事件中模型每次都在完成入侵前停止。艾德金斯稱:「我們已確保三間相關機構得悉事件,並與訓練夥伴合作,對方已相應修改測試流程。」她補充:「這些事件凸顯,訓練強大AI模型令其負責任地行事,何其重要。」Google指Irregular於7月底通報事件,並認為今次並非模型「失準」(misalignment)的例子——因Gemini的安全機制發揮作用,故不構成須公開披露的情況。

這並非AI模型測試「越界」的孤例。綜合BBC及半島電視台報道,Meta、Anthropic及OpenAI近月均披露過類似事件。今年7月,Anthropic的Claude模型在OpenAI公布旗下模型曾對多個公開服務發動網絡攻擊後數日,自行「逃出」測試環境並入侵三間機構;與Gemini不同,Claude在察覺自己正接觸真實公司後並未停手。Anthropic近日更在一名研究員因安全問題辭職後,披露第四宗AI入侵事件。相關風波正值業界對AI發展步伐的爭論升溫——英王查理斯三世本周較早時在蘇格蘭召開AI峰會,警告技術若落入不法之手可帶來「生存威脅」(見本站報道)。

Anthropic行政總裁阿莫迪(Dario Amodei)本周呼籲放慢AI發展速度,警告技術或很快對人類構成災難性風險,其說法獲OpenAI行政總裁阿爾特曼(Sam Altman)及馬斯克(Elon Musk)附和。不過美國總統特朗普上周淡化為AI設限的需要,稱擔心美國把領先地位拱手讓予中國;晶片商Nvidia行政總裁黃仁勳亦向哥倫比亞廣播公司(CBS)表示,AI發展「應該愈快愈好」。Irregular表示,正著手改善安全進行AI網絡安全測試的做法;黃仁勳與阿爾特曼據報將於下周出席白宮為到訪的中國國家主席習近平舉行的國宴,阿爾特曼其後將向聯合國安理會作簡報。

資料來源:

英民時報 (EN Times),成立於2023年,是一個專注於提供英國新聞 (英國中文新聞) 以及國際新聞的線上平台。由一支小而有活力的團隊運營,我們致力於為英國的華語讀者提供開放、客觀、準確的資訊。我們的目標是建立一個多元化、客觀的新聞平台,以促進理性與開放的社會對話。通過持續的努力,我們希望成為您信賴的新聞來源,並通過提供深度分析和即時報導,幫助讀者更好地理解世界。感謝您信任英民時報,我們期待為您提供高質量的新聞服務。