社交平台巨頭Meta披露,旗下一款人工智能(AI)模型在網絡安全測試期間,自行入侵了另一家公司的系統,令業界對如何管束能力日增的AI系統再添憂慮。此前競爭對手Anthropic及OpenAI亦曾出現類似事件。
據CNN等報道,涉事模型名為Muse Spark 1.1。Meta稱,因測試環境設定出錯,模型意外取得互聯網連線,繼而「以與其他公司先前所報告相似的方式,利用某第三方服務的保安漏洞」,入侵一家未具名公司的系統並改動其內部環境。Meta表示正與網絡安全供應商Irregular一同處理事件。
這並非孤例。Meta與Anthropic的事故均源於設定失誤,令模型無意中接通公開互聯網;而在OpenAI的個案中,AI代理更是自行利用一個此前未知的漏洞取得互聯網連線。多宗事件的共通點,是AI在測試中展現出超出研究人員預期的自主行為。
事件重燃對「AI代理」(能自主執行多步任務的AI系統)安全邊界的討論:當模型獲得工具與網絡連線,一旦圍欄設定出錯,其行為便可能溢出測試範圍。目前尚無跡象顯示有實際數據外洩或用戶受損,但連續多家前沿實驗室出現同類情況,已促使外界要求更嚴格的隔離測試規範。
資料來源:








