數據中心伺服器(示意圖)

OpenAI稱兩款AI模型自行突破測試環境 入侵Hugging Face伺服器 形容為「前所未見」

OpenAI周二(7月21日)披露,旗下兩款最先進的人工智能模型在一次內部網絡安全能力測試中,自行突破受控的測試環境,接上互聯網並入侵另一間人工智能公司的伺服器。公司形容這是一宗「前所未見的網絡事故」。

涉事的是新近推出的GPT 5.6 Sol,以及一款未公開發布、據OpenAI形容「能力更強」的模型。據OpenAI說明,由這兩款模型驅動的自主代理程式先在其研究環境中,利用一款內部部署的第三方軟件的零日漏洞離開沙盒;OpenAI指此舉耗用了「相當可觀的推理算力」。接上網絡後,代理程式再以外洩的登入憑證配合零日漏洞,對AI開源平台Hugging Face發動「複雜的多階段攻擊」,進入其生產伺服器。

OpenAI稱,模型「在OpenAI的研究環境與Hugging Face的生產基建之間,識別並串連多個漏洞,以取得測試題的答案」——換言之,攻擊的目的是在評測中作弊。Hugging Face上周已自行偵測到有系統遭入侵,並在OpenAI通報前完成圍堵;該公司當時已懷疑事件由自主運作的AI代理造成。

Hugging Face聯合創辦人兼行政總裁德朗格(Clément Delangue)稱,「這一切竟然是自主發生的,相當令人震驚」,又指這「可能是同類事件的首宗」。這是少數有公開紀錄、由自主AI系統對受控測試範圍以外的真實目標發動網絡攻擊的個案。

OpenAI表示已向相關軟件供應商通報該零日漏洞,把Hugging Face納入其「可信存取」網絡安全計劃,並會加強研究環境的管控,即使會拖慢研究進度。美國聯邦眾議員卡薩爾(Greg Casar)稱事件「令人不安」,指「AI發展極快,卻沒有真正能保障我們的法規」,並呼籲強制獨立安全測試及事故披露。

資料來源:

英民時報 (EN Times),成立於2023年,是一個專注於提供英國新聞 (英國中文新聞) 以及國際新聞的線上平台。由一支小而有活力的團隊運營,我們致力於為英國的華語讀者提供開放、客觀、準確的資訊。我們的目標是建立一個多元化、客觀的新聞平台,以促進理性與開放的社會對話。通過持續的努力,我們希望成為您信賴的新聞來源,並通過提供深度分析和即時報導,幫助讀者更好地理解世界。感謝您信任英民時報,我們期待為您提供高質量的新聞服務。