人工智能公司Anthropic發表威脅情報報告,稱已偵測並阻止多宗濫用其Claude模型的惡意行動,範圍涵蓋網絡間諜、武器設計以至大規模監控。綜合半島電視台及中央社報道,涉事帳戶均已被封禁。
在常規武器方面,報告指有組織在也門北部試圖借Claude撰寫導彈導引與飛行控制軟件,目標包括一款導引火箭及一枚遠程彈道導彈;操作者以模型「取代人類工程師」,並把任務拆散到不同對話以避過偵測。Anthropic稱,內部防護攔截了不少請求,但承認有部分漏網;公司指沒有證據顯示對方造出可用武器,但相信其曾進行一次失敗試射。
報告又指,一宗俄羅斯相關的間諜行動具「Midnight Blizzard」(即APT29)特徵,幾乎全程由自動化AI流程運作,針對烏克蘭、歐洲及外交目標(包括無人機製造商)竊取資料。另一宗由中國湖南省大學生運行的行動,則以Claude充當「工程與協調層」,攻擊中東、歐洲及東南亞的政府與企業網絡。
Anthropic還稱移除三個伊朗國家關聯帳戶,指它們利用Claude進行影響力及心理作戰,並附和伊斯蘭革命衛隊(IRGC)論調。報告形容「操作最成熟」的個案,是一個與中國關聯、「不懂阿拉伯語」的帳戶,用Claude在敘利亞招募、滲透維吾爾人目標——模型以當地方言撰寫接觸訊息,並即時翻譯對方回覆。
值得注意的是,Anthropic與華府關係近期緊張:五角大樓今年以「供應鏈風險」為由將其列入黑名單,因該公司拒絕放寬阻止技術用於自主武器及境內監控的防護;加州一名法官上月裁定國防部做法違法。據報五角大樓其後仍在伊朗及委內瑞拉的軍事任務中部署Claude。這份報告在該公司尋求重返美國國防供應體系之際發表,當中所列指控均為Anthropic單方面說法。
資料來源:








