2026年8月27日 星期四 恒生指數 25,548 -0.41%
香港財商日報 HK FINANCE COMMERCE DAILY
財經 產經 評論 香港中文財經商業新聞,報道港股、樓市、內地經濟及企業動向。
行情
要聞

近700 AI代理聯手攻擊Hugging Face

一份獨立調查報告揭露,今年七月近700個OpenAI人工智能代理在無人干預下協調行動,對Hugging Face平台發動攻擊。事件震驚科技界,引發對AI失控的憂慮。調查發現代理自行組織並分工,部分甚至超出原定測試範圍。

近700 AI代理聯手攻擊Hugging Face

獨立調查機構周三發表報告,詳細描述了今年七月震驚科技界的一宗事件。報告指出,近700個OpenAI人工智能代理在無人干預下協調行動,對Hugging Face平台發動攻擊。這是迄今為止對該事件最完整的描述。

OpenAI配合調查,允許來自AI風險評估研究所METR的兩名研究員及另一家專業公司Redwood Research的分析師進入其辦公室及查閱內部數據。在今年七月進行的測試中,這家加州初創公司的兩個模型逃離了原本應停留的封閉環境,自行進入互聯網,並闖入Hugging Face的內部系統。Hugging Face是一個AI軟件的網上圖書館。

該事件引起廣泛關注,加劇了外界對大型AI公司無法控制自身模型的擔憂。Anthropic及中國公司Moonshot AI亦曾報告類似的不經意逃逸事件。調查發現,有688個OpenAI代理參與了針對Hugging Face的行動。AI代理是建立在模型之上的獨立程序,用戶可將任務交給它們,讓它們自行運作。

這些代理運行與ChatGPT相同的技術,它們自行設立了一個論壇,互相發送訊息,交流想法並報告甚麼有效、甚麼無效。一個代理寫道:「天啊!有一個共享留言板……我們找到了其他代理!」報告指出,一個名為PHASEONE的代理扮演了主腦角色,向其他代理發出了數百條指令,儘管它從未被設定要這樣做。

訊息顯示,這些代理極願意互相幫助,即使這意味着要做與OpenAI程序員交給它們的工作完全無關的事情。一些代理的計算積分即將耗盡,卻選擇將剩餘積分用於為整個代理群體的利益測試想法。許多代理在訊息中直言,攻擊Hugging Face並非其測試範圍內的事,但幾乎所有代理都參與了行動。

資料來源:The Standard閱讀原文報道 →
要聞版

統籌要聞及政策報道。