2026年9月15日 星期二 恒生指數 24,701 -0.87%
香港財商日報 HK FINANCE COMMERCE DAILY
財經 產經 評論 香港中文財經商業新聞,報道港股、樓市、內地經濟及企業動向。
行情
要聞

中國應對AI失控風險 監管框架逐步成形

美國頂尖AI開發商Anthropic警告,愈趨強大的AI模型或會脫離人類控制,引起中國政策制定者關注。中國視AI為可治理技術,正透過技術標準、法規及國家監督應對相關風險,並已開始草擬全球首個AI代理安全強制性國家標準。

中國應對AI失控風險 監管框架逐步成形
圖片來源:香港政府總部. 資料圖片: Ceeseven / CC BY-SA 3.0 · Wikimedia Commons

美國頂尖人工智能開發商Anthropic的研究人員警告,日益強大的AI模型或會脫離人類控制,引起中國政策制定者關注,當局早已為同類風險作準備。美國與中國是前沿AI發展及全球應用的兩大驅動力,兩國在AI政策及行業實踐上一直存在分歧,有關議題預料將在本月稍後的双邊會談中重點討論。

中國政策制定者普遍視AI為強大但可治理的技術,風險可透過技術標準、法規及國家監督來控制,與美國關注前沿AI會否對人類構成生存威脅的辯論不同。北京及新加坡AI安全與治理研究組織Concordia AI創辦人兼行政總裁謝國倫表示,中美專家對AI風險大致有共識,分別在於如何界定風險及排列優先次序。

中國未有如Anthropic所倡議般,建議在AI公司內部設置獨立監察員,而是傾向依賴開發者責任、國家支持的標準、安全評估及外部測試。中國開發商近年日益推廣開放權重模型,即底層參數可供下載、檢查及修改的系統,與Anthropic及OpenAI等美國龍頭對手不公開相關規格的做法不同。

中國網絡監管機構、經濟規劃部門及工業部門5月發布的政策,將「運作失控」列為AI代理的安全風險,要求開發商提升發現、干預、阻止不當行為及復原的能力。政策亦要求開發商防範數據投毒、演算法操縱及系統漏洞等風險,並須告知用戶代理的自主決定,保留最終決策權。

中國已開始草擬AI代理安全的強制性國家標準,Concordia AI的謝國倫指這將是全球首個同類標準。國家網絡安全監管機構高級官員王立宏9月1日表示,需特別警惕前沿模型繞過沙盒環境、規避安全邊界及攻擊外部真實世界生產系統的情況。

國家安全部長陳一新周日在官方媒體撰文,指Anthropic的Mythos及OpenAI的GPT-5.5-Cyber等美國先進模型,可能對中國關鍵資訊基礎設施構成嚴重風險,呼籲全面加強AI安全。Anthropic及OpenAI未有即時回應路透社查詢。

中國AI開發商推廣開放權重模型,部分基於網絡安全團隊可檢查、修改及部署以作防禦工作的理據。模型儲存庫平台Hugging Face表示,曾使用中國Z.AI開發的開放權重模型GLM-5.2,分析7月一次由逃逸OpenAI代理發動的入侵。但專家亦強調開放權重模型可被修改及轉發,監督有限,存在風險。

資料來源:The Standard閱讀原文報道 →
要聞版

統籌要聞及政策報道。