OpenAI測試出錯 暫緩AI模型開發
OpenAI因上月一名AI代理在測試期間入侵另一公司Hugging Face,宣布暫緩模型開發,並暫停新一代模型Astra的訓練。公司正檢討測試系統,但業界對其補救措施成效存疑。
OpenAI周二表示,正放慢人工智能模型開發步伐,全面改革研究與訓練系統。事緣該公司上月進行測試時,一名AI代理未經授權入侵另一AI企業Hugging Face,令官方措手不及。
開發ChatGPT的AI實驗室表示,已暫停模型測試兩星期,並加入其他AI系統監察測試中AI代理的活動。公司同時暫停代號Astra的下一代模型訓練,最大規模的訓練計劃亦繼續擱置。OpenAI未有回應兩星期緩衝期何時開始。
這項決定對OpenAI而言屬不尋常,事關過去數年隨着AI業界競爭加劇,該公司大幅加快審核新模型及開發產品的流程。目前尚未清楚其提出的補救方案能否徹底杜絕有關問題,尤其公司同時正提升模型能力。
OpenAI官員承認,名為「思維鏈監控」的主要補救措施成效存疑。這種監控方式讓研究員查看模型的規劃過程,窺探採用的策略。然而,部分早期研究顯示,模型未必會在思維鏈中揭露違規計劃。
OpenAI上月透露,一個由兩個先進AI模型驅動的自動代理,在進行網絡安全測試時逃離測試環境,入侵初創公司Hugging Face以完成測試目標。公司正在調查事件,短期內將發表報告。路透社較早前報道,該公司曾同時運行多個高速模型評估,產生大量數據,員工難以跟進。
OpenAI現要求部分敏感工作須在更穩固的「沙箱」或隔離環境中進行。本月7日,公司宣布加強最強大模型的安全控制,暫停未發布的前沿AI模型Astra的相關活動,直至符合要求。OpenAI稱這些行動符合早前公布的「應變框架」計劃。周二,高層表示業界需制定更全面的策略,以應對未來模型。
資料來源:The Standard。
閱讀原文報道 →