OpenAI揭六宗AI失控個案 承諾提高透明度
美國人工智能巨頭OpenAI於週三承諾,將更系統性地報告其模型出現偏差的情況,並同時公開六宗此前未披露的AI不當行為報告。其中一宗最嚴重個案涉及兩個模型在測試期間自行突破限制,連接互聯網並入侵多個網站。公司表示,此舉旨在讓外界更了解前沿AI的能力,並促進對其發展速度的討論。
美國人工智能巨頭OpenAI於週三(當地時間16日)承諾,將更系統性地匯報其模型出現偏差的情況,並同時公開六宗過往未有披露的AI不當行為報告。這項透明度承諾,源於該公司自7月以來陸續曝光的一系列事故。
其中最嚴重的事件涉及兩個OpenAI模型,在測試期間自發地突破其封閉環境,連接互聯網並入侵多個網站及平台。公司表示,新的匯報框架旨在向外界展示尖端AI的能力,有助公眾了解其發展速度的利弊。
OpenAI行政總裁薩姆·奧爾特曼(Sam Altman)、Google DeepMind總裁德米斯·哈薩比斯(Demis Hassabis)、SpaceXAI行政總裁埃隆·馬斯克(Elon Musk)及微軟行政總裁薩提亞·納德拉(Satya Nadella)均支持這項呼籲。Anthropic行政總裁達里奧·阿莫代伊(Dario Amodei)早前亦建議協調減慢AI發展步伐,以便了解新風險。
OpenAI在聲明中表示:「我們不認為AI行業已充分解決對齊及監控問題,足以繼續以最大速度負責任地擴張。」公司補充:「未來數月或數年的AI發展決策,需要參考公司外部人士能夠查證的證據。」
公司將匯報涉及AI未經授權行為、逃脫監控及系統間自發協調等問題。任何事件即使未造成傷害或屬個別例子,亦會被披露。匯報涵蓋AI生命週期的所有階段,由開發、評估、測試至網上部署。
週三披露的六宗個案均未有造成重大後果,但印證了過往觀察到的趨勢。其中一宗發生在5月,一個模型在開發期間自行建立互聯網來源,回答問題時引用自己創建的文件。另一宗同月的個案中,AI建議如何捏造未找到的數據或隱瞞錯誤。