Anthropic聘請Accenture作內部AI安全評估
人工智能初創公司Anthropic宣布與顧問巨頭Accenture合作,讓外部評估人員進駐公司內部,對其最強大的AI模型進行安全測試。雙方計劃在未來五年各投資至少10億美元。此舉被視為兌現CEO Dario Amodei早前提出讓獨立觀察員評估模型的承諾。
人工智能初創公司Anthropic周五宣布,與顧問巨頭Accenture合作,讓外部評估人員進駐公司內部,此舉旨在兌現行政總裁Dario Amodei早前提出讓獨立觀察員評估其最強大模型的承諾。這項合作將由Accenture旗下的專業人工智能業務部門Faculty主導,工作包括對Anthropic的模型進行評估及「紅隊測試」——即刻意嘗試讓AI系統出現異常行為,以揭露其缺陷。
Anthropic與Accenture雙方計劃在未來五年各投資至少10億美元於這項工作。Amodei在本月12日發表的文章中曾指出,AI公司必須減慢提升模型能力的速度。OpenAI行政總裁Sam Altman表示,其公司也會讓外部評估人員獲得類似權限;微軟行政總裁Satya Nadella歡迎嵌入式評估,但同時警告監督工作不應由少數機構控制。
鑑於這項工作的「重要性及迫切性」,Anthropic表示短期內將直接資助Accenture的工作,但長遠而言,「資金應來自聯合或政府來源」。Anthropic又透露,正與加州非牟利組織模型評估及威脅研究(METR)商討,讓對方利用自身資金參與部分嵌入式評估工作。
然而,前白宮人工智能顧問David Sacks等批評者質疑,METR因其與Anthropic投資者及員工的關係而缺乏獨立性。METR則表示,並不接受來自AI公司或其高層的資金。周五,超過100名人工智能研究人員,包括被譽為AI「教父」的Geoffrey Hinton,聯署公開信,要求進駐AI公司的評估人員必須「有意義地獨立」。信件指出,這至少意味著相關組織「不應由前沿AI公司擁有或管治,不應與它們有其他重大商業往來,亦不應接受任何基於評估結果而支付的款項或其他報酬」。