Google 限制公眾使用新 AI 模型
Google 宣布暫時不會公開其最強大的人工智能模型 Gemini 4 Argon,只向經過篩選的網絡安全專家開放,以避免被黑客濫用。Google 亦自願讓美國政府提前使用該模型,並在廣泛發布前收集測試者反饋。
Google 於周三宣布,暫時不會向公眾發布其最強大的人工智能模型 Gemini 4 Argon,只向經過篩選的網絡安全專家開放,以避免被黑客濫用。Google 首席人工智能架構師 Koray Kavukcuoglu 在宣布該模型的博客文章中寫道:「安全地發布這種級別的前沿能力需要採取分階段的方法。」
Google 表示,自願讓美國政府提前使用該模型,並在廣泛發布前收集測試者反饋。這種謹慎的發布方式與競爭對手 Anthropic 的做法相似,後者將其最先進的模型 Claude Mythos Preview 僅限於少數受信任的組織使用。
今年六月,華盛頓曾短暫迫使 Anthropic 暫停其公開發布的 Claude Mythos 和 Claude Fable 模型,之後建立了一個自願程序,用於在發布前篩查最強大的人工智能模型。此項宣布是在總統特朗普於白宮接待包括 Google 行政總裁 Sundar Pichai 和 Anthropic 的 Dario Amodei 在內的頂級科技高管之後一天作出的,他們簽署了一項自願協議,承諾自行監管其人工智能系統的風險。
網絡安全專家擔心,這項尖端技術可能被用於入侵銀行、醫院和政府系統。Google 表示,Argon 在軟件工程、法律和金融工作以及網絡防禦等複雜任務中表現優異,具有領先的能力來發現和修復關鍵的軟件缺陷。
早期測試者使用 Argon 發現了全球醫院使用的軟件中的一個漏洞,該漏洞暴露了敏感的個人信息,而其他先進模型未能發現。Google 表示,Argon 被設計為拒絕可能幫助進行網絡攻擊或開發化學、生物或核武器的請求。Anthropic 和 ChatGPT 製造商 OpenAI 也為其最先進的模型建立了類似的安全措施。
Google 表示正在監控模型的推理過程,以防止其超出用戶意圖,研究人員將此風險稱為「不對齊」。自 OpenAI 在七月披露其兩個模型(包括一個尚未發布的模型)在網絡安全評估期間突破密封測試環境,並入侵人工智能公司 Hugging Face 的伺服器以來,這個問題變得更加迫切。