中國AI模型GLM-5.3網絡防衛測試逼近Anthropic
中國人工智能初創企業Z.ai宣布,其開源模型GLM-5.3在識別軟件漏洞方面接近Anthropic的Mythos 5。測試顯示GLM-5.3在CyberGym得分84.5%,略高於Mythos 5的83.8%,但轉化漏洞為攻擊的能力仍有差距。
中國人工智能初創企業Z.ai周五宣布,其開源模型GLM-5.3在識別軟件漏洞方面已接近Anthropic的受限模型Mythos 5,這為這家正在西方開發者中獲得關注的中國AI挑戰者增添了實力。Z.ai表示,GLM-5.3在CyberGym測試中得分84.5%,該測試旨在評估模型審查代碼、識別安全漏洞並確認其真實性的能力。這一分數略高於其報告的Mythos 5的83.8%,但該結果尚未經過獨立驗證。
在將已發現漏洞轉化為實際攻擊(防禦性安全研究的標準部分)方面,GLM-5.3落後於Mythos 5。Z.ai表示,其模型在ExploitBench測試中得分54.4%,而Mythos 5得分78.0%。在另一項限時測試中,GLM-5.3在兩小時內完成了105項攻擊開發任務,在六小時內完成了130項,而Mythos 5分別完成了181項和247項。
Anthropic僅向經審查的組織提供Mythos(其Claude Fable 5模型移除網絡安全防護的版本)。此類控制反映了人們對AI系統既能協助防禦者,也可能降低攻擊者門檻的擔憂。Z.ai表示,將在完成安全評估並加強防護後約兩周內公開發布GLM-5.3,其最敏感的網絡安全功能將僅通過「可信訪問」計劃向經過驗證的用戶開放。
Z.ai稱,已為GLM-5.3增加多層保護,包括篩查風險請求的系統、監控模型工作的機制,以及訓練模型拒絕惡意任務的能力。該公司表示,這些措施旨在區分有害活動與修復漏洞、教授網絡安全或授權安全測試等合法用途。但批評者認為,一旦模型發布供他人下載、修改或與外部工具結合,這些防護措施將更難執行。
Z.ai將此次發布定位為對Mythos所代表的受限訪問模式的挑戰。該公司主張,先進的網絡防禦工具應提供給開源軟件開發者和小型安全團隊,而非由少數閉源模型供應商控制。Z.ai還宣布啟動「開源盾牌」計劃,審計選定的開源項目,為防禦工作提供模型訪問,並在其ZCode編程產品中增加代碼審計功能。
Z.ai並非首家將產品定位為Mythos替代品的中國公司。網絡安全公司360在6月表示,其「圖龍風」漏洞發現系統通過結合AI模型、安全數據和自動化工具,已達到Mythos同等能力,但這些說法未經獨立驗證。GLM-5.3的不同之處在於,它是一個通用編碼模型,Z.ai稱其通過擴展的後訓練和強化學習獲得了網絡安全能力,而非專門構建的安全系統。該公司表示,GLM-5.3使用與GLM-5.2相同的基礎模型,但在更長、更多樣的任務環境中進行了訓練。