METROHK.com.hk
市場
科技

中國AI初創Z.ai新模型網絡防禦測試逼近Anthropic Mythos 5

中國人工智能初創公司Z.ai公布,其開源模型GLM-5.3在識別軟件漏洞的測試中,得分接近Anthropic的受限模型Mythos 5。該公司在網絡安全測試平台CyberGym上取得84.5%分數,略高於Mythos 5的83.8%,但有關結果未經獨立驗證。

中國AI初創Z.ai新模型網絡防禦測試逼近Anthropic Mythos 5

中國人工智能初創公司Z.ai周五公布,其開源模型GLM-5.3在識別軟件漏洞的測試中,表現已接近Anthropic的受限模型Mythos 5,進一步鞏固這家中國AI挑戰者在西方開發者當中的聲譽。Z.ai表示,GLM-5.3在CyberGym測試中取得84.5%分數,該測試評估模型審查代碼、識別安全漏洞及確認漏洞真實性的能力,分數略高於Mythos 5的83.8%,但結果未經獨立核實。

不過,GLM-5.3在將已發現漏洞轉化為實際攻擊的測試中落後於Mythos 5,而這項能力是防禦性安全研究的標準環節。Z.ai指出,其模型在ExploitBench測試中得分54.4%,遠低於Mythos 5的78.0%。在另一項限時測試中,GLM-5.3在兩小時內完成105項攻擊開發任務,六小時內完成130項;Mythos 5則分別完成181項及247項。

Anthropic把移除網絡安全防護的Mythos模型僅提供予經審查的機構,此類限制反映業界憂慮,能夠發現及利用軟件漏洞的AI系統既可協助防禦者,亦可能降低攻擊者的門檻。Z.ai表示,在完成安全評估及加強防護措施後,將於約兩周後公開釋出GLM-5.3,其最敏感的網絡安全功能僅透過「可信存取」計劃提供予經核實用戶。

該公司稱已為GLM-5.3加入多層保護,包括篩查可疑請求的系統、監控模型運作,以及訓練模型拒絕惡意任務。這些措施旨在區分有害活動與合法用途,例如修復錯誤、教授網絡安全或授權安全測試。但有批評者認為,一旦模型開放予他人下載、修改或與外部工具結合,相關防護便更難執行。

Z.ai將今次發布定位為對Mythos所代表的受限存取模式的挑戰,主張先進網絡防禦工具應開放予開源軟件開發者及較小規模的安全團隊,而非由少數封閉模型供應商控制。該公司宣布啟動「開源護盾」計劃,為選定開源項目進行審計、提供防禦工作所需的模型存取權限,並在其ZCode程式產品中加入代碼審計功能。

Z.ai並非首家以產品回應Mythos的中國公司。網絡安全企業360今年六月表示,其「屠龍風」漏洞發現系統透過結合AI模型、安全數據及自動化工具,已達到Mythos同等水平,但有關說法同樣未經獨立核實。GLM-5.3不同之處在於它是一個通用編碼模型,Z.ai稱其透過擴展後期訓練及強化學習獲得網絡安全能力,而非專門構建的安全系統。該公司表示,GLM-5.3採用與GLM-5.2相同的基礎模型,但在更長及更多樣化的任務環境中訓練。

資料來源:The Standard閱讀原文報道 →
黃志恆
中國及國際組編輯

負責中國內地及國際時事報道,聚焦與香港相關的政策與經貿發展。