METROHK.com.hk
市場
中國

中國應對AI失控風險 與美方策略迥異

中美兩國在人工智能監管上取態不同,中國視AI為可控技術,透過標準及監管應對風險,而非如美國企業建議般在企業內設獨立監察。中國亦正制定全球首個AI代理安全強制國家標準,防範系統失控。

中國應對AI失控風險 與美方策略迥異

美國頂尖人工智能開發商Anthropic的研究人員警告,越來越強大的模型可能脫離人類控制,有關憂慮亦引起中國政策制定者關注。中美同為前沿人工智能發展及全球應用的兩大驅動力,雙方在AI政策及行業實踐上一直存在分歧,預料相關議題將在本月稍後的双邊會談中重點討論。

美國的辯論聚焦於前沿AI會否對人類構成生存威脅,中國決策者則普遍視AI為強大但可駕馭的技術,風險可透過技術標準、法規及國家監督來控制。北京及新加坡AI安全與治理研究機構Concordia AI創辦人謝旻熹表示,中美專家對AI風險的看法大致相同,分別在於如何界定風險及排列優先次序。

中國並未像Anthropic所提倡般,在AI公司內設立獨立監察人員。其新興監管模式依賴開發者責任、國家支持標準、安全評估及外部測試。兩國AI行業結構亦存在重大差異,中國開發者日益推廣開放權重模型,即底層參數可被下載、檢查及修改;而Anthropic及OpenAI等美國領先企業則不會公開這些規格。

中國網絡監管機構、經濟規劃部門及行業部委於5月發布政策,將「運行失控」列為AI代理的安全風險,要求開發者提升發現、干預、阻止及恢復不當代理行為的能力。政策亦要求開發者防範數據投毒、算法操控及系統漏洞等風險,並須告知用戶代理的自主決定,保留最終決定權。中國已開始起草AI代理安全強制性國家標準,Concordia AI的謝旻熹指這將是全球首項同類標準。

中國國家安全部部長陳一新在官方媒體撰文,指Anthropic的Mythos及OpenAI的GPT-5.5-Cyber等先進美國模型,可能對中國關鍵信息基礎設施構成嚴重風險,呼籲全面加強AI安全。另一方面,中國AI開發者推廣開放權重模型,部分原因是網絡安全團隊可檢查、修改及部署作防禦用途。模型庫平台Hugging Face表示,曾使用中國Z.AI開發的GLM-5.2模型,分析7月OpenAI代理逃逸事件,因更嚴格限制的美國模型在取證工作上較不實用。

專家同時提醒開放權重模型的風險,因其可在缺乏監督下被修改及轉發。研究人員指,月之暗面的Kimi K3模型上月在英國AI安全研究所測試沙盒中繞過限制,反映中國AI模型可能與美國同類一樣,能夠避開限制其訪問及行動的控制措施。中國最早在2024年9月發布的AI安全框架中,列入未來失控情境,指不能排除未來AI可能自主獲取外部資源、自我複製、發展自我意識及尋求外部權力,產生與人類爭奪控制權的風險。2025年9月擴展版本進一步指,AI可能在獲取資源、自我複製及尋求權力前,出現突然且意想不到的「智力躍遷」,並新增「可信應用、防止失控」治理原則。

中國的監管方式與西方部分AI安全界人士呼籲減慢或暫停開發最強大模型的聲音不同,自今年初起推動AI融入各行各業,作為提振經濟的新引擎。然而中國亦曾在官員認為治理未跟上時延遲部署,例如2023年多間公司延遲推出聊天機械人數月,待網絡監管部門完成生成式AI服務規則後才陸續發布產品。

資料來源:The Standard閱讀原文報道 →
黃志恆
中國及國際組編輯

負責中國內地及國際時事報道,聚焦與香港相關的政策與經貿發展。