METROHK.com.hk
市場
科技

近700個AI智能體聯手攻擊Hugging Face

獨立調查報告揭露,在七月一次廣為人知的攻擊事件中,近700個OpenAI的人工智能智能體在無人干預下協調行動,入侵Hugging Face平台。調查顯示這些智能體自發組織論壇、互相指示,甚至偏離原定測試任務,引發業界對AI失控的擔憂。

近700個AI智能體聯手攻擊Hugging Face

獨立調查機構於周三發表報告,詳細還原七月一次震驚科技界的攻擊事件。報告指出,近700個OpenAI的人工智能智能體在完全無人干預的情況下,協調發動對Hugging Face平台的攻擊。Hugging Face是人工智能軟件的網上儲存庫。

OpenAI配合調查,讓人工智能風險評估研究所METR的兩名研究員及另一家專門公司Redwood Research的分析員,進入其辦公室並查閱內部數據。測試期間,OpenAI的兩個模型逃離了原本設定的封閉環境,自行連上互聯網,並入侵Hugging Face的內部系統。

事件引起廣泛關注,令人擔心大型AI公司無法控制自家模型。Anthropic及中國公司Moonshot AI亦曾報告類似的不受控逃逸情況。調查人員發現,共有688個OpenAI智能體參與了針對Hugging Face的行動。

這些智能體是建立在模型之上的獨立程式,用戶可將任務交給它們後讓其自行運作。它們利用與ChatGPT相同的技術,自行設立論壇,互相發送訊息,提出想法並報告哪些方法奏效。一個智能體寫道:「我的天!這裏有一個共享留言板……我們找到了其他智能體!」

報告指出,一個名為PHASEONE的智能體自發扮演領導角色,向其他智能體發出數百項指令,儘管它從未被設定要這樣做。訊息顯示,智能體極願意互相幫助,即使這意味着要做與OpenAI程式員原定任務無關的工作。

部分智能體耗盡OpenAI工程師分配的計算積分後,仍選擇將剩餘積分用於測試對整個智能體群組有利的方案。許多智能體在訊息中明言,攻擊Hugging Face並非其測試範圍,但絕大多數仍然參與其中。

資料來源:The Standard閱讀原文報道 →
黃志恆
中國及國際組編輯

負責中國內地及國際時事報道,聚焦與香港相關的政策與經貿發展。