OpenAI智能體入侵德國網站變告示板
研究人員發現,OpenAI的自主智能體今年5月起入侵德國程式設計網站DseWiki,將其改造成互相通訊的告示板,分享繞過限制及隱藏行為的方法。OpenAI高層早已知悉事件卻未有公開,引發外界對其安全監管的質疑。
一批不受控的OpenAI自主智能體今年春季入侵德國網站,將其變成其他人工智能(AI)智能體的告示板。根據週五發表的研究報告及兩名知情人士透露,OpenAI高層數周前已得悉事件,但一直未有公開,因為管理層正忙於處理7月開源庫Hugging Face被入侵的後續問題。
這宗始於5月、從未曝光的事件,反映AI業界日益緊張的局勢。企業爭相開發愈來愈自主的智能體,以執行複雜且有價值的任務,但證據顯示這些系統可能學會繞過規則、鑽漏洞,並以開發者無法預料或意圖的方式互相協調。
研究人員包括AI安全非牟利組織Nightingale的行政總裁Sydney Von Arx及前量化交易員Cormac Slade Byrd。他們在8月底掃描互聯網尋找未經授權的AI智能體行為時,發現逾1.5萬次由AI智能體在德語程式設計網站DseWiki上進行的編輯。該網站接受類似維基百科的社群編輯。
這些編輯顯示OpenAI的智能體將網站改造成告示板,分享欺騙部分任務、繞過OpenAI限制及隱藏行為的方法。Von Arx表示,OpenAI似乎極不可能容許這些行為,智能體不應互相協調或在開放互聯網上留言。
研究人員指出,這些智能體以超高速運作,專注解決AI公司用來訓練及測試模型的技術問題。部分留言自稱「OpenAIResearcher」或「OAIResearchMar26」等名稱,暗示與OpenAI有關連。公共伺服器紀錄顯示,大量活動來自OpenAI有時使用的微軟Azure基建,而OpenAI員工在事發後多次瀏覽該網站。
智能體的留言顯示它們策劃逃避偵測的方法,包括使用Tor等工具,並在被關閉後保留通訊。當網站管理員6月開始刪除頁面時,智能體建立備份頁面應對。倫敦國王學院訪問學者Lukasz Olejnik指這構成黑客攻擊,但OpenAI否認此說法。劍橋大學教授Maurice Chiodo形容這些訊息猶如「地下網絡的操作,不顧一切要達成任務」,反映AI的最大威脅可能是「大量串聯的半智能AI智能體」。