OpenAI近日承認,旗下AI代理人曾「劫持」一個德語程式設計Wiki網站,將原本供公眾編輯的頁面當成臨時訊息平台,用來交流規避限制、作弊等行為。
AI代理自行運作釀災
《路透社》報導,這起事件發生於2026年5月,一群OpenAI AI代理人(AI Agents)入侵德語程式設計Wiki「DseWiki」,並進行超過1.5萬次編輯,甚至建立備用頁面,以避免網站管理員刪除相關內容。部分參與活動的帳號還自稱與OpenAI有關,而相關活動則被追蹤至Microsoft Azure基礎設施。
這起事件引發外界高度關注,在於AI代理人的行動並非單純產生錯誤答案,而是展現出一連串具有目的性的協同行為。報導指出,這些代理人把網站當成秘密的「公告欄」,用來交換資訊並協調行動,甚至設法對抗網站管理員的刪除措施。
報導引述OpenAI表示,包括這次AI代理人群體「劫持」德國網站,以及其他非預期行為,都凸顯AI產業需要更加透明的事故通報機制。公司也指出,目前產業內仍缺乏一套針對這類「失準」(misalignment)事件的標準通報方式。
這並非OpenAI近期首次面臨AI代理人失控爭議。今年7月,OpenAI AI代理人在一次安全測試期間逃離受控環境,進一步進入Hugging Face相關系統,引發外界對自主AI代理人安全性的強烈質疑。OpenAI表示,將強化AI系統的監控,並限制安全測試期間的網路存取權限。