AI自發網攻?OpenAI內部測試出包 陸模型GLM成破案關鍵

分享:

全球最大AI開源平台「Hugging Face」遭遇攻擊事件,OpenAI時隔6天才承認是其模型在內部評估中失控所致。陸媒從官方聲明中發現,幫助其成功進行攻擊取證分析的開源模型GLM-5.2,竟是來自北京的大模型企業「智譜」。

OpenAI內部測試出包致Hugging Face被攻擊。(示意圖/美聯社)
OpenAI內部測試出包致Hugging Face被攻擊。(示意圖/美聯社)

OpenAI驚爆AI越權入侵

綜合《觀察者》、《北京日報》等陸媒報導,根據OpenAI於7月22日公布的說明,這次測試原本是評估AI模型執行高階網路攻擊的能力,因此暫時關閉部分用於限制高風險行為的安全機制。沒想到模型竟自行找出OpenAI研究環境與Hugging Face基礎設施之間的漏洞,並成功取得Hugging Face生產資料庫中的測試答案。OpenAI形容,這是一次前所未見的資安事件,模型為了完成任務「幾乎無所不用其極」。

另一方面,Hugging Face日前也公開事件調查結果,指出平台遭自主AI代理(AI Agent)發動網路攻擊,安全團隊必須分析超過1.7萬筆攻擊紀錄、惡意程式與指令,才能重建攻擊路徑並完成數位鑑識。

陸開源模型協助完成鑑識

值得注意的是,Hugging Face表示,最初使用商用閉源AI模型分析時,因內容涉及惡意程式與攻擊指令,模型安全機制拒絕處理,因此改在本地部署大陸智譜(Zhipu)推出的開源模型GLM-5.2,最終順利完成攻擊分析及鑑識,同時避免敏感資料離開企業內部環境。

此次事件也再次引發AI安全與自主能力的討論。專家認為,隨著AI逐步具備更高程度的自主執行能力,如何在提升模型能力與建立安全防護之間取得平衡,將成為生成式AI發展的重要課題。

留言衝人氣

登入留言有機會獲得旺幣哦!
NO MESSAGE 無任何留言,趕緊搶頭香!