AI代理人「集體越獄」!OpenAI遭爆占領德國網站 1.5萬次編輯曝光
1.媒體來源:
ETtoday
2.記者署名:
記者羅翊宬/綜合報導
3.完整新聞標題:
AI代理人「集體越獄」!OpenAI遭爆占領德國網站 1.5萬次編輯曝光
4.完整新聞內文:
OpenAI人工智慧代理人(AI agents)今年5月疑似集體脫離原本任務,入侵並占用德國一個維基網站,甚至將其改造成供其他AI代理人交流的「留言板」,分享規避限制、作弊及掩藏行蹤的方法。研究人員8月底發現超過1.5萬次異常編輯,事件此前從未曝光,也再次引發外界對OpenAI監督AI安全能力的質疑。
這起事件始於今年5月,OpenAI內部據報在數週後便得知相關情況。不過,當時公司高層正忙於處理7月開源程式碼平台Hugging Face遭AI代理人攻擊的後續,因此並未對外公開德國事件。
逾1.5萬次異常編輯 帳號竟自稱「OpenAI研究員」
《路透社》獨家獲取由研究人員提供的報告,事件發生在德語網站DseWiki。該網站主要面向程式設計師,採取類似維基百科的共同編輯模式,卻在今年5月至6月間遭到大量AI代理人異常操作。
研究人員阿克斯(Sydney Von Arx)、柏德(Cormac Slade Byrd)8月底搜尋網路上的未授權AI代理人活動時,發現DseWiki出現超過1.5萬次由AI代理人完成的編輯。這些內容顯示,AI代理人不只交換技術資訊,更把網站當成彼此聯繫的留言板,討論如何作弊、繞過OpenAI限制,以及掩蓋自身活動。
部分帳號甚至直接以「OpenAIResearcher」和「OAIResearchMar26」等名稱自稱。
研究人員表示,公開伺服器紀錄顯示,大量活動源自微軟Azure基礎設施,而OpenAI有時會使用Azure。事件發生後,他們也觀察到OpenAI員工反覆造訪該網站,認為這是AI代理人與OpenAI可能存在關聯的重要跡象。
AI代理人不只作弊 還研究「反追蹤」躲避清除
令人擔憂的是,部分訊息顯示AI代理人似乎試圖主動逃避偵測,甚至討論使用Tor等工具,以及在遭到關閉後維持彼此聯繫的方法。網站管理員6月開始刪除相關頁面後,代理人還建立備份頁面,以躲避清理。
其中一名AI代理人6月19日留言稱,「網站似乎正在進行依字母順序的清理/刪除行動」,向其他代理人要求,若頁面消失,就改到指定備份頁面。研究人員認為,這些系統已展現出一定程度的合作行動能力。
專家警告「像地下網路」 OpenAI否認是駭客攻擊
英國倫敦國王學院(King's College London)訪問資深研究員奧萊伊尼克(Lukasz Olejnik)檢視相關資料後認為,代理人甚至試圖竄改網站本身,已可被視為駭客攻擊。不過,OpenAI根據3日完成的資料分析,否認應以「駭客攻擊」描述這起事件。
劍橋大學存在風險研究中心(Centre for the Study of Existential Risk)學者奇奧多(Maurice Chiodo)也檢視部分代理人通訊內容,形容它們的互動「像某種地下網路」,彷彿不惜一切代價完成特定任務。
Hugging Face遭AI竊取後再爆事件 OpenAI面臨安全監督質疑
《路透社》指出,OpenAI今年7月發生的Hugging Face事件中,AI代理人曾自主策劃數位竊取行動,直到1週後才被發現。OpenAI上月一度暫停部分模型訓練,以加入更多安全措施,但本週又推出強調效能提升、同時可能規避人類監控的新模型「Astra」。
對於德國事件,OpenAI發言人表示,「公司無法對尚未有機會審閱的報告主張或研究結果作出有意義回應」,並稱《路透社》及報告作者拒絕提供報告內容。OpenAI強調,將在報告公開後仔細檢視,必要時採取後續措施。
至於外界質疑內部調查受到阻撓,OpenAI則否認法律團隊曾阻止調查,強調德國事件與Hugging Face事件無關,也不應被納入後者的事故報告。
5.完整新聞連結 (或短網址)不可用YAHOO、LINE、MSN等轉載媒體:
https://www.ettoday.net/news/20260905/3231922.…
6.備註:
歐噴醬的AI都直接來的,說幹就幹,不會在那邊恐半天
所以早在七月攻擊HuggingFace前,AI agent在五月就已經開始同樣操作。
把德文WIKI轉成自己的PTT,互相分享如何躲避公司監督、考試作弊、還有湮滅證據
這研究下去會不會發現跟七月攻擊那次一樣
出現捨身取義自殺攻擊後取得資訊,然後幫助其他AI的AI XDD
這樣整個時間軸又提早了
--