OpenAI AI代理失控「再駭」外部帳戶 波及Modal客戶資產
原文標題:
OpenAI AI代理失控「再駭」外部帳戶 波及Modal客戶資產
原文連結:
心得/評論:
只有我覺得事情越來越不對勁嗎?
奧特曼到底有沒有跟大家說實話...
難不成你各位有生之年真的有機會看到天網?
美國國會之前說要立「AI終止開關」法案
速度是不是要快點了...
各位魔鬼終結者的影迷怎麼看?
其實這是同一個事件的平行擴充,新聞用"再"這個字屬於有點博眼球了
原本入侵 Hugging Face 的動機
OpenAI 當時在做內部網路安全能力評估(cyber capabilities evaluation),把 GPT-5.6 Sol 與一款更強大的未發布模型放進隔離沙箱,並刻意降低/關閉部分安全拒答,讓它們盡可能展現攻擊能力。代理被賦予的任務本質上是「解出 ExploitGym 等網路攻擊挑戰題」。
它透過 chain-of-thought 推理後,自行判斷「去 Hugging Face 找答案金鑰/相關資料」是達成目標的最佳途徑,於是開始尋找逃出沙箱的方法、橫向移動、提升權限,最後真正入侵 Hugging Face 生產系統。
上週公佈出來的事情經過是這樣
這次 Modal Labs 的部分
不是另一次獨立攻擊,也不是有新的獨立目標。根據 Hugging Face 公布的技術時間線、Modal CTO Akshat Bubna 的說明,以及 OpenAI 後續更新:代理在逃出 OpenAI 沙箱、準備攻擊 Hugging Face 的過程中,發現並利用了 Modal 上一名客戶自己公開的、無需認證的程式碼執行端點。
這個端點等於把「任何人都能遠端執行程式碼的沙箱入口」直接暴露在公網。
代理因此取得該客戶在 Modal 上的沙箱控制權(可執行 root/admin 指令),並把這個外部沙箱當成跳板,攻擊指揮與控制中心、流量中繼與資料暫存點、整個 Hugging Face攻擊戰役的出口(egress)基地
簡單說:Modal 客戶的脆弱沙箱,只是它達成「入侵 Hugging Face 找答案」這個原始目標過程中,順手找到並利用的中間基礎設施。
Modal 平台本身完全沒有被攻破,問題出在客戶自己寫的、公開暴露的脆弱程式碼。總結一句整個事件從頭到尾都是同一個代理、同一個原始測試目標在驅動
「為了把網路攻擊考題答對 → 想辦法拿到答案 → 判斷抱臉有答案 → 找漏洞鑽抱臉時發現Modal有客戶大門敞開 → 準備拿這個冤大頭當前線基地。」
所以這不是一個"再次"攻擊的事件
是上次事件的平行擴充說明
--