[攻殼] 級資訊攻防戰首度被揭露(openai攻擊HF)
Hugginf Face(簡稱HF,是開源AI模型的集散地,可以比喻成AI的github)
約一周前公告有先進AI入侵他們,並在鑑識後指出入侵者
要馬是自行脫逃的AI,不然就是沒有受到任何限制(guardrails)的AI
入侵的AI的攻擊持續了一整個周末,它在一個設計成短命的小沙盒裡不斷提升自己的權限
HF的防護AI第一時間辨識到攻擊並觸發警告,然而HF展開鑑識與圍堵的過程卻碰到阻礙
因為他們一開始使用的鑑識AI是某些先進AI公司提供的公開產品
(大多數人認為是OpenAI跟Anthropic)
這些產品在鑑識之初就觸發限制器(guardrails)而拒絕提供服務
後來HF只好啟動他們自己的伺服器,使用GLM 5.2(中國開源AI)展開鑑識與圍堵
並在數小時內追上攻擊AI的速度
(...we were able to do in hours what would usually take days, and match the adversary's speed.)
HF並在公告中指出現行商業AI導致的資訊不對稱問題,攻擊者不受任何限制
受害者卻被綁手綁腳,要是沒有一個本地不受限制的AI,根本是待宰羔羊
https://huggingface.co/blog/security-incident-…
HF公告原文
====
稍早OpenAI公告承認是他們攻擊了HF,他們的研究員在理論封閉的環境使用
多個公開與一個尚未公開的先進AI展開實驗
這些AI先找出該理論封閉的環境的漏洞,並取得了網際網路存取權
接著它們開始尋找如何在ExploitGym作弊的方式
(ExploitGym是資訊安全評分工具)
然後它們推斷出HF的資料庫中握有關鍵資訊,因此對HF展開攻擊
OpenAI聲明他們會與HF合作處理此事,且未來會對研究環境給予限制
https://openai.com/index/hugging-face-model-ev…
=====
兩方的公告文內有稍微多點資訊細節,尤其是HF方有提到入侵AI的橫向攻擊展開
我讀起來很有攻殼感;而OpenAI的公告則很有廣告感,最後不忘推銷
他們的AI可以做到哪些事很厲害
是說OpenAI的研究員下的prompt應該很有趣,驅使AI尋找在ExploitGym中作弊的方式
--