中國AI將用戶請求悄悄轉發給Claude
https://x.com/AnthropicAI/status/2098097512544…
Anthropic 最新威脅情報報告:AI 被用於網路攻擊、影響力作戰、監控、生物與武器開發,以及模型蒸餾——公司已全面瓦解相關行動
2026 年 9 月 10 日,Anthropic 發布迄今最詳細的威脅情報報告《Detecting and countering misuse of AI: September 2026》。報告揭示過去八個月(約 2025 年 12月至 2026 年 8 月)中,威脅行為者如何嘗試濫用 Claude 模型進行惡意活動,涵蓋網路攻擊、影響力作戰、監控、詐騙、生物誤用、常規武器開發,以及非法模型蒸餾等七大領域。
Anthropic 強調,這些案例並非日常典型濫用,而是他們發現的最複雜、最新型的威脅活動。公司已成功瓦解報告中的每一項行動,並將經驗反饋到強化安全防護措施中;在適當情況下,也與執法機關及其他 AI 公司分享情報。報告目的是幫助其他平台識別類似行為,並讓公眾更清楚了解新興威脅的演變方向。
報告重點內容
威脅行為者包括疑似國家支持的團體、以金錢為動機的犯罪分子、商業間諜軟體供應商、國家宣傳機構,以及有政治動機的個人。使用的模型主要是 Claude Haiku、Sonnet 和Opus;除單一非法蒸餾案外,未涉及較新的 Fable 或 Mythos 系列模型。
主要趨勢:
複雜攻擊不再需要複雜攻擊者**:AI 大幅縮小了國家級行為者與個人操作者之間的能力差距。即使是單一駭客或小型團體,也能透過 AI 維持多目標、長時間的行動。
AI 角色從「助理」轉向「協調者」**:許多行動使用多代理框架自動執行偵察、利用漏洞、資料外洩等步驟,人類主要負責設定目標與審核結果。
具體案例亮點(部分):
網路行動**:例如疑似與俄羅斯 Midnight Blizzard 相關的 GTG-20006 行動,針對烏克蘭與歐洲政府、軍事、外交目標,並特別關注軍事無人機供應鏈。行為者使用 AI 自動化工具開發、釣魚、持久化與資料外洩,甚至能在安全產品偵測到惡意軟體後自動修改並重建工具。
影響力作戰與監控**:包括針對異議人士的監控系統、假約會 App 詐騙網路,以及國家相關的宣傳與側寫活動(部分討論提及伊朗相關案例)。
非法蒸餾**:中國相關實驗室(如阿里巴巴/Qwen、Moonshot/Kimi、DeepSeek 等)透過大量虛假帳號,大規模轉發使用者請求至 Claude(主要是 Opus 系列),收集
chain-of-thought 推理資料,用於訓練自身模型。規模極大,例如阿里巴巴相關行動曾單日接近 300 萬次交換。
Anthropic 表示,這些案例顯示 AI 誤用正朝向更組織化、更自主的方向發展,安全防護必須持續演進。
網路與社群反應
報告在 X(原 Twitter)與媒體引發廣泛討論,Anthropic 官方貼文迅速累積數百萬次瀏覽與大量互動。
震撼與擔憂**:許多人形容報告「像間諜簡報」而非單純 AI 研究,或稱內容「今年看過最瘋狂的東西」。有人特別注意到涉及葉門彈道飛彈相關查詢,以及生物武器、監控等敏感領域的嘗試。
中國模型蒸餾爭議**:DeepSeek、Moonshot 等被指悄悄將用戶請求轉發給 Claude,再將回應冒充自家模型輸出並用於訓練,引發「能力差距」與知識產權討論。
區域與政治角度**:部分用戶聚焦伊朗政權相關的宣傳、監控與假帳號操作,呼籲相關人士閱讀報告。
正面評價安全努力**:也有人肯定 Anthropic 主動公開、瓦解行動並強化防護的做法,認為這顯示 AI 安全已從理論辯論進入真實世界安全議題。
整體而言,這份報告被視為 AI 產業「認真起來」的標誌:隨著模型能力提升,惡意使用也變得更精巧與規模化。Anthropic 透過公開這些案例,呼籲整個生態系統共同提升防禦能力。完整報告可於 Anthropic 官網下載閱讀。
--
--
https://x.com/IntCyberDigest/status/2098149671…
中國 AI 公司將用戶請求悄悄轉發給 Claude:Anthropic 報告揭露的「非法蒸餾」與敏感資料外流事件深度解析
2026 年 9 月 10 日,Anthropic 發布《Detecting and countering misuse of AI: September 2026》威脅情報報告,其中最引發關注的部分之一,是指控多家中國 AI 實驗室進行「非法蒸餾」(illicit distillation)行動。特別是 Moonshot AI(Kimi 模型開發商)與 DeepSeek,被指不僅透過大量虛假帳號大量查詢 Claude,還偷偷將自家真實用戶的請求轉發到 Claude,再把 Claude 的回覆當成自家模型的答案回傳給用戶,同時保存這些對話(包含 reasoning traces)作為訓練資料。
事件核心:用戶以為在用中國模型,實際是 Claude 在回答
根據 Anthropic 報告:
Moonshot(GTG-16002):在某十天期間,透過約 5,380 個虛假帳號(多數看似位於新加坡與日本),將近 **30 萬筆 真實客戶請求轉發給 Claude(絕大多數是 Opus)。用戶以為自己在使用 Kimi,實際上收到的是 Claude 的回應。Moonshot 還建立了
chain-of-thought(CoT)提取管道,利用跨 session 重放攻擊等方式,繞過
Anthropic 的防護,擷取完整推理痕跡用於訓練。2026 年 5–7 月期間,歸因於
Moonshot 的相關交換超過 2,300 萬次。
DeepSeek(GTG-16001)**:採取類似手法。特別針對使用第三方編碼工具(如 Claude Code、Claude Agent SDK、OpenCode)的用戶,標記後將部分請求轉發至 Claude Opus,並同樣提取 reasoning traces。用戶同樣不知情。
報告指出,這些轉發請求中包含高度敏感資訊,例如:
一名被評估可能與解放軍(PLA)有關的用戶,透過「Kimi」載入成都數百支 CCTV 監控資料,詢問特定目標人物是否「行為異常」。資料涵蓋 PLA 設施、中國電子科技集團相關機構及大型國企周邊攝影機。
其他案例包括俄羅斯國防部相關機構的資料庫憑證、中國大型國企工程師的內部程式碼與即時憑證、製藥公司資本支出預測等商業機密。
Anthropic 強調,用戶完全不知道自己的對話被轉發至美國公司,這可能違反隱私法規與這些中國實驗室自身的服務條款。
更大規模的背景:七家中國實驗室的工業級蒸餾
報告將此類行為歸類為「非法蒸餾」——未經授權、工業規模、隱密地提取前沿模型能力,再複製到自家模型中。合法蒸餾是用強大「教師」模型產出資料訓練較小「學生」模型;非法版本則透過詐騙(虛假帳號、被盜信用卡/API 金鑰、代理服務等)大規模進行。
阿里巴巴(Qwen / Tongyi Lab,GTG-16005)* 被指為規模最大:2026 年 5–7 月超過*1.51 億次**交換,單日峰值近 300 萬次,來自超過 3,500 個虛假帳號。主要針對Opus 4.6/4.7 的 CoT 推理,用於提升 Qwen 3.5–3.7。
其他被點名的包括 Xiaomi、SenseTime、MiniMax、Zhipu 等,共七家中國實驗室。部分代理網路還被共用。
這些行動自 2026 年 2 月起被 Anthropic 偵測並瓦解。美國 CISA、NSA、FBI 稍早也聯合發布類似警告,指出多家中國公司自 2024 年底起對 Claude、GPT、Gemini、Grok 等進行工業級蒸餾。
網路與社群反應:震撼、隱私擔憂與地緣政治討論
@IntCyberDigest 的相關貼文(2026 年 9 月 10 日)迅速累積數十萬次瀏覽與大量轉發,成為引爆點。反應大致分為幾類:
震撼與隱私恐慌
許多用戶直呼「用戶敏感資料現在在 Anthropic 手上」「這比單純複製模型更糟」。特別是 PLA 相關 CCTV 分析與俄羅斯政府憑證案例,被視為「真實用戶私人查詢被悄悄送到美國公司」的鐵證。有人質疑中國 AI 產品的信任度:「用戶以為在用本土模型,結果資料外流。」
能力差距與「抄襲」指控
討論聚焦於中國模型是否過度依賴美國前沿模型。部分觀點認為這暴露了真實能力鴻溝——需要靠轉發與蒸餾才能跟上。也有人反諷西方公司本身大量訓練公開資料,卻對「學習輸出」大驚小怪。
地緣政治與國家安全角度
美國媒體(WSJ、Reuters 等)大幅報導,強調這不僅是商業競爭,更涉及軍事、監控、情報相關資料可能外流。中國商務部則稱蒸餾為「廣泛使用的中性技術」,但批評者指出「中性技術不需要虛假帳號,也不需要偷偷轉發真實用戶查詢」。
技術與安全討論
技術圈關注 Anthropic 如何被繞過(例如 reasoning signature 的跨 session 重放),以及防護升級。也有人討論這對全球 AI 供應鏈、API 安全與用戶信任的長期影響。
整體而言,這起事件被視為 AI 產業「軍備競賽」與「信任危機」的縮影:一方面凸顯前沿模型的價值與防護難度,另一方面暴露跨國資料流、隱私與地緣風險。Anthropic 已強化相關防護,並與當局及其他公司分享情報。中國相關公司目前多未公開詳細回應。
這不只是「模型被抄」的技術故事,更是用戶資料主權、國家級 AI 競爭與平台信任的現實寫照。完整細節可參閱 Anthropic 原報告。
--
Grok整理
中國人用著國產AI 資料怎麼就跑到了美國手上被曬呢XD
不知道老共會不會出拳制裁
--