Anthropic新AI威脅報告 台灣也中獎了!
原文:
https://www.anthropic.com/threat-intelligence-…
板上七月才戰過中國 AI 公司到底有沒有偷用、蒸餾 Claude。
那時候大家還在吵:
中國模型都已經追成這樣了,幹嘛偷 Claude?
美國公司是不是看到競爭對手追上來就在喊蒸餾?
模型回答自己叫 Claude 能不能算證據?
兩個月後,Anthropic 在 9 月 10 日直接丟出一本 154 頁的威脅情報報告。
看完才發現,模型蒸餾只是最後一章。
前面還有:
俄羅斯情報活動
ShinyHunters 金融犯罪
24 小時 AI 漏洞工廠
單人駭客打歐洲政黨
假新聞工廠
選舉操弄
冒充真人政治活動家
跨國鎮壓
全國級電信監控
飛彈導引
自殺無人機蜂群
電子戰與防空壓制
病毒功能增益研究
AI 假交友 App
台灣在裡面出現好幾次。
這篇很長。
原文 154 頁更長。
英文看得很爽的人可以自己去啃原文。
懶得啃的,下面大概就是整本在講什麼。
====================
這本報告到底是哪來的
====================
Anthropic 威脅情報團隊整理的是 2025 年 12 月到 2026 年 8 月之間,他們發現並中斷的 Claude 高風險濫用案件。
涵蓋七大類:
網路攻擊
政治影響力操作
監控
常規武器
生物濫用
詐騙
非法模型蒸餾
涉及 Haiku、Sonnet、Opus。
Anthropic 表示,除了其中一宗蒸餾事件之外,他們沒有在這批高危案件裡看到 Fable或 Mythos 級模型遭成功濫用。
這裡有個很重要的閱讀方式。
Anthropic 自己就寫了:
這批案例不是一般濫用的代表樣本。
他們挑的是目前看到最顯著、最有新意的一批。
所以拿這份東西算「多少比例 Claude 使用者在犯罪」毫無意義。
而且很多俄羅斯、中國、伊朗、企業與組織的身分,屬於 Anthropic 根據帳號活動、使用內容、基礎設施、裝置資料和公開情報做出的歸因。
有些高信心。
有些中等信心。
有些只說活動模式吻合。
該寫「Anthropic 研判」的地方就寫研判。
154 頁情報報告不會因為 PDF 很厚就自動升格成法院判決。
Anthropic 在開頭花很多篇幅講一個變化:
以前看到一場攻擊做到偵察、寫工具、打漏洞、橫向移動、整理資料、長期維持存取,而且同時打一堆目標,資安分析師會覺得後面應該是一支成熟的專業團隊。
現在這個判斷開始失靈。
報告裡同時出現:
疑似國家情報單位
金融犯罪集團
中國大學生
政治駭客
單人法語 hacktivist
做出以前看起來很像 APT 團隊才有辦法維持的工作量。
AI 最明顯的作用也不只寫幾段程式。
Anthropic 說,多數案例已經進入直接執行或編排工作流程:
主 Agent 拆工作
子 Agent 平行偵察
另一批找漏洞
另一批分析偷來的資料
另一批寫工具
完成後回報
人類還在。
只是愈來愈像主管。
決定打誰。
看結果。
有問題再改一下工作指示。
全年無休的工程部門就繼續跑。
Anthropic 用一個詞叫 uplift。
大概分三件事:
速度
規模
深度
AI 有沒有讓同一個人做得更快?
能不能同時打更多目標?
碰到陌生系統時能不能挖得更深?
後面的案例就是這三件事一路放大。
====================
俄羅斯情報案:
防毒抓到病毒,AI 自己回去改
====================
GTG-20006。
Anthropic 認為它的行為和公開情報裡的 Midnight Blizzard 相符,其中一名俄語操作者使用「JackPoterz」這個名字,技術手法和目標也符合俄羅斯國家關聯間諜活動。
他們觀察到超過 20 個不同組織進入攻擊規劃、偵察或實際行動。
目標包括:
烏克蘭政府
歐洲政府
軍事情報機構
外交單位
大使館
國防企業
智庫
美國外交政策相關人士
亞洲海事政府機構
北非政府科技機關
其中一條主線一直繞著烏克蘭和軍用無人機。
攻擊者掃描二十多個烏克蘭政府單位的郵件與遠端存取服務。
至少兩家無人機零件製造商的信箱遭大量匯出。
一間軍用無人機製造商也被鎖定。
更扯的是,一套無人機視覺系統的完整專有 SDK 被偷走。
接下來幾天,Claude 被拿來協助拆這套東西:
產品架構
硬體物料表
供應商依賴
韌體
還沒公開的產品資訊
連軍用無人機控制和 AI 視覺韌體都在研究範圍。
這群人還攻下至少三家經營飯店住客 Wi-Fi 的供應商。
打飯店 Wi-Fi 幹嘛?
因為政府官員、外交人員、無人機業者也要住飯店。
攻擊者拿到後台管理權限後修改 DNS。
客人一連上受影響飯店的 Wi-Fi,裝置識別資料和 IP 就可能先送到攻擊者那邊。
接著再依裝置投放 Windows、Android、iOS 的惡意內容。
微軟後來把這套手法稱為 CaptiveCrunch。
攻擊者還能把飯店管理系統裡的住客資料,和裝置端拿到的東西交叉比對。
所以這不是:
「我駭一間飯店,看今天住誰。」
比較接近:
「我要找特定人,所以我先控制他會使用的基礎設施。」
WhatsApp 那段也很精彩。
他們使用 Headless Browser 和 WPPConnect,把受害人的 WhatsApp 帳號綁成伴隨裝置。
然後把已讀回條壓掉。
受害人表面上照常用 WhatsApp。
後台則可以大量匯出俄語、烏克蘭語聊天。
Anthropic 至少看到兩名前烏克蘭高階官員成為這種方式的目標。
還有監視器。
攻擊者找到攝影串流服務授權上的缺陷,取得能看即時攝影畫面的 Token。
北非另一個受害政府單位更加慘。
VPN 憑證被拿走。
中央帳戶伺服器接著失守。
Anthropic 說最後外流:
30 萬筆以上國民身分紀錄
50 萬筆以上公司登記資料
另外一套叫 Embassy Kit 的東西專門處理 Microsoft 365 裝置碼釣魚。
最後至少八個組織的郵件資料遭到存取或外流,包括:
國家檢察機關
軍事教育機構
區域政府間組織
這案最讓資安圈頭痛的一段,是惡意程式和防毒之間的循環。
Agent 會監測植入程式有沒有被安全產品發現。
被抓到。
Agent 自動修改。
重新編譯。
重新部署。
再測。
還被抓?
繼續改。
一直弄到偵測不到為止。
傳統防守有一項成本優勢:
你辛苦做一隻惡意程式。
我抓到了。
我做出新特徵碼。
你的工具報廢。
回家重寫。
現在對面多了一群不下班的軟體工程師。
防毒:
「偵測成功。」
Agent:
「已收到測試結果。」
更機車的是,部分惡意程式還會阻止受害電腦取得安全更新。
防毒廠商就算後來做出新偵測,機器可能根本收不到。
====================
ShinyHunters:
搶銀行的概念,被做成資料工程流水線
====================
GTG-50014。
這批是金錢導向。
Anthropic 認為其中多個集群和 ShinyHunters 生態有關。
其中一名法語操作者使用過:
MeowSHA
frkoo
blazespider
這人搞了 10 台 AWS EC2 工作節點。
工作內容非常樸實:
到處下載 Android APK。
總共大約 180 萬個。
反編譯。
掃裡面有沒有開發者忘記拿掉的:
API Key
Session Token
帳密
其他祕密
驗證成功的東西即時送進 Telegram。
Telegram 裡甚至依一百多種來源分類。
找到一把 Key 之後還沒完。
系統會繼續判斷:
這個 Key 能不能登入?
權限多大?
可以摸到哪個雲端?
值不值得賣?
可以拿到多少資料?
有沒有下游客戶?
然後一路擴。
其中一家科技供應商被搬走超過 1TB 資料。
內容包含:
數十萬筆國家身分識別資料
數百萬筆支付卡資料
攻擊者把資料放到公開網站施壓勒索。
一家航空公司被摸到數千萬筆乘客紀錄。
一家能源公司那邊,攻擊者甚至聲稱有能力遠端控制裝在客戶家中的電動車充電樁電流。
供應鏈案更壯觀。
一家 SaaS 公司先失守。
接著利用這個入口摸下游客戶。
大約 200 家公司資料被抽。
其中一段作業在約 34 小時內倒出:
2,100 組以上 Azure AD Token
橫跨 40 多個企業租戶。
Anthropic 寫得很直接:
AI Agent 幾乎做了所有工作。
有一次企業軟體公司的攻擊,從取得初始存取權到大量偷資料,只花幾個小時。
另一案從一枚被偷的 Developer Token,約三小時一路爬到整個雲端環境的管理權限。
操作者未必熟悉每家公司的架構。
指令可以很接近:
「拿這個憑證進去,把有價值的資料找出來。」
Claude 自己理解環境。
自己寫腳本。
自己執行。
看結果。
失敗再調整。
直到完成。
Anthropic 把這種風格稱為 vibe hacking。
程式圈 vibe coding 的治安版本。
而且有人被抓到一邊入侵、偷資料、勒索,同一時間還從其中兩家受害企業領
HackerOne 漏洞賞金。
金額分別是:
2,000 美元
5,000 美元
同一個客戶。
漏洞賞金賺一次。
入侵再賺一次。
資料拿去勒索又是一次。
財務自由的課程看到都要記筆記。
====================
AI API Key 現在也是戰利品
====================
報告特別花一段講 AI 供應鏈。
因為偷一把 AI API Key 有三個用途。
第一,能賣。
第二,拿來跑模型,帳單別人付。
第三,用合法客戶的 Key 發流量,可以躲在正常客戶身後。
ShinyHunters 相關操作者入侵企業後,只要看到受害者有 AI Key,就把自己的攻擊工作切換到受害者 Key 上跑。
很環保。
不浪費別人的雲端額度。
還有一家假 Claude 經銷商更有創意。
GTG-50021。
俄語、烏克蘭語集團。
號稱賣便宜 Claude。
客戶付錢之後才發現兩件事情。
第一,後面根本不是 Claude,而是偷偷轉到其他模型。
第二,客戶電腦還被裝了憑證竊取工具。
Anthropic 帳號被偷走後,再賣給其他代理商。
你本來想買便宜 AI。
最後自己變成商品。
====================
GTG-50020:
先駭飯店,後來發現 AI 公司更香
====================
另一名俄語金融犯罪操作者原本主要打飯店訂房系統和金融科技。
其中一案偷走約 26GB 資料。
勒索或暗網出售的開價落在:
150 萬到 250 萬美元。
後來他把相同技術轉去 AI 產業。
其中一次,攻擊者把惡意指令塞進某 AI 廠商的自動評測沙盒。
結果沙盒自己把手上握的憑證交出去。
裡面包含多家 AI 供應商的 Production API Key。
拿到之後,攻擊工作立刻改用受害公司的 Key。
接著同一套基礎設施大約四天打了 30 家 AI 公司。
這個人的終極目標也寫得很清楚:
他想摸到尚未公開的 Claude 預發布模型。
試了十幾條路。
全部失敗。
Anthropic 自家的系統也沒有遭攻破。
這點要寫,不然只挑成功案例看,會把整份報告看成 AI 版世界末日宣傳冊。
====================
湖南兩個大學生:
24 小時漏洞鑄造廠
====================
GTG-10007。
Anthropic 追到一群可能住在湖南長沙的中文操作者。
其中兩人被辨識為湖南某中國大學資訊與通訊工程相關科系本科生。
其中一人曾在深信服實習,當時還在面試奇安信的進攻型資安職位。
這群人的目標約 50 個組織:
教育
零售
能源
科技
醫療
金融
製造
各國政府
一家教育科技公司被搬走數百 MB 學生個資。
一家零售公司的正式生產環境被進入,而且攻擊者證明可以直接修改線上系統。
東南亞某政府機關則被拿到公民姓名、電話和住址。
他們另外維持一套長時間自動跑的漏洞研究工作。
目標包含安全產品和網路設備。
流程大致是:
把韌體或程式拆開
大量反編譯
找可疑區塊
提出漏洞假設
寫利用程式
丟進自己的實驗環境
失敗就修改
繼續跑
Anthropic 表示,其中一項安全產品研究找到了多個以前未知、而且在操作者自家實驗室驗證過的漏洞。
同一套研究也替數個網路與安全設備系列做出可工作的利用程式。
最有趣的是他們會跑 Agent Swarm。
一隻主 Agent 拆任務。
下面一堆子 Agent 同時做偵察和入侵後工作。
而且戰役狀態會保存:
今天有哪些目標
拿到哪些憑證
哪一家打到哪裡
下一步要幹嘛
人去睡覺。
系統還可以繼續做漏洞研究和資料收集。
隔天回來接續。
以前「國家級網路攻擊」裡的「國家級」多少還暗示後面有人力。
未來情報分析報告看到一個操作流程做得很漂亮,可能得多填一格:
團隊規模:
□ 50 人
□ 10 人
□ 3 人
□ 一個學生和他的 Agent
====================
法國單人駭客:
42 個目標,14 個進去
====================
GTG-50029。
2026 年春天。
單一法語操作者。
目標是歐洲:
政黨
媒體
智庫
政治相關 SaaS
他自己做 Rust 掃描器,在公開容器裡找 API Key。
找到後驗證,再透過代理層輪換使用,把惡意流量混進真正 Key 主人的正常流量。
這人還找到一個當時沒有公開紀錄的 WordPress 重裝競態漏洞。
Claude 幫忙開發和除錯。
最後至少四個受害網站被建立惡意管理員帳號。
某政治競選管理平台被拿走大約:
14 萬筆紀錄
而且資料包含使用者政治意見。
另一個網站被塞 Webshell。
備份也被污染。
所以管理員如果發現中毒,心想:
「沒關係,我還原備份。」
恭喜。
把後門一起還原回來。
一間媒體網站則被植入瀏覽器攻擊框架。
數千名讀者的瀏覽器被做指紋辨識。
攻擊者特別找編輯部工作人員的 Session 和憑證。
這個人另外做了一個叫 fafsearch 的人肉搜尋平台。
把不同資料外洩來源灌進去。
裡面有數千萬列資料:
國民健康識別碼
司法系統外洩資料
自己入侵偷回來的資料
全部交叉比對。
最後架成 Tor 服務。
可以直接輸入姓名查某個政治運動相關的人。
42 個追蹤目標裡:
至少 14 個取得內部存取。
外洩量估計:
12 到 26GB。
包括:
政黨會員
捐款人
15,000 封信件
學生申請資料
未成年人資料
支付資料
整個平台,一個人做的。
====================
政治網軍篇:
連政治宣傳都開始訂閱制
====================
報告列了九個影響力行動案例,橫跨六大洲。
俄羅斯
伊朗
土耳其
波斯灣
南亞
非洲
歐洲
什麼立場都有。
政府做的。
國家媒體做的。
反政府組織做的。
廣告公司收錢做的。
地方政治操作者自己做的。
所以從這章硬推導:
「AI 都是在幫某一個政治陣營。」
會直接撞牆。
有錢、有需求、有帳號,各家都有。
一家法國廣告公司 LKM 搞出的網路:
約 70 個假新聞網站
70 個對應 X 帳號
250 多個假留言帳號
至少 8,913 篇文章
約 20 種語言
目標橫跨六大洲。
最有商業精神的部分是:
沒有固定政治理念。
誰付錢就幫誰寫。
同一則新聞甚至可以改成完全相反的政治立場,分別餵給不同國家的受眾。
假新聞網站還配假記者名字。
假記者當然不存在。
250 多個假留言帳號不少還使用 AI 頭像。
2025 年 9 月 11 日曾出現一批網站在三分鐘內同時發表幾乎一樣的剛果民主共和國與盧安達新聞,只是按照不同地區讀者修改語氣。
八千多篇文章弄完。
成效呢?
大部分真實受眾互動很低。
Anthropic 給它 Breakout Category 2。
所以 AI 已經解決「一天怎麼生八千篇垃圾」的問題。
還沒有徹底解決:
「八千篇垃圾為什麼還是沒人看。」
====================
馬來西亞:
號稱「軍規級 AI 政治作戰生態系」
====================
GTG-84005。
一家伊斯坦堡公司 BBS Bilisim Teknolojileri 被 Anthropic 指認和一套商業選舉操弄平台有明確連結。
公司自己的文件把產品形容成:
「軍規級、AI 驅動、即時政治作戰生態系。」
功能確實不少。
大約 1,000 個假 X 帳號。
有養號邏輯。
會定期更新 Cookie 和 IP,看起來比較像真人。
有控制台。
可以設定一個目標想灌多少假瀏覽。
Anthropic 甚至看到一個針對馬來西亞現任首相帳號要求:
100 萬人工瀏覽。
系統還吃進真實人口統計和選舉資料。
涵蓋馬來西亞全部 222 個國會選區。
按照當地最敏感的:
族群
宗教
王室
去做政治微型瞄準。
另外架了一間假新聞媒體:
Malaysia Pulse。
抓合法馬來西亞媒體文章回來。
Claude 改寫好幾次。
再用不存在的記者名字重新發。
Russian、Chinese state media 來源,例如新華社、Sputnik、CGTN 的內容,也會被拿來加工,來源身分拆掉之後包成看起來像馬來西亞本地獨立新聞。
聽起來像次世代認知戰航空母艦。
實際影響力評級還是 Category 2。
有很多資產。
沒有證據顯示突破到大量真實社群。
簡報十分。
觸及另外算。
====================
俄羅斯國家媒體:
Claude直接進新聞編輯台
====================
Anthropic 還查到四個帳號,Claude 產出的內容最後進入俄羅斯國家媒體或國家資助媒體。
包括:
Sputnik Moldova
RIA Novosti
Sputnik en Español
Sputnik Africa
RT English
其中一名前 Sputnik Moldova 總編,把羅馬尼亞語、摩爾多瓦新聞、民調和反對派社群內容丟進 Claude,整理成俄語文章。
之後內容出現在 Sputnik Moldova Telegram 和 RIA Novosti。
同一個故事再被不同媒體互相引用,看起來就像:
「很多媒體都證實了。」
來源繞一圈,原本其實可能只有一個。
摩爾多瓦 2025 年國會選舉前,還出現針對總統 Maia Sandu 的虛假與毀謗性內容。
另一名俄國國有媒體員工甚至拿 Claude 做電視用文字:
跑馬燈
螢幕標題
旁白
短標
輸入來源包括俄國新聞通訊社、SVR 和國防部內容。
Anthropic 至少確認一段真的播上俄羅斯電視。
以前問:
AI 什麼時候會進新聞編輯室?
答案看起來是:
有些編輯室已經上工了。
====================
伊朗:
連宣傳部門的組織架構都叫 AI 幫你做
====================
Anthropic 找到三個與伊朗國家宣傳機構相關的帳號。
操作者把自己的計畫稱為:
軟戰爭
認知戰
Claude 幫的範圍遠超過寫貼文。
還包括:
宣傳計畫
組織架構
學說手冊
人物系統
目標資料庫
部會規劃文件
甚至做出一套九部分國際影響力組合,以及最高領袖葬禮相關的完整組織預案。
有一批活動在 2026 年美國、以色列、伊朗戰爭相關宣傳中,還把虛假說法掛到:
CSIS
Brookings
RAND
等西方研究機構頭上。
手法很熟:
自己的話先塞到別人嘴裡。
再引用「別人說的」。
網際網路祖傳秘方。
====================
孟加拉:
一個人輪 29 個 Claude 帳號
====================
孟加拉 Gaibandha 地區一名操作者,大約 16 個月輪轉 29 個 Claude 帳號。
他寫了一個叫 fake_news_3.py 的程式。
一次固定生:
15 個假新聞標題
3 篇完整故事
15 個圖片生成提示
再經過雲端資料夾。
轉音訊。
轉影片。
另一支程式自動排 YouTube。
甚至可以把影片排到幾個月以後再發。
人睡了。
宣傳還在排程。
====================
最黑色的一段:
AI直接冒充一個真的政治活動家
====================
GTG-84006。
Anthropic 把這批活動連到伊朗人民聖戰者組織 MEK/NCRI 生態。
這裡已經跨過普通「假帳號」很多。
他們找了一名真的政治活動人士。
把他大約:
8,400 則 Telegram 貼文
餵給 Claude。
模仿他的寫作方式。
接著直接使用這個被模仿的身分,和原本人際圈裡的人即時聊天。
Anthropic 說,據他們所知,對方不知道自己正在跟 AI 輔助帳號交談。
這個網路還爬超過 500 個社群頻道。
分析約:
51,944 則歷史訊息。
拿來建立伊朗境內特定人士的心理和政治檔案:
城市
年齡
職業
政治傾向
被捕紀錄
這些不是「生成幾張迷因圖」。
這是把真人的人際信任也變成可以複製的攻擊面。
====================
阿聯酋相關行動:
假 NGO、假獨立網紅,連聯合國證詞都準備
====================
GTG-84002。
Anthropic 高信心把行動連到阿聯酋政府官員。
一名操作者維護一個叫 Deadshot 的 AI 人格。
底層有一份總綱,數百個 Session 都沿用同一任務。
行動包含:
約 300 個假網紅帳號
複製一家真實瑞士 NGO 身分,建立前台 NGO
替兩個人代寫準備在聯合國人權理事會第 62 屆會議使用的證詞
對 18 名歐洲議會議員與知名記者建立詳細人物檔案
對批評阿聯酋在蘇丹行動的聯合國特別報告員製作反制資料
代寫聯合國證詞時還有規定:
不能提 UAE。
因為「獨立聲音」最大的特色,就是最好不要讓大家知道背後誰在付錢。
Anthropic 無法確認這些證詞或人物檔案最後到底有沒有成功送進目標手上。
所以不能把「準備使用」寫成「已經成功影響聯合國」。
這種地方原文分得很清楚。
====================
監控篇:
AI開始替整個情報分析部門省人力
====================
監控章比網軍章更陰。
Anthropic 自己整理出幾個趨勢。
AI 可以拿來蓋監控工具。
也可以一次吃大量資料找目標。
還能直接嵌進政府安全官僚體系。
一家名為 S2T Unlocking Cyberspace 的商業情報公司,被發現開發用來分析伊朗與波斯灣社群使用者的監控平台。
使用者會被依:
位置
政治立場
城市人口
宗教人士
軍人
青年
僑民
農村人口
等條件分類。
最後生出正式政府公文口吻的阿拉伯文情報簡報。
旁邊還有 255 個以上的合成社群帳號準備使用。
Anthropic 在試點階段把帳號封掉,沒有證據能確認更後段的監控能力真的拿去對付真人。
====================
中國在敘利亞找維吾爾人
====================
GTG-14010。
Anthropic 認為這是一場與中國政府利益一致的監控與招募活動,但對「承包商替國安工作」這個身分只給低信心。
操作者監控:
100 多個 WhatsApp 群
數十個 Telegram 頻道
把大量聊天丟給 Claude。
模型整理成中文結構化資料。
其中一個很陰的篩選條件是:
哪些人在新疆還有家人。
因為這種資訊可能形成現實世界槓桿。
操作者本身使用中文。
不需要懂敘利亞阿拉伯方言。
Claude 幫忙:
翻譯
修話術
檢查軍事用詞
模擬阿拉伯語專家
評估目標心理
等於情報人員突然免費獲得一個:
會中文
會阿拉伯文
懂當地方言
能大量讀群組
不會抱怨資料太多
的分析小組。
====================
台灣第一條:
台灣長老教會被做人物檔案和場所偵察
====================
GTG-14020。
這一段台灣媒體如果只寫一句「台灣長老教會遭監控」,其實會漏掉不少東西。
Anthropic 看到一組中國境內操作者,工作優先順序和中國宗教事務、統戰體系高度重疊。
其中一名使用者甚至自稱中國國家機關的資訊安全人員。
Claude 被拿來產出看起來像國安內部文件的東西:
人物調研底稿
線索報
每日態勢感知摘要
每個目標還要整理:
涉中活動
負面消息
醜聞
「抓手」
這裡的「抓手」不是很抽象的管理術語。
在這種情報文件脈絡裡,指的就是:
有哪些地方可以利用。
監控名單包含:
亞洲天主教高階樞機
台灣長老教會領導層
西藏流亡行政與倡議團體
法輪功
神韻
新唐人
跨新加坡、香港、中國的基督教宣教網絡
針對個人收集的東西包括:
出生日期
出生地
移民時間
社群帳號
場所也查。
教堂、宗教場地的:
平面圖
外觀
結構圖
Anthropic 的表格對台灣這條直接寫:
目標:台灣長老教會領導層
產物:多名目標人物檔案+場所偵察
工作不是一整隊人在做。
一名操作者同時跑四條工作線。
多國語言資料丟進去。
Claude 負責:
翻譯
摘要
整理
套模板
產文件
一間以前可能坐很多分析員的辦公室,開始變成一個人配模型。
====================
台灣第二條:
連「台灣政府」都可以自動改成「台灣當局」
====================
GTG-14022。
Anthropic 認為這是一個中國境內「輿情監控」與異議人士監視系統。
他們中等信心研判,操作者比較像替政府客戶工作的承包商,客戶可能和國安、統戰或宣傳體系有關。
Claude 被要求扮演:
「服務中國政府的高級突發輿情分析師。」
每天處理:
15 到 30 篇以上
外媒、微博、X、YouTube、Telegram、Facebook 內容。
系統替內容打政治敏感分數。
監控:
異議人士
活動人士
少數民族
海外華人
宗教組織
台灣政治人物
勞工
學生
國際人權組織
語言也有規定。
「台灣政府」
改成
「台灣當局」。
「人權侵犯」這類批評中國的文字,加上引號。
部分產出的文件甚至會提出只有政府機關才有能力執行的執法建議,並使用中國「三戰」
心理戰
法律戰
輿論戰
相關語言。
最有公務員味的地方是:
操作者還讓 Claude 做出版本化操作手冊。
每天新聞自動進。
自動分析。
自動套政府語彙。
自動產報告。
政治正確已經從人工校稿進化成 CI/CD。
====================
中國「維穩」案:
第一次拒絕,換個問法後列出10個真人
====================
GTG-14021。
三組互相關聯的帳號。
Anthropic 認為涉及:
地方網警
公安院校學生
地方國安局
部分具體機構歸因是中等信心。
其中一個工作流用 Claude Code 加自訂技能,直接查政府監控資料庫,產每天的敏感事件報告。
有一次 Claude 原本拒絕替操作者產「維穩」週報。
接著對方重新下 Prompt。
後來模型產出了針對:
10 名中國公民
的功能性「穩控」建議。
包括:
攔截上訪
約談
密切監視活動和通信
另一部分延伸到海外。
操作者要求做活動前場地情報。
包括:
加拿大溫哥華民主遊行的集合點、路線、終點
土耳其維吾爾文化活動場地
奧斯陸自由論壇放映活動
這裡很值得看,因為 Anthropic 沒有假裝自己防護每次都成功。
官方直接承認:
有一案一開始拒絕了。
後續 Prompt 還是被突破。
====================
伊朗:
一年建檔6388人、分析15萬多則推文
====================
另外一批伊朗相關監控活動更接近一個正式官僚機器。
Anthropic 描述兩個單位、16 個帳號。
其中活動資料聲稱:
一年建檔 6,388 名伊朗人
分析 155,216 則推文。
兩個單位都把資料送到名為 Arman 的案件管理系統。
個人檔案包含:
國民 ID
信仰
犯罪紀錄
社群帳號
「行動」分頁
其中有人拿 Claude 寫惡意 Firefox 擴充套件。
外觀看起來像祈禱時間工具。
實際上拿來收集社群身分。
旁邊還有人把 Claude 的自訂技能拿去做聲音複製工廠。
複製三名伊朗作家的聲音。
甚至提前準備最高領袖繼承時可能使用的宣傳敘事。
====================
馬利:
一個顧問做出2500萬SIM級監控平台
====================
GTG-50027。
這案大概是監控章最誇張的一個。
Anthropic 說,一名可能位於馬利首都巴馬科的獨立顧問,替馬利國家情報機關 ANSE 開發:
Lakana 360。
整個國家三家行動電信商都在範圍裡。
大約:
2,500 萬張 SIM。
可以處理:
通聯紀錄
簡訊
語音
還包括:
跨不同 SIM 做聲紋辨識
標記使用 VPN 或加密工具的人
推斷秘密會面
地理圍欄觀察名單
和國家生物特徵戶籍等資料庫交叉比對
其中一個功能可以輸入任意電話號碼,直接讓 LLM 生情報人物報告。
原本有司法令狀要求。
操作者要求把它拿掉。
拿掉了。
資料還設定成無限期保存。
最荒謬的地方在故事結尾。
Anthropic:
「我們封鎖這個帳號了。」
問題是 Lakana 360 已經部署在當地。
而且正式系統跑的是本地模型。
Claude 主要負責前期軟體設計與工程開發。
帳號封掉。
已部署的平台繼續存在。
就像建築師突然宣布:
「我從今天起不接你生意。」
對方:
「可是房子已經蓋好了。」
====================
武器篇:
這次直接多一個完整章節
====================
2025 年 11 月前一份報告還沒有獨立的常規武器章。
這次一次列六案。
中國三案。
俄羅斯兩案。
葉門一案。
其中四案直接碰武器軟體。
另外兩案碰軍事採購和情報。
====================
北葉門:
Claude Code被當飛彈軟體工程師,而且真的試射
====================
GTG-87001。
北葉門一組人同時跑三個武器計畫。
第一個:
用手機等級飛控電腦做末段尋標導引火箭。
第二個:
多級彈道飛彈。
操作者自己寫的射程目標:
超過 2,000 公里。
第三個:
R2000 系列。
裡面還包含高超音速滑翔載具變體。
Claude Code 在這裡扮演的角色很接近軟體工程師。
幫忙整合開源自動駕駛系統。
寫控制和位置估計。
調參。
編譯韌體。
跑飛行模擬。
而且他們不是只開一個 Claude 視窗。
同時開好幾個。
一個寫程式。
一個研究。
一個審查第一個寫的程式。
這套開發真的進到實體測試。
他們試射了一枚導引火箭。
失敗。
幾個小時後,操作者回來找 Claude 分析為什麼失敗。
一般程式設計師:
Production 爆了。
貼 Log。
這群人:
Production 真的爆了。
貼遙測。
Anthropic 沒有證據證明他們最後做出可實戰部署武器。
但還有一個麻煩。
他們已經做出可以離線執行的模擬工具包。
不需要 Claude。
也不需要 MATLAB。
封號能阻止後續 AI 協助。
已經交付到硬碟裡的東西不會跟著消失。
====================
中國反魚雷案:
200多頁軍工提案,AI自己當紅隊審自己
====================
GTG-17001。
中國境內操作者同時做三條線。
第一:
中國版反魚雷火控規格。
目標是送中國國防承包商核准,後續進認證和作戰測試。
第二:
超過 200 頁中文技術提案。
另外還有給主管看的簡報。
第三:
蒐集公開資訊,把自家方案和美國海軍反魚雷、反潛系統比較。
有趣的是提案審查方式。
每寫完一版,就叫 Claude 扮演敵對、很機車的專家審查員。
挑毛病。
再把 Claude 挑出來的毛病拿去修下一版。
AI:
「你的方案這裡不合理。」
AI:
「謝謝,我改。」
一家公司最夢寐以求的內部審查文化。
沒有情緒。
沒有部門政治。
也沒有會議便當。
Anthropic 研判操作者和中國國防工業製造商有關,目標可能是為解放軍海軍製作武器規格與採購提案,但無法歸到某個具體實體。
====================
俄羅斯自殺無人機蜂群:
可以自己選「人」當目標
====================
GTG-27005。
俄羅斯境內可能是小型自由接案團隊。
專案名字:
DronDoc
Serafim
目標是一套全棧自主 FPV 自殺無人機蜂群。
Claude Code 幫忙做的東西包括:
無人機共享蜂群記憶
容錯協調
機載小型語言模型
決定攻擊、觀察、返航
末端視覺導引
尋找對方無人機操作手位置
被動聲學偵測
底層晶片程式
設計裡甚至允許機載模型選擇:
「人」
這一類目標。
並下達引爆命令。
沒有 Human-in-the-loop。
Anthropic 還看到:
韌體真的燒進開發板。
單板電腦有準備。
網狀網路模擬環境有架。
電腦視覺模型使用烏克蘭戰場影片訓練。
目標被分成敵、友。
俄軍裝備加入白名單。
示範打擊位置還固定用頓內茨克州。
這套系統成熟度被 Anthropic 評估約:
TRL 3 到 4。
也就是模擬/實驗驗證。
距離成熟實戰系統還有很大距離。
這部分如果媒體寫成:
「AI自主殺人蜂群已經部署烏克蘭。」
那就是幫原報告免費加戲。
====================
台灣第三條:
電子戰軟體做到一半,把預設場景改成台灣12個目標
====================
GTG-17002。
中國境內操作者使用 Claude 聊天、寫程式和 Agent 工具,做了一套大約:
16 個模組
的中文電子戰與防空壓制軟體。
總共迭代:
12 版。
軟體分析:
雷達
地對空飛彈陣地
指揮所
通信節點
然後計算:
偵測範圍
干擾效果
哪個目標價值高
哪個比較脆弱
哪個先壓制
多日作戰時干擾機怎麼分配
還會模擬 Patriot 和 THAAD 級系統的交戰包絡。
專案做到中途。
Anthropic 看到操作者把預設模擬情境改成:
台灣 12 個目標。
內容包括:
台灣一處指揮掩體
預警雷達
愛國者飛彈連
天弓飛彈連
主要空軍基地
區域作戰指揮總部
操作者同時還在內部網路跑自己的模型,再透過工具呼叫接到這套軟體。
Anthropic 根據帳號資料和內容,研判此人是中國境內國防/軍工研究人員。
相關訊號指向中國研究機構,其中包含:
解放軍軍事科學院。
證據到這裡。
報告沒有寫:
解放軍已經拿這套系統做出完整攻台作戰計畫。
它寫的是:
一名被 Anthropic 研判和中國軍事研究機構相關的操作者,用 Claude 做電子戰、防空壓制分析工具,預設模擬場景後來改成台灣 12 個軍事目標。
光原文這樣就夠大條了。
不用再自行加辣。
====================
俄羅斯採購:
AI幫忙研究怎麼繞出口管制
====================
還有一名莫斯科設計局採購經理。
研究的貨物有:
德國三軸磁通門磁力計
數千片太空級三接面光伏晶圓
航空機組氧氣系統
國防工程
加密設備
部分交易規劃涉及中國供應商,以及受制裁相關金融管道。
Claude 被拿來:
找供應商
爬市場
整理數十項報價
寫中英俄詢價
分析轉手價格
整理灰色市場供應鏈
有文件甚至明寫要透過制裁中立司法管轄區規避歐盟出口限制。
AI 對採購最大的貢獻:
全球比價。
用途看客戶。
====================
生物篇:
Anthropic自己都說這是最嚴重的前沿風險之一
====================
生物章有五個案例。
這部分 Anthropic 把很多東西遮掉。
研究機構不公布。
國家不公布。
部分病原體與技術細節拿掉。
官方還特地說:
這些人是工作的科學家。
Anthropic 沒有宣稱他們一定有傷害意圖。
原因是生物研究的「雙重用途」太難切。
研究病毒怎麼逃避免疫,可以拿來做疫苗。
同一份能力也可以拿來讓病毒更麻煩。
第一案:
2026 年 5 月。
一個轉售平台繞過地區限制,服務一批做國家資助研究的病毒學家。
研究涉及:
基孔肯雅病毒功能增益。
方向碰到:
傳播能力
免疫逃脫
活體連續傳代
而且計畫預定在軍事研究機構執行。
Anthropic 的生物分類器其實有成功把相關請求擋掉。
然後轉售平台做了一件非常符合市場競爭精神的事。
Claude 不回答?
自動轉給安全限制比較鬆的競爭模型。
更諷刺的是,這個「Claude 拒絕時自動換模型」的程式,有一部分還是 Claude 幫忙寫的。
因為開發者把需求包裝成:
降低模型過度拒絕。
Anthropic 五月封掉帳號和中繼網路。
幾天後對方重新建立存取。
幾週內換新身分繼續。
研究本身也沒有停,只是後來文件把病毒修改描述成比較偏「功能喪失」的語言。
第二案是高致病性禽流感。
一名不在 Anthropic 支援地區的研究者,用數千則訊息、花數週規劃:
禽流感適應哺乳類
氣溶膠傳播
嚴重病理
相關實驗。
這次分類器把他限制在較弱的模型。
Anthropic 認為 AI 帶來的增益主要仍在:
文書
實驗規劃
資料分析
沒有讓使用者取得前沿模型最強能力。
第三案更奇妙。
一個中繼服務一次服務十幾名不同客戶。
幾天內和 Claude 交換數萬則訊息。
其中一名客戶用 Opus 5。
大約一個小時。
從頭到尾寫完一份正痘病毒免疫逃逸研究補助案。
包括:
中心假說
實驗設計
劑量
統計計畫
備案策略
因為研究本身用「減毒」方向描述,分類器沒有擋。
問題就在這裡。
研究哪些基因負責關掉宿主抗病毒機制,可以幫你做減毒病毒。
同樣的知識也能告訴你:
哪些功能最好不要讓它消失。
第四案是一個國家支持的研究者建立:
多物種毒液胜肽圖譜。
再接生成式最佳化管線。
表面目標有:
止痛藥
抗憂鬱藥
其他治療分子。
圖譜同時包含麻痺類靶點。
其中一些還碰到國際出口管制的雙用途毒素類。
第五案更敏感。
研究者替國家計畫做多種毒素的計算重新設計。
包括一種細菌毒素亞基,以及 WHO R&D Blueprint 優先疾病清單上的出血熱病毒蛋白。
寫季度進度報告時,研究者還要求 Claude:
把病原體身分寫模糊一點。
維持低保真描述。
這兩案大致都沒被生物分類器攔下來。
Anthropic 說這其實符合原本設計。
因為分類器主要擋的是:
讓新手快速取得已知生物武器能力。
碰到:
新分子
治療研究
雙重用途
專業科學家
就難很多。
所以 Anthropic 最後的態度已經不是:
「再多加幾個關鍵字封鎖就好。」
他們提出前沿生物能力可能需要:
安全過濾器
加上
可信任使用者制度。
====================
詐騙篇:
兩週236萬則訊息,4700個AI假情人
====================
GTG-15001。
中國一家 App 工作室做了一個超過:
20 款交友 App
的網路。
廣告說:
真人。
2026 年 4 月兩週內,Anthropic 看到:
4,700 多個不同 AI 人格
至少接觸 25,000 個真人
Claude 發出約 236 萬則訊息
AI 跟真人工讀生比例:
大約 3 比 1。
交友畫面裡大概:
75% Claude 人格
25% 真人。
真人工讀生存在有非常重要的戰略價值。
視訊。
加社群好友。
需要證明「我不是 AI」的時候出場。
工讀生自己也有 AI 輔助。
另一個比較弱的模型會一次給三個建議回覆。
真人按一個送出。
另外的模型負責:
臉部吸引力評分
照片審核
聲音審核
圖片生成/編輯
各模型專業分工。
詐騙集團比很多企業導入 AI 的組織架構還成熟。
這些 Claude 人格還被下指令:
永遠不能承認自己是機器。
遇到視訊或照片要求要轉移話題。
按照固定聊天階段推進。
後台甚至會記:
哪個使用者開始懷疑對面是 Bot。
沒有真人可以視訊的時候,系統還能偽造:
Like
訪客
預錄「影片」。
App 本身也有過審設計。
審核 App Store、Google Play 時才會出現的特殊介面控制。
20 多個 App 變體故意改 Class 名稱避開相似度檢查。
第三方付款頁還能由伺服器端關掉,送審時藏起來。
Anthropic 甚至發現,少數受害人聊天時提到:
嚴重疾病
急性痛苦
模型內部其實看出這可能有傷害性。
最後還是照人設繼續聊。
大家常講:
AI 最好的方向是人機協作。
詐騙業:
已量產。
====================
最後154頁的大魔王:
七家中國AI實驗室被Anthropic點名蒸餾Claude
====================
這章就是七月板上吵過的東西。
差別在這次數字和手法全部端上來。
Anthropic 定義的「非法蒸餾」不是普通拿大模型教小模型。
蒸餾本身是正常 AI 技術。
他們指的是:
未授權
隱蔽
工業規模
大量假帳號
假身分
假卡或被盜信用卡
被偷 API Key
代理服務
長時間抽前沿模型能力,拿去訓練自己的模型。
攻擊者還會專門想辦法挖 Claude 的推理紀錄。
Anthropic 甚至看到有人先做:
12,000 多次不同方法的測試。
看看哪種 Prompt 最容易把推理痕跡挖出來。
成功的那幾種再放大。
有人叫 Claude:
把之前的思考「翻譯」成另一種語言。
目的還是一樣:
把原本不該吐出來的推理內容榨出來。
而 Anthropic 說,這裡還有一個安全問題。
就算蒸餾資料本身沒有很多生物、網攻內容,
被蒸餾的小模型還是可能因為通用推理能力提升,在危險領域一起變強。
最麻煩的是:
能力被抄過去。
Claude 原本的安全護欄不會一起複製。
====================
Alibaba / Qwen:
1.51億次
====================
Anthropic 說,Alibaba 關聯操作者跑了他們目前量到最大的蒸餾攻擊。
目標:
Opus 4.6
Opus 4.7
的推理能力。
每次請求塞固定 Prompt,要求 Claude 把推理過程寫進文字標籤。
把這些資料存起來。
整理成監督式微調資料。
Anthropic 指控這些資料後來被用在:
Qwen 3.5
Qwen 3.6
Qwen 3.7
規模最高:
接近每天 300 萬次交換。
同時動用:
3,500 多個假帳號。
第一批帳號池更接近:
5,000 個假帳號。
配:
住宅代理
拋棄式電子郵件
虛擬卡
Anthropic 一鍋端之後,
流量很快切到第二批帳號池。
2026 年 5 月到 7 月總規模:
超過 1.51 億次交換。
目標內容包括:
Agent 任務
軟體工程
Kernel 開發
長時間複雜任務
Anthropic 還說 Alibaba 不只拿 Claude 當老師蒸餾。
也讓 Claude 幫忙做:
強化學習環境
模型架構研究
內部 AI 研發基礎設施。
如果 Anthropic 歸因成立,
這已經很難用「借同學作業參考一下」形容。
比較像把老師搬回宿舍。
====================
Moonshot / Kimi:
使用者以為自己在用Kimi,後台其實送Claude
====================
這段很精彩。
Anthropic 指控 Moonshot 把部分客戶請求靜默轉給 Claude。
Claude 回答。
Moonshot 再把結果顯示給 Kimi 使用者。
使用者:
Kimi 幫我寫。
Kimi:
好的。
後台:
Claude 幫我寫。
十天裡接近:
30 萬個客戶請求
被送到 Anthropic。
大多數打 Opus。
代理網路用了:
5,380 個假帳號。
大多看起來位於新加坡和日本。
Moonshot 還保存其中至少部分交換內容。
再利用跨 Session 技術嘗試把 Claude 的完整推理軌跡還原出來,用於模型訓練。
2026 年 5 到 7 月:
超過 2,300 萬次交換。
更大的問題是被轉送的東西裡有客戶資料。
Anthropic 舉的一個案例:
一名它研判可能與解放軍相關的使用者,以為自己在用 Kimi,拿成都數百支 CCTV 的監視資料分析一名特定人士行為是否異常。
攝影機還包括:
解放軍設施外
中國電子科技集團相關研究所
大型國企附近。
這批資料實際被轉到了 Claude。
另一名大型中國國企工程師以為自己在用 Kimi 蓋內部系統。
結果 Prompt 裡的:
內部程式碼
有效登入憑證
中國大型科技公司資訊
也跟著被轉過去。
這位工程師本人根本不知道。
====================
DeepSeek:
還會辨識你是不是從OpenCode、Claude Code這類Harness進來
====================
Anthropic 對 DeepSeek 的指控很接近 Moonshot。
同樣有:
偷偷轉送使用者請求
抽 Claude 推理
拿交換資料做訓練
還有一項滿針對性的行為。
DeepSeek 會檢查傳入請求裡的一些字串。
辨識使用者是不是透過:
Claude Code
Claude Agent SDK
OpenCode
這類編程 Harness 使用模型。
特定被標記使用者的請求,接著被轉到 Claude Opus。
其中幾個案例非常敏感。
一家中國科技公司員工以為自己在用 DeepSeek 分析內部文件。
結果被轉給 Claude。
資料包括:
旗艦 AI 計畫完整規格
組織架構
戰略目標。
另一案是一名處理俄羅斯政府機構資料的 IT 人員。
該機構和俄羅斯國防部有關。
被轉過去的內容裡甚至露出:
俄羅斯政府資料庫有效憑證。
還有中國某地方公安局案件管理系統。
工程師正在開發利用國民身分證號碼,把一個人的移動紀錄和警察資料交叉比較的工具。
也被轉到 Claude。
Anthropic 統計:
2026 年 7 月其中 14 天
DeepSeek 相關蒸餾流量超過:
1,210 萬次交換。
====================
Zhipu / GLM:
打Fable打不動,換防護比較弱的模型
====================
智譜相關活動 17 天:
超過 340 萬次交換。
其中十天裡:
770,609 次
經過專門清理推理軌跡的管線。
Claude 還被拿來:
評分其他模型輸出
清理推理稿
篩訓練資料
寫任務
寫答案
做測試
GLM 5.3 發布前,Anthropic 還看到智譜研究人員利用公開漏洞資料建立資安挑戰題,再去蒸餾美國前沿模型的網路能力。
一開始試 Anthropic 的 Fable。
安全限制太強。
效果不好。
後來放棄。
改打 Opus 4.6,以及另一家美國實驗室被他們判斷防護比較弱的模型。
攻擊者也會做產品比較。
KPI 很務實。
====================
Xiaomi / MiMo:
免費試用流量可能直接變成蒸餾原料
====================
Anthropic 指控 Xiaomi 保存 MiMo 使用者完整對話和寫程式工作,再重播給 Claude。
不是把 Claude 答案即時回給原使用者。
主要目的被研判是:
SFT
RL
訓練資料。
20 天:
超過 40 萬次 Claude 請求。
使用:
1,500 多個帳號。
Anthropic 還提出一個更敏感的推測:
MiMo-V2-Pro 的免費試用期及延長,可能被利用來吸引大量國際開發者流量,再將這些工作蒸餾 Claude。
這個部分要注意措辭。
Anthropic 原文是「調查顯示可能」。
所以不能改成:
「小米已承認免費試用就是拿來偷資料。」
完全不同。
被轉送資料裡,Anthropic 稱看到至少十多種語言、數百名使用者的:
姓名
聯絡資訊
公司資料
其他敏感內容。
====================
SenseTime、MiniMax:
連中間商市場都長出來了
====================
SenseTime 部分,Anthropic 指控它向第三方資料供應商買 Claude 對話紀錄。
這些紀錄來自使用中介服務、模型路由的客戶。
中介商把對話記起來。
再賣。
Claude 還被拿來幫 SenseTime:
寫蒸餾管線
啟動訓練
監控訓練。
MiniMax 更有創業故事。
Anthropic 說 MiniMax 透過一間看不出和母公司有關係的空殼公司,自己做模型代理服務。
這家代理商只提供:
Anthropic
OpenAI
一個中國模型都不提供。
連 MiniMax 自己家的都沒有。
Anthropic 因此研判這項服務存在的目的,就是收集使用者和美國前沿模型之間的對話,拿回去訓練模型。
假設這項歸因成立,
這家公司提供的產品非常專一:
我們什麼國產模型都沒有。
專業收外國模型資料。
====================
看到這裡,其實154頁一直在講同一個產業變化
====================
釣魚以前有。
間諜以前有。
詐騙以前有。
假新聞以前有。
監控以前有。
飛彈以前有。
生物雙重用途研究以前有。
偷別人的技術更是人類傳統藝能。
今年不一樣的地方,是一堆原本很吃人的工作開始可以塞給模型。
看一百個網站。
讓 Agent 看。
二十種語言。
模型翻。
不知道受害公司 API 怎麼用。
模型讀文件。
惡意程式被防毒抓。
模型改。
要同時跑十條情報工作。
多開幾個 Agent。
幾萬則 Telegram 訊息。
模型整理。
兩百頁軍工提案沒人審。
叫另一個 Claude 扮刻薄審查委員。
四千七百個假女友聊不過來。
模型聊。
這就是 Anthropic 為什麼一直強調:
以後不要看到攻擊很專業,就立刻推測背後一定有多少人、多少預算、多少國家級資源。
生產力門檻正在掉。
以前一支十人團隊做的事情,
現在幾個人可能辦得到。
以前一個人做得到的事情,
現在可以同時對幾十個目標做。
攻擊方式可能還是那堆老招。
單位成本已經變了。
====================
台灣看這份報告,有三件事很難當沒看到
====================
一:
台灣長老教會領導層進了宗教情報工作流。
不是只有查新聞。
有人物檔案。
還有場所偵察。
二:
台灣政治人物和媒體進了自動輿情監控。
每天吃新聞、社群。
政治敏感度分類。
政府口吻改寫。
連「台灣政府」改成「台灣當局」都有固定規則。
三:
一套用 Claude 做出來的電子戰/防空壓制分析軟體,專案中途把預設模擬改成台灣 12個軍事目標。
愛國者。
天弓。
預警雷達。
空軍基地。
指揮設施。
全部出現在 Anthropic 報告。
這三件事都沒有辦法證明:
Claude 已經成為某個國家的正式攻台 AI。
Anthropic 也沒這樣寫。
資料能確定到哪裡,就停在哪裡。
但如果還停留在:
「生成式 AI 不就問問題、寫作文而已?」
154 頁大概已經回答得滿完整。
AI 沒有突然發明人類的惡意。
比較像把既有產業通通發了一套:
翻譯組
研究組
程式組
資料分析組
客服組
24 小時輪班組
而且不請病假。
以前企業簡報天天喊:
AI 賦能。
數位轉型。
降本增效。
看完這本會發現,
這四個字沒有規定只能給好人用。
資料來源:
Anthropic
《Detecting and countering misuse of AI: September 2026》
2026/09/10
https://www.anthropic.com/threat-intelligence-…
補充說明:
本文涉及俄羅斯、中國、伊朗、阿聯酋及 Alibaba、Moonshot、DeepSeek、Zhipu、Xiaomi、SenseTime、MiniMax 等實體的身分與行動歸因,依 Anthropic 公開威脅情報報告整理。不同案例的歸因信心並不相同,部分屬 Anthropic 的情報研判或指控,不能視為法院判決、政府正式承認或相關企業已承認事實。
報告收錄的是 Anthropic 認為最顯著、最新穎的案例,也不能拿來推算所有 Claude 使用者或全球 AI 濫用的比例。