根據外媒報導,部分與中國相關的使用者疑似透過Claude研究電子戰系統,甚至將模擬情境直接設定為台灣防空目標;此外,Anthropic也點名多家中國AI業者涉嫌大規模取得Claude回應,用於訓練自家模型。
Anthropic強調,相關案例並不代表所有使用者都具有傷害意圖,公司主要是依違反使用政策或服務地區規範進行處置,並將部分情資提供給主管機關及其他業者。
模型安全出現缺口 生物研究恐成AI新風險
Anthropic在報告中列出5起可能涉及生物武器風險的研究案例,其中3起未被既有安全分類器攔截,凸顯AI安全機制面對「雙重用途」研究時的限制。
其中一宗事件發生於2026年5月。Anthropic的生物安全系統攔下一份屈公病功能增益研究的補助申請,研究目的包括提升病毒傳播能力及免疫逃脫特性。申請資料顯示,提案人雖以民間研究者身分出現,但研究地點卻與軍方研究機構有關。
Anthropic進一步調查發現,相關帳號並非單純個人使用者,而是一個替數十名生命科學研究人員提供服務的轉售平台。該平台透過美國基礎設施規避地區限制,並利用零資料保留設定降低活動曝光;帳號遭封鎖後,又在短時間內重新建立帳號。
另一名研究人員則在數週內與Claude進行數千次互動,用於規劃、分析及解讀高致病性禽流感病毒的哺乳類適應實驗。由於安全限制,系統將其導向能力較低的模型,Anthropic認為實際提供的協助主要集中在文書及研究整理。
此外,還有痘病毒免疫逃脫研究的補助申請,以及兩起具有國家支持背景、涉及毒液與毒素改造的計畫。
Anthropic指出,部分案件之所以成功繞過分類器,是因為現行防護設計主要針對「讓使用者取得已知生物武器資訊」的情境,對於新型化合物或具有雙重用途的研究,辨識能力仍有限。
電子戰模擬改成台灣場景 12處防空目標遭列入
在常規武器相關案例中,Anthropic共揭露6起事件,其中3起與中國有關、2起來自俄羅斯,另1起則涉及葉門工程團隊。最受台灣關注的,是編號GTG-17002的中國案例。
Anthropic表示,相關使用者利用Claude開發一套約16個模組組成的電子戰軟體,功能涉及雷達與通訊系統的偵測、干擾及欺騙。開發過程中,該系統經過12次版本更新,模擬環境後來更被設定為台灣戰場。
報告指出,模擬目標共12處,包括指揮掩體、早期預警雷達站、愛國者及天弓飛彈陣地、主要空軍基地,以及一處戰區司令部。
相關測試還模擬愛國者、THAAD等防空飛彈系統的接戰範圍。Anthropic根據調查結果研判,該使用者可能與中國軍事科學院等研究機構存在關聯。
這類案例也顯示,AI協助軍事研究的門檻正在降低。過去需要大量人力與專業設備完成的模擬、程式開發及資料分析,如今可能透過大型語言模型加速。
俄羅斯AI無人機具辨識能力 葉門則測試遠程武器
俄羅斯相關案例同樣涉及軍事用途。Anthropic發現,有行動者利用AI打造FPV自殺式無人機系統,讓機載模型自行辨識「人員」等目標,再執行引爆指令,訓練資料則來自烏克蘭戰場影像。
另一組來自葉門北部的工程團隊,則同時推進導引火箭、多級彈道飛彈及搭載極音速滑翔載具的「R2000」系列計畫。其中一項導引火箭曾進行實際試射,但結果疑似未達預期。
俄羅斯駭客大量自動化 Claude被用於偵察與釣魚攻擊
網路攻擊方面,Anthropic點名一場與俄羅斯駭客組織Midnight Blizzard有關的行動。代號GTG-20006的行動鎖定超過20個烏克蘭及歐洲相關組織,包括政府單位、外交機構、國防承包商及無人機製造商等,累計取得數百GB資料。
Anthropic表示,駭客利用Claude將大量工作自動化,包括目標偵察、架設攻擊基礎設施及執行釣魚攻擊。當惡意程式遭到偵測後,行動者甚至要求Claude修改程式並重新部署,以嘗試躲避防護機制。
調查也發現,部分遭竊資料涉及大量個人及企業資訊,其中一個北非目標被取得超過30萬筆國民身分紀錄,以及50萬筆以上公司登記資料。
7家中國AI業者遭點名 大規模「蒸餾」Claude
除了軍事與網路安全風險,Anthropic此次報告另一項焦點,是中國AI業者涉嫌進行模型蒸餾。
Anthropic表示,自2026年2月起,公司陸續發現來自7家中國AI實驗室的非法蒸餾活動,包括阿里巴巴、月之暗面(Moonshot AI)、DeepSeek、智譜、小米、商湯及MiniMax。
所謂「模型蒸餾」,是利用能力更強的AI模型產生大量高品質資料,再拿這些資料訓練其他模型,以提升後者的能力。這項技術本身並非非法,但若未經授權大量取得競爭對手模型回應,就可能成為降低研發成本的捷徑。
其中規模最大的一起案例與阿里巴巴有關,Anthropic稱,相關行動者建立超過3500個虛假帳號,集中取得Claude高階模型的回應,高峰期每天產生近300萬次互動,從5月至7月累計超過1.51億次。
月之暗面同樣遭到點名,Anthropic指控,相關帳號曾將大量使用者請求轉送給Claude,再把產生的答案拿回自家模型使用。其中一個案例涉及近30萬筆請求。
敏感監控資料意外送進Claude 隱私疑慮升高
更受外界關注的是,部分被轉送的內容並非一般測試資料。Anthropic表示,曾發現一名Kimi使用者將中國監控資料上傳至相關服務,要求AI分析特定人士是否存在異常行為。由於請求最後被轉送到Claude,Anthropic因此接觸到原本預期由其他模型處理的資料。
其中甚至包含數百支監視攝影機的影像,部分畫面位於解放軍設施周邊。這也讓模型蒸餾爭議延伸出另一層問題,如果AI業者在未充分告知使用者的情況下,把輸入內容轉交第三方模型,不僅涉及技術競爭,也可能牽涉資料安全與個人隱私。Anthropic威脅情報主管Jacob Klein也指出,無論是Anthropic或競爭對手採取類似做法,都可能演變成嚴重的隱私問題。
中方否認指控 AI競爭成美中科技戰新戰場
對於Anthropic的指控,中國方面否認相關說法,並批評外界不應歪曲事實、對中國進行抹黑。中國商務部此前也曾表示,外界關於中國AI業者大規模蒸餾美國模型的指控缺乏事實及法律依據,若美方進一步採取限制措施,中方將作出反制。
不過從Anthropic此次公布的案例來看,AI競爭已不再只是模型參數、晶片或算力的較量。大型語言模型如今同時被投入網攻、軍事模擬、生物研究與情報分析,如何在提供高階AI能力的同時防止遭到武器化,已成為科技業者與各國政府必須面對的新課題。Anthropic也坦言,現有分類器並非萬無一失,尤其面對具有軍民雙重用途的研究時,單純依靠模型端的自動判斷,很難完全辨別研究目的。
因此公司提出的方向之一,是將部分高風險生物用途改採「可信任使用者審核」機制,讓高階能力的使用從單純依賴模型判斷,進一步轉向人工身分與用途核驗。AI從聊天工具走向軍事與國安領域的速度,或許已經比安全機制更新的速度更快。此次Anthropic報告,也再次揭開生成式AI被濫用後可能帶來的實際風險。


