Anthropic公佈的新威脅報告,最引人注目的當然是中國模型公司大規模提取Claude能力。阿里被指在三個月內製造超過一點五億次交互,用Claude的推理過程訓練Qwen;Kimi與DeepSeek則被指把部分真實用戶請求秘密轉給Claude,再收集回答用於訓練。
若被轉送的只是數學題、編程題或公開資料,還可以找到不少溫和解釋:測試競爭對手、補充訓練數據、降低研發成本,或者在少數困難任務上調用更強模型。蒸餾本來也是正常技術,只是手段是否合法、是否違反服務條款的問題。
可是報告中出現了解放軍相關監控資料、公安系統數據、中國國企內部代碼,甚至俄羅斯國防機構數據庫的有效憑證。事情到了這一層,許多解釋便站不住了。
總不能說,中國模型已經達到Claude的水平,只是為了做幾個無關緊要的實驗,順便冒險把軍方資料送進一家美國公司的伺服器。更不能說企業有意出賣國家利益。對中國公司而言,這不只是商業醜聞,而可能觸及數據出境、國家安全與保密責任。明知內容涉及軍警仍然主動轉送,近乎政治自殺。
更合理的解釋是,這套轉發已經進入真實產品流程,並由系統自動運行。平台可能識別出某項請求屬於複雜編程、長程推理或智能體任務,便將它送給Claude,卻沒有先判斷其中是否含有軍事資料。公司追求的是Claude的高質量回答,以及由真實任務產生的珍貴訓練數據;至於用戶輸入了什麼,數據最終去了哪裏,安全部門或者不知道,或者根本攔不住。
這個解釋並不能替涉事公司減輕責任,反而暴露出更嚴重的問題:它們為了追趕美國模型,建立了一條規模巨大、未經用戶知情同意、連軍警資料都擋不住的境外數據管道。
這也為判斷中國模型的真實水平提供了罕見證據。公開排行榜可以優化,標準化題目可以針對訓練,普通聊天的差距也容易隱藏。可是企業願意承擔如此嚴重的泄密風險,說明Claude提供的並不是可有可無的兩分改善。如果自家模型已經能夠穩定完成同類任務,何必動用數千個欺詐賬號,持續提取上億次交互?何必把真實用戶請求轉給競爭對手,再冒充自己的回答?
這不能證明中國模型一無是處。它們在中文寫作、普通問答、數學和短代碼任務上,可能確實已經接近美國前沿模型。真正的差距,更可能集中在複雜軟件工程、長程任務、工具調用、錯誤修正和智能體可靠性上。恰恰是這些難以用一張排行榜顯示的能力,決定模型能否承擔真正的生產工作。
軍方資料的泄露,還帶來另一重損失。美國公司看到的未必只是一份文件。工程師反覆詢問什麼問題、代碼卡在哪一步、使用什麼硬件、連接什麼數據庫,都能反向暴露項目方向、技術瓶頸和組織關係。這是一種需求側情報,有時比正式報告更有價值。
當然,Anthropic掌握日誌,也有打擊競爭對手的商業動機;具體歸因仍需更多獨立證據。但如果報告的基本事實成立,業界過去對中國模型能力的評估就必須下調。不是說它們沒有能力,而是不能再把經過蒸餾、秘密調用乃至實時轉發形成的產品表現,全部計算為獨立自主能力。
最諷刺的地方正在這裏:中國企業原想從Claude那裏偷師,結果不但讓Claude看見了自己的訓練需求,也讓它看見了本國軍警系統正在做什麼。它們未必想出賣國家利益,只是太想得到Claude的能力,終於把國家利益也一起送進了管道。這種代價,反過來正是能力差距最有分量的證詞。

















