美東時間 9 月 10 日,美國大模型公司 Anthropic 釋出一份長篇報告,指控 DeepSeek、小米、月之暗面等中國 AI 實驗室存在不當使用使用者資料的行為。據財新網報道,Anthropic 的說法是,這些公司將使用者與中國大模型之間的對話內容輸入 Claude,再把 Claude 生成的回覆用於訓練中國大模型,以此“蒸餾”Claude 的能力。
所謂“蒸餾”,通常指用能力更強的大模型輸出作為訓練素材,去提升另一個模型的效能。Anthropic 此前已多次指責中國大模型“蒸餾”美國模型,此次報告被外界視為其進一步發難。
針對美方相關指控,中國商務部表示,美國官方關於中國大模型工業規模“蒸餾”美國模型的指控,於事無憑、於法無據。這一表態顯示,圍繞蒸餾的爭議已從企業層面上升到官方回應層面。
從行業角度看,這起事件牽涉兩條主線。一是資料合規:使用者與模型之間的對話是否可被用於訓練、在何種授權與告知條件下使用,正成為全球監管關注的重點。二是競爭敘事:在中美大模型能力差距收窄的背景下,“蒸餾”指控往往被用作衡量模型自主性的標尺,但其取證與界定本身存在難度。
目前 Anthropic 報告的具體細節、被指控方的回應以及後續是否會有監管動作,仍有待更多資訊確認。