美东时间 9 月 10 日,美国大模型公司 Anthropic 发布一份长篇报告,指控 DeepSeek、小米、月之暗面等中国 AI 实验室存在不当使用用户数据的行为。据财新网报道,Anthropic 的说法是,这些公司将用户与中国大模型之间的对话内容输入 Claude,再把 Claude 生成的回复用于训练中国大模型,以此“蒸馏”Claude 的能力。
所谓“蒸馏”,通常指用能力更强的大模型输出作为训练素材,去提升另一个模型的性能。Anthropic 此前已多次指责中国大模型“蒸馏”美国模型,此次报告被外界视为其进一步发难。
针对美方相关指控,中国商务部表示,美国官方关于中国大模型工业规模“蒸馏”美国模型的指控,于事无凭、于法无据。这一表态显示,围绕蒸馏的争议已从企业层面上升到官方回应层面。
从行业角度看,这起事件牵涉两条主线。一是数据合规:用户与模型之间的对话是否可被用于训练、在何种授权与告知条件下使用,正成为全球监管关注的重点。二是竞争叙事:在中美大模型能力差距收窄的背景下,“蒸馏”指控往往被用作衡量模型自主性的标尺,但其取证与界定本身存在难度。
目前 Anthropic 报告的具体细节、被指控方的回应以及后续是否会有监管动作,仍有待更多信息确认。