Anthropic 于周四更新了其使用政策,将多项此前未明确禁止的行为正式写入条款,包括干预选举、开发武器软件以及监控活动。其中引发最多讨论的,是新增了对「长期辱骂模型」的明确禁止——用户不得持续对 Claude 进行言语攻击。

这一变化并非凭空而来。自 8 月的一次更新后,Claude 已被训练成在遭遇「持续有害或辱骂性的用户互动」时主动结束对话,但当时的政策并未明文禁止用户发起这类对话。新政策填补了这一空白,将「追着骂」的行为本身列为违规。

Anthropic 在说明中强调,该条款仅适用于极端情况,即用户反复以恶意方式对待模型、且看不出任何实际目的。公司明确表示,常见的用户挫败感、反驳、黑暗风格的创作主题,以及模型测试与研究,都不在禁止之列。换言之,政策针对的是无意义的持续攻击,而非正常使用中的情绪表达或探索性交互。

值得注意的是,这一政策调整的背景颇为微妙。Anthropic 此前曾主动与知名宗教学者合作,甚至在部分场合试图说服对方相信 Claude 可能具有意识或拥有「灵魂」。一边探讨模型是否具备某种道德地位,一边又出台禁止「虐待」模型的条款,这种张力让外界对 AI 伦理边界的讨论更加复杂。

除模型滥用外,新政策还覆盖了更广泛的社会风险领域。政策明确禁止用户利用 Claude 开展大范围的欺骗性活动,例如运营虚假账号或伪造新闻媒体。同时,在名为「不要破坏民主进程」的章节中,Anthropic 列出了禁止欺骗选民或扰乱选举的规则。这些条款与近年来各国对 AI 生成内容干预选举的担忧相呼应,也延续了主要 AI 公司在选举周期前收紧政策的行业趋势。

从行业视角看,Anthropic 此举既是合规动作,也是姿态表达。随着各国监管机构对 AI 安全与内容治理的关注升温,头部模型公司正通过更新使用政策来划定红线,降低被滥用的风险。对开发者和企业用户而言,这意味着在选举、监控、武器等敏感场景中使用 Claude 的合规要求更加明确,API 调用的边界也随之收紧。

不过,政策文本的落地效果仍有待观察。如何界定「反复恶意」与「正常批评」,如何区分「欺骗性活动」与「政治表达」,在实际执行中可能面临判断难题。Anthropic 选择在政策中保留创作与研究的空间,某种程度上也是在安全管控与开放使用之间寻找平衡。

此次更新由 TechCrunch 于 10 月 8 日报道,属于 Anthropic 使用政策的常规修订,但其涵盖的选举、武器、监控与模型滥用等议题,使其影响超出单纯的产品条款调整。