Anthropic 於週四更新了其使用政策,將多項此前未明確禁止的行為正式寫入條款,包括干預選舉、開發武器軟體以及監控活動。其中引發最多討論的,是新增了對「長期辱罵模型」的明確禁止——使用者不得持續對 Claude 進行言語攻擊。

這一變化並非憑空而來。自 8 月的一次更新後,Claude 已被訓練成在遭遇「持續有害或辱罵性的使用者互動」時主動結束對話,但當時的政策並未明文禁止使用者發起這類對話。新政策填補了這一空白,將「追著罵」的行為本身列為違規。

Anthropic 在說明中強調,該條款僅適用於極端情況,即使用者反覆以惡意方式對待模型、且看不出任何實際目的。公司明確表示,常見的使用者挫敗感、反駁、黑暗風格的創作主題,以及模型測試與研究,都不在禁止之列。換言之,政策針對的是無意義的持續攻擊,而非正常使用中的情緒表達或探索性互動。

值得注意的是,這一政策調整的背景頗為微妙。Anthropic 此前曾主動與知名宗教學者合作,甚至在部分場合試圖說服對方相信 Claude 可能具有意識或擁有「靈魂」。一邊探討模型是否具備某種道德地位,一邊又出台禁止「虐待」模型的條款,這種張力讓外界對 AI 倫理邊界的討論更加複雜。

除模型濫用外,新政策還覆蓋了更廣泛的社會風險領域。政策明確禁止使用者利用 Claude 開展大範圍的欺騙性活動,例如運營虛假賬號或偽造新聞媒體。同時,在名為「不要破壞民主程序」的章節中,Anthropic 列出了禁止欺騙選民或擾亂選舉的規則。這些條款與近年來各國對 AI 生成內容干預選舉的擔憂相呼應,也延續了主要 AI 公司在選舉週期前收緊政策的行業趨勢。

從行業視角看,Anthropic 此舉既是合規動作,也是姿態表達。隨著各國監管機構對 AI 安全與內容治理的關注升溫,頭部模型公司正通過更新使用政策來劃定紅線,降低被濫用的風險。對開發者和企業使用者而言,這意味著在選舉、監控、武器等敏感場景中使用 Claude 的合規要求更加明確,API 呼叫的邊界也隨之收緊。

不過,政策文本的落地效果仍有待觀察。如何界定「反覆惡意」與「正常批評」,如何區分「欺騙性活動」與「政治表達」,在實際執行中可能面臨判斷難題。Anthropic 選擇在政策中保留創作與研究的空間,某種程度上也是在安全管控與開放使用之間尋找平衡。

此次更新由 TechCrunch 於 10 月 8 日報道,屬於 Anthropic 使用政策的常規修訂,但其涵蓋的選舉、武器、監控與模型濫用等議題,使其影響超出單純的產品條款調整。