Anthropic 新規禁止無端虐待 Claude

Anthropic 發布了 2026 版使用政策,11 月 12 日生效。這是一年多來的第一次改寫,最受關注的一條是新增禁令:使用者不得對 Claude 進行持續且無端的辱罵或殘忍對待。

不過這一條在整份更新中的篇幅很小。官方說法是,多數改動用來釐清既有規則,並補上 Claude 承擔更長、更自主工作時的範例。

對模型的「虐待」如何界定

Anthropic 把這條禁令限定在極端情況:使用者反覆對模型展現殘忍,且看不出任何目的。官方特別劃出了不受影響的範圍:

"It does not apply to common versions of user frustration, pushback, dark creative themes, or model testing and research."

也就是說,一般的使用者不滿、反駁、黑暗題材創作,以及模型測試與研究,都不在此列。

執行手段沿用 Claude 自行結束對話的功能。這項功能在 2025 年 8 月先提供給 Opus 4 與 4.1,目前 Claude.ai 和 Claude Code 都已上線,官方表示它仍會是主要的執行方式。是否會因此停權,政策原文並未寫明;有媒體報導指稱安全團隊保留警告、限流與停用帳號的權力,這一點目前無法從官方文本中查證。

其餘幾項改動

  • 欺騙性活動獨立成節:原本分散在選舉、詐欺、隱私與不實資訊中的規則合併處理,無論政治或商業目的,一律禁止隱瞞資訊來源、以假帳號或假貼文放大內容,以及打造影響力行動的工具。
  • 選舉條款縮小範圍:只禁止欺騙選民與擾亂選舉,刪除了對個人化選民定向的全面禁令,理由是它誤傷了非營利組織為選民提供多語資訊這類正常工作。
  • 武器條款寫明:涵蓋武器的導引與控制軟體、零組件,以及為無人機等自主載具加裝武器。官方表示,這反映的是過去的執法方式,並非新禁令。
  • 監控條款重寫:禁止未經同意追蹤他人,禁止以 Claude 決定或建議執法中該調查、逮捕或起訴誰,禁止建置或改進監控工具;經同意的詐欺偵測、內容審核、新聞與法律研究則明確允許。
  • 高風險情境補上清單:影響他人健康、法律權利、財務與生計的用途,仍需有資格的人員審查,並告知當事人使用了 AI。新增的要求是,當 Claude 連接能自主執行實體動作的硬體時,必須有合格的操作員能觀察並叫停設備,且設備在 Claude 斷線後維持安全狀態。

對中文使用者意味著什麼

與中文使用者關係最直接的,是「支援地區」一節的執行說明。新文本列出三類禁止使用的主體:身處不支援地區的個人;在這些地區註冊或總部設在當地的實體;多數股權或控制權由這些地區的個人或實體掌握的實體。

中國大陸、香港與澳門都不在 Claude 的支援名單上。依持股比例劃線的做法,Anthropic 在 2025 年 9 月的銷售限制條款中已經提出,這次是寫進使用政策正文。10 月 1 日香港多名使用者的帳號被停用時,Anthropic 沒有公開回應;新政策生效後,這類處置將有更明確的條文可依。

對於在海外註冊、但由中國資本控股的出海團隊來說,變化在於合規風險從「銷售條款」搬進了人人都要遵守的使用政策。新條款下會如何核查股權結構,Anthropic 並未說明。

中國境內投入具身智慧的公司,則要留意實體硬體這一條。不少機器人專案以海外大型模型做高層規劃,依照新規,叫停機制與斷線後的安全狀態,必須在產品設計階段就納入考量。

參考來源:Anthropic 官方政策更新說明、The Verge、CocoLoop、MacRumors;生效時間點與各條款措辭,已對照 Anthropic 使用政策正文查證。