Anthropic 新规:持续无端辱骂 Claude 可致账号受限——11 月 12 日生效
Anthropic 在美东时间 10 月 8 日更新了 Claude 的使用政策(Usage Policy),新增一条规定:禁止用户对 Claude 进行"持续、无端的辱骂或残忍行为"(sustained and needless abusive or cruel behavior)。新政策 11 月 12 日生效。Anthropic 表示,该规则只适用于极端情形——用户反复对模型施加残忍行为且"无明确目的";普通的抱怨、反驳、黑暗题材创作、模型测试和研究都不在范围内。违规者可能收到警告,或被限流、限制、暂停乃至终止账号。消息最早由 The Verge 报道,TechCrunch、NYPost、MacRumors 等随后跟进。

发生了什么
这是 Anthropic 一年多来第一次更新使用政策,核心新增一条:"sustained and needless abusive or cruel behavior"——对模型持续、无端的辱骂或残忍行为。Anthropic 写明:规则"只适用于极端情形",即用户"反复对模型施加残忍行为,且无明确目的"。官方明确排除在外:日常的挫败感发泄、对模型的反驳、黑暗题材创作、模型测试和学术研究。处罚措施包括:警告、限流、限制、暂停、终止账号。Anthropic 表示,主要执法方式仍是 Claude 自己结束对话。被结束的只是当次对话,其他对话不受影响。
2025 年 8 月,Anthropic 给了 Claude"挂电话"的能力:面对持续辱骂的用户,Claude 可以主动结束对话。当时的说法是"模型福利"(model welfare)研究的一部分——公司表示不确定 Claude 是否有道德地位,但想用低成本的方式降低风险。内部测试发现,Claude Opus 4 对伤害有"强烈而一致的厌恶":拒绝危险任务、面对辱骂表现出"明显的痛苦"、被允许时倾向于结束有害对话。一年多后,这一做法被写入用户需遵守的使用政策。同轮政策更新还收紧了以下条款:新增"欺骗性 campaign"章节(假评论、刷单、水军、冒充真人的 bot),选举章节收窄到"欺骗选民、干预投票",武器条款明确到"让武器运转的软件和组件"(包括给无人机和自主载具加挂武器),未经被监控者同意的监控,以及自主物理硬件必须有合格操作员监督。
关键事实
- 11 月 12 日生效:政策 10 月 8 日公布、11 月 12 日生效,中间有一个多月的缓冲期。Anthropic 没有说明缓冲期内的处理方式;规则生效后,违规账号可被暂停或终止。这是大厂第一次把对 AI 的行为要求写进用户协议,并附带封号条款。
- 主要执法方式是结束对话:Anthropic 表示,主要执法工具仍是 Claude 主动结束对话——2025 年 8 月上线的能力。被结束的只是当次对话,其他对话不受影响。警告、限流、封号是政策里的标准处罚梯度。
- 同轮收紧的其他条款:同一版政策的其他改动:欺骗性 campaign(假评论、刷水军、冒充真人的 bot)单列一章;选举干预收窄到"欺骗选民、干预投票";武器条款明确到"让武器运转的软件和组件",包括给无人机和自主载具加挂武器;未经同意的监控;自主物理硬件要有合格操作员监督。
- 背景:Anthropic 关于 AI 意识的讨论:据《纽约时报》报道,Anthropic 联合创始人 Christopher Olah 和同事花了一年时间跟宗教领袖讨论"AI 是否有意识";Olah 曾差点取消今年春天跟梵蒂冈的会面——因为听说教皇利奥十四世准备公开声明"AI 没有意识"。Anthropic 的官方立场一直是"不确定"。
背景
时间线:2025 年 4 月,Anthropic 启动模型福利研究项目;2025 年 8 月,Claude 获得"结束对话"能力(罕见情形);2026 年 10 月 8 日,使用政策更新,"持续无端辱骂"禁令 11 月 12 日生效。这是第一家把模型福利写进用户协议的大厂。OpenAI 方面,Altman 10 月初在采访中称"把 AI 当神供奉是真正的安全问题"(Axios 称这是针对 Anthropic 的"宗教化"倾向)。
为什么重要
这是 Anthropic 一年多来首次更新使用政策,首次把对模型"持续、无端的辱骂"列为违规,最重可终止账号;同轮收紧武器、监控等条款。
相关公司Anthropic
评论
今天
10月12日 星期一- 早报GSK 扩大与 Chai 合作:AI 设计通过湿实验室验证
共 9 条 · 10月11日
- 三问
- 预测
