Anthropic 近日对旗下 AI 助手 Claude 的使用政策做了一次全面修订,新规定将于 2026 年 11 月 12 日正式生效。这次改动里,最引人注意的是条款中首次出现了"禁止持续且不必要的虐待或残忍行为"。除此之外,武器、监控、物理硬件三个高风险领域的规则也被扩容和细化。
一、首次写入:不准"持续且不必要"地虐待模型
这条规则针对的是没有明确目的、反复对模型实施残忍对待的情况。关键在"持续"和"不必要"两个词,偶尔发泄一下不算,毫无目的地反复折磨才算。
执行上,Anthropic 目前的处理方式是终止对话。至于以后会不会引入封禁账号等更重的措施,官方还没有明确表态。
公司同时强调,下面这些情况不受这条限制:
- 用户日常的抱怨、对模型表达不满
- 对模型的质疑
- 含有黑暗主题的文学创作
- 合规的模型安全测试与研究
也就是说,正常使用、吐槽两句、写黑暗题材小说、做安全测试,都不会被误伤。
二、武器禁令:从"武器本身"扩到"让武器运转的东西"
新规进一步扩大了武器相关禁令的适用范围,明确涵盖:
- 使武器正常运转的软件与组件
- 武装无人机和其他自主车辆的开发
Anthropic 透露,此前已经发现多起有人试图利用 Claude 开发武器指导或控制软件,这次修订有明显的针对性。
三、监控限制:不准偷偷追踪,也不准参与执法决策
监控条款这次写得更具体,主要有三点:
- 禁止未经同意追踪个人,无论是实时追踪,还是分析已有数据,都在禁止之列
- 禁止用 Claude 决定或建议执法与刑事司法程序中的调查、逮捕或起诉对象
- 禁止用 Claude 构建或改进任何监控工具
四、物理硬件安全:AI 控制设备,必须有人盯着
当 Claude 连接到可能对外界造成伤害的自主物理硬件时,新规要求必须有合格的操作人员在现场观察,并且能在必要时随时停止设备运行。
不过对于特定的政府客户,Anthropic 表示,只要合同限制和安全防护措施充分,可以对相关规则灵活调整。
五、谁会受影响
整体看,这次修订有两个方向:一是开始对用户与模型之间的互动方式提出要求,二是在武器、监控、实体设备等高风险领域把边界划得更清楚。
对普通用户来说,日常提问、写作、编程、吐槽都不会有变化。真正受影响的,主要是做武器相关开发、监控类产品,以及让 AI 控制实体设备的团队。新规生效前,相关从业者最好对照新条款检查一下自己的使用场景。