跳到主内容

Anthropic 发布 2026 版使用政策:11-12 生效,新增「欺骗性活动」专章并首次禁止针对模型的虐待行为

Anthropic 于 2026-10-08 发布新版 Usage Policy,2026-11-12 生效:新增「禁止欺骗性活动与人造流量」专章、收窄选举条款、武器禁令扩展到制导软件、明确高风险场景人工复核要求,并首次禁止针对模型本身的持续虐待行为。

2026-10-11 · Anthropic 官方新闻(2026-10-08,一手核对原文)

发布 2026-10-11核实 2026-10-11

要点

  • 发布时间与生效时间分开:Anthropic 于 2026-10-08 发布 2026 版 Usage Policy,2026-11-12 正式生效。中间留了一个月的缓冲期——现在就该对照自查,不是等 11 月中旬。
  • 新增专章「Do Not Engage in Deceptive Campaigns or Artificial Activity」:把原先散落在选举、欺诈、隐私、虚假信息四节里的规则合并成一条,覆盖任何性质的欺骗性活动(无论政治或商业)——隐藏信息发布者身份、用假账号或假帖放大内容,以及为影响行动搭建工具与基础设施。
  • 选举条款改名并收窄:原「禁止个性化投票与竞选定向」的一刀切禁令被删除(它误伤了非营利组织用 Claude 把投票信息翻译成其他语言、选举官员发送选票补正通知这类正当公民工作);条款改名为 Do Not Undermine Democratic Processes,只针对欺骗选民或扰乱选举本身。
  • 武器禁令扩展到「让武器运转起来的软件与组件」:官方明确点名制导与控制软件、为无人机或其他自动驾驶载具装弹这类行为。官方强调这不是新增管控,而是把既往执法口径写清楚。
  • 监控与执法条款重写:未经同意的追踪被禁止(无论实时还是对既有数据的分析);Claude 不得在执法或刑事司法流程中决定或建议侦查、逮捕、起诉对象;也不得用于构建或改进监控工具。同时明确列出仍然允许的用途:用户同意的追踪(如欺诈监测)、内容审核、新闻调查、法律研究。
  • 高风险场景要求写得更直接:影响他人健康、法律权利、财务、生计或基本服务获取的用途,仍要求有合格的「human in the loop」,且必须告知当事人 AI 参与。新版本直接列出了「哪些建议属于覆盖范围、哪些不属于」。
  • 连接硬件的自主物理行动新增要求(承接 Model Hardware Standard):合格操作员必须能观察设备并在需要时停机;Claude 断连后设备必须能保持安全状态。
  • 首次禁止针对模型本身的虐待:新增对持续性、无必要的虐待或残忍对待模型的禁止。官方明确例外包括:普通沮丧情绪、反驳、黑暗向创作主题,以及模型测试与研究。主要执法手段仍是终止极少数 abusive 对话。

来源层级:以上全部内容来自 Anthropic 官方新闻页 2026 Usage Policy update(2026-10-08 发布),本站逐段核对原文,属一手来源。

背景与分析

这不是一次「收紧」,而是一次「把已经变长的作业写进说明书」

官方在开头就把动机说清楚了:过去一年 Claude 接手了更长、更独立的工作(这也是 Claude Code 与各类 agent 平台的主线),旧条款里那些按「人机对话」场景写的例子已经不够用。所以这次更新大部分是为了澄清既有规则,而不是新增禁令——武器与监控两节官方都专门加了一句「这并不改变我们实际执法的内容」。

真正新增的只有三块:

新增内容对开发者的实际影响
欺骗性活动专章影响行动的工具链也在禁止范围内——不只是「发假帖」,写发假帖的基础设施同样违规
硬件自主物理行动要求做机器人 / 设备控制的团队需要证明「人能停机、断连能保安全状态」
虐待模型条款红队测试与研究被明确豁免,不用担心正常的安全研究踩线

对用 Claude 做 agent 的团队,三条最该马上检查

① 「human in the loop」的定义被写死了。 官方原文要求是有权审阅并在必要时修改 Claude 建议的合格人(someone who has the authority to review and, if necessary, change Claude's recommendations),并且要告知受影响个人 AI 参与了决策。只是「页面上有人点了个确认」不算——这个人得有权限改,且改得动。

② 别再把「自动化」当成免责理由。 监控条款里最容易被忽略的一句是:Claude 不得用于决定或建议侦查、逮捕、起诉对象。很多团队做的「风险评分 + 建议处置」类 agent,如果下游是人来做决定,看着没问题;但如果输出的措辞是「建议立案」,就已经踩到边界。

③ 影响行动的工具化是新增红线。 过去这类判断多落在「内容」上,新条款明确把为影响行动搭建工具与基础设施写进禁止范围。做增长工具、舆情工具、批量内容工具的团队需要重新审视自己的客户场景。

选举条款的「减法」值得单独说

删除「禁止个性化投票与竞选定向」这条一刀切禁令,是一次少见的放松。官方给出的理由很实在:这条规则误伤了非营利组织用 Claude 把投票信息翻译成其他语言、选举官员发送选票补正通知这类正当公民工作。真正需要禁止的行为(基于欺骗的选民定向、滥用选民个人数据)在欺骗性活动、监控、隐私三节里仍然被覆盖。

这个改动对国内开发者也有参照意义:合规条款写得太宽,最后伤的往往是正当用途;正确的做法是把要禁止的具体行为写清楚,而不是把整个领域划掉。

AI 之家 观点

  • 「执法口径没变,只是写清楚了」这句话本身就是重要信息。 它意味着:如果你的产品此前依赖「条款没写所以不违规」的解释空间,那这个空间从 11-12 起会明显收窄。合规评估要按新条款的明文,不能按旧条款的沉默。
  • 一个月缓冲期是给我们做代码与流程改造的,不是给法务走流程的。 尤其是硬件自主行动这一条——「断连后能保持安全状态」是工程要求,不是文档要求,需要真实改造控制回路。
  • 红队与研究被显式豁免,是这次更新里最值得肯定的部分。 在多家厂商把「安全研究」模糊化的当下,Anthropic 明确把模型测试与研究写进虐待条款的例外,对安全社区是实质性利好。
  • 对本站的提醒:涉及 Claude 的能力与限制描述,本站一律以官方页面为准;政策类内容具有强时效性,本站会按 11-12 生效节点再复核一次实际文本是否有细微调整。

待核实

  • 完整政策正文的细节差异:本文基于 Anthropic 官方新闻页的变更说明撰写;完整 Usage Policy 与 Supported Regions Policy 全文在各自独立页面,本站未逐条比对新旧全文,若你的场景处于边界,请直接读全文原文。
  • 地域差异:Supported Regions Policy 与本次更新独立成页,本次未核对,不同地区可用性与条款适用性可能有差异。
  • 虐待条款的执行口径:官方称主要手段是「终止极少数 abusive 对话」,但未公布判定阈值与申诉路径。

来源

相关对比

Aider vs Claude Code:终端 AI 编程双雄怎么选

Aider vs Claude Code 2026 选型对比:开源 BYOK 多模型 vs Anthropic 订阅长任务 Agent,从编程能力、多模型支持、价格、Git 集成、国内可用性和适合人群判断,帮你选对终端 AI 编程工具。

Claude Code vs Cline:CLI AI Agent 怎么选?2026 对比

Claude Code vs Cline 2026 选型对比:Anthropic 官方闭源 CLI Agent vs Apache-2.0 开源 VS Code 插件。从模型绑定、工作流、MCP 支持、价格、隐私和适合人群 6 个维度帮你选对 CLI AI 编程工具。

Claude Code vs Codex CLI:终端 AI Agent 双雄对比

Claude Code vs Codex CLI 2026 选型对比:Anthropic 与 OpenAI 两大官方终端 Agent 的模型、长任务、MCP 生态、Windows 支持、订阅打包价格和国内可用性全方位对比,帮你判断该用哪个终端 AI Agent,以及能不能两个一起用。

Claude Code vs Crush:Anthropic 官方 vs 多模型 TUI(2026 实测选型)

Claude Code vs Crush 怎么选:Anthropic 官方 CLI(长任务最稳),对上 Charmbracelet 开源 TUI(多模型切换 + LSP)。按模型、长任务、价格对比。

Cursor vs Claude Code:什么时候用哪个?(2026 实测选型)

Cursor 和 Claude Code 到底怎么选?一句话结论 + 决策树 + 价格实测 + 国内可用性对比。GUI 派选 Cursor,终端长任务派选 Claude Code,最优解其实是共存。

Devin vs Claude Code:AI 编程 Agent 怎么选?异步自主 vs 终端同步对比

Devin vs Claude Code 2026 选型对比:Cognition 异步自主 Cloud Agent vs Anthropic 终端同步 CLI Agent,从形态、工作模式、长任务能力、并发、价格、中文支持和适合人群 8 个维度判断,帮你选对 AI 编程 Agent。

相关评测