该政策涉及武器、监控、选举、高风险决策和连接硬件系统等不同场景。了解其范围,有助于团队区分对现有规则的进一步说明与新提出的义务。Anthropic 在10月8日的公告中表示,11月12日修订的大部分内容是澄清或重新组织现有规则,同时指出两项新规定:禁止持续且无必要地虐待其模型,以及要求连接到可能造成伤害的自主行动的硬件符合安全要求。

最明确的新增规定是禁止对 Anthropic 的模型实施“持续且无必要的辱骂或残酷行为”。Anthropic 表示,此规定针对用户反复以残酷方式行事且看不出任何目的的极端情况。一般的挫折表达和质疑、黑暗题材创作、模型测试及研究均不在适用范围内。公司还称,Claude.ai 和 Claude Code 现有的功能——在少数持续遭受辱骂的对话中结束对话——仍将是执行这条规则的主要方式。公告没有说明这项新规定还会带来哪些其他执行后果。

几项改动让现有限制更加明确。Anthropic 表示,原有武器规则已经禁止使用 Claude 开发武器;修订文本明确涵盖武器运行不可或缺的软件和部件,也包括为无人机及其他自主车辆装载武器等行为。公司称,这种表述反映了其对旧政策的执行方式。

重写后的监控与刑事司法章节规定,未经同意追踪他人属于禁止行为,无论是实时追踪,还是分析先前收集的数据。该章节还禁止使用 Claude 决定或建议调查、逮捕或起诉哪些人,以及构建或改进监控工具。Anthropic 称这些修订是对既有执行规则的进一步明确,并将基于同意的追踪、欺诈监控、内容审核、新闻报道和法律研究列为允许的示例。

选举规则的范围有所收窄,另设一节汇总针对欺骗性宣传活动的限制。Anthropic 表示,原先分散在选举、欺诈、隐私和虚假信息章节中的限制,现在归入“不得参与欺骗性宣传活动或人为活动”。该节涵盖隐瞒信息发布者身份、通过虚假账号或帖子扩大内容传播,以及为政治或商业影响力行动搭建基础设施。

选举章节更名为“不得破坏民主进程”,重点是欺骗选民或扰乱选举,包括散布有关候选人或投票的虚假信息、冒充候选人或选举官员,以及压低投票率。Anthropic 还删除了对个性化投票和竞选定向的一概禁令。公司称,该规则原本也涵盖了翻译选民信息或发送选票补正通知等正当公民工作。依赖欺骗或滥用个人数据的定向行为,仍受其他章节禁止。

Anthropic 表示,高风险用途的基本要求并未改变。如果 Claude 的输出可能影响某人的健康、法律权利、财务状况、生计或获得基本服务的机会,就必须由具备资质的人类审核,并在必要时有权更改建议;受影响者还必须被告知使用了人工智能。针对用户提出的问题,修订文本列出了哪些建议属于适用范围、哪些不属于。

更新还为连接到可自主执行物理操作且可能造成伤害的硬件的模型增加了控制措施。具备资质的操作人员必须能够观察设备,并在需要时将其停止;如果 Claude 断开连接,设备必须能够保持在安全状态。这些要求针对 Claude 周边的系统配置,并不表示模型本身控制任何特定设备。

Anthropic 表示,其《支持地区政策》也得到了澄清。公司称,身处不受支持地区的个人、在这些地区注册或设有总部的实体,以及多数股权由这些地区的个人或组织持有或控制的实体,均不得使用 Claude。

用户和组织可查阅 Anthropic 的 使用政策,并在11月12日之前检查自己的工作流程是否涉及列出的用途。本文仅审阅公开文件;BIG CHANGE 未测试账号层面的政策执行或任何模型行为。Anthropic 的公告解释了公司对这些修订的看法,但无法说明未来每种情况将如何评估。

重大变化

Anthropic 表示,11月12日的更新明确新增两项规定:禁止持续且无必要地虐待其模型,并为连接到可能造成伤害的自主行动的硬件设置保障措施。对于硬件,具备资质的操作人员必须能够观察设备,并在需要时将其停止;如果 Claude 断开连接,设备必须能够保持安全状态。Anthropic 称,其他大多数修订是对现有限制的澄清或重新组织。在选举、监控、武器相关工作、高风险决策或连接硬件系统中使用 Claude 的团队,应在生效日期前对照修订后的政策文本检查自身做法。

来源与延伸阅读