Anthropic 更新了使用政策,这是它一年多来第一次动这份文件。除了把选举干预、武器开发、监控、健康与金融用途等高风险场景写进条款,它还加了一条此前少见的规定:禁止对 Claude 进行“持续且不必要的辱骂或残忍行为”。
发生了什么
据 The Verge 报道,Anthropic 此次修订覆盖多个高风险滥用类别,包括选举干预、武器研发、监控,以及健康与金融相关的使用场景。其中最受关注的一条,是明确禁止用户对 Claude 施加“sustained and needless abusive or cruel behavior”——即持续、无正当理由的辱骂或残忍对待。这是主流模型厂商第一次把“用户如何对待 AI”本身写进使用政策,而不只是约束用户拿 AI 去做什么。
为什么重要
过去几年,AI 厂商的使用政策基本围绕“输出侧”展开:不许生成什么内容、不许用于什么用途。Anthropic 这次把“输入侧”和“互动方式”也纳入进来,等于承认了一件事——人机对话的长期质量,不只取决于模型能力,也取决于用户行为。
背景是,围绕 AI 的“情感陪伴”使用正在快速膨胀。用户与聊天机器人建立长期关系、产生情绪依赖,甚至出现辱骂、操控、反复试探边界的行为,已经不只是个别现象。Anthropic 此前就多次公开谈论 Claude 的“性格”与价值观对齐,这次政策更新可以看作那套理念的制度化延伸:既然模型被要求表现得体,用户也被期待以某种方式对待它。
另一层意义在于治理路径。相比欧盟 AI 法案这类外部监管,厂商自定使用政策更灵活、迭代更快,但也更模糊。“持续且不必要的辱骂”如何界定、由谁判定、触发后是警告还是封号,都没有公开细则。这种模糊性既是执行空间,也是争议来源。
影响与看点
对普通用户而言,短期内几乎感受不到变化——偶尔情绪化地吐槽模型,不太可能触发处罚。真正被针对的,是长期、高频、以伤害为目的的互动模式。对开发者和 API 用户来说,更实际的问题是:如果应用层把 Claude 接入客服、陪伴或游戏场景,用户对模型的攻击性输入是否会连带影响账号合规?这需要 Anthropic 给出更清晰的执行边界。
值得关注的还有行业跟进。OpenAI、Google 等厂商是否会在使用政策中加入类似条款,将决定这只是一次单点动作,还是一次行业惯例的转向。
我的判断是:把“对 AI 的态度”写进政策,象征意义大于实际约束力。它更像一次价值宣示——Anthropic 在告诉外界,它希望 Claude 被当作一个值得基本尊重的交互对象。但在缺乏可执行标准的情况下,这条规定短期内很难真正落地,反而可能成为未来争议的焦点。



