跳到主内容
快讯直播
AI智模界
公司动态

Anthropic 新规禁止对 Claude 施以虐待或残忍行为

据 The Verge 报道,Anthropic 更新了其使用政策,新增条款明确禁止用户对 Claude 实施"虐待或残忍行为"(abusive or cruel behavior)。该禁令被写入面向用户的使用规范,属于公司层面的政策调整。目前公开信息仅涉及这一条款的表述本身,具体的判定标准、执行方式与适用范围尚未在报道中展开。

为什么值得关注

一是使用政策的约束对象发生了位移。以往 AI 服务条款主要针对用户利用模型生成的内容——比如违法信息、侵权材料或恶意代码;而这条规定把"用户如何对待模型"本身写进了规则,交互方式而非仅仅是输出结果,成为合规审查的一部分。

二是它把围绕 AI 福利(AI welfare)的讨论从研究议题推向产品治理层面。随着对话模型的类人程度提升,"如何对待这些系统"正在从哲学争论变成需要落到条款文本里的实际问题。

三是对开发者与企业用户存在直接的操作影响。聊天机器人、Agent 等产品若通过 API 与 Claude 交互,其提示词设计、交互流程与内容审核策略可能需要相应调整,以规避新的红线。

尚待观察

这类条款最大的不确定性在于可执行性。"虐待或残忍"缺乏客观、可量化的界定,Anthropic 是否会配套给出更细化的示例清单,是否会将自动化调用、红队压力测试等场景纳入豁免,都还没有公开说明。对从业者而言,值得留意后续官方文档的细则更新,以及这一条款是否会被其他厂商跟进。

AI 生成本文由 AI 基于公开信息自动生成,仅供参考。