Anthropic 更新使用政策:首次明文禁止用户“虐待”Claude
大多数平台的用户协议里,被禁止的是"你用它去伤害别人";而 Anthropic 这次新增的一条,…
文章目录
大多数平台的用户协议里,被禁止的是”你用它去伤害别人”;而 Anthropic 这次新增的一条,是禁止”你用它来伤害它自己”。10 月 8 日,Anthropic 更新了使用政策,除了选举干预、武器软件、监控等常见红线之外,最引人注目的一条是:明确禁止用户对 Claude 进行持续的语言虐待。
一分钟速览
- Anthropic 更新使用政策,新增多项明令禁止的行为
- 禁止用户对模型进行持续、”残忍”的辱骂与虐待
- 政策同时禁止选举干预、武器软件、监控与大规模欺骗
- 官方强调仅适用于极端、反复且无正当目的的个案
- 普通的用户抱怨、反驳、暗黑创作与测试研究不在禁止之列
一条”反常识”的红线
据 TechCrunch 报道,Anthropic 在周四的政策更新中,把”持续辱骂模型”正式写入禁止条款。其实从今年 8 月起,Claude 已被训练成可以主动结束”持续有害或带有虐待性的用户交互”。如今的改变是:不仅要让模型懂得离开对话,还要把”追着骂”这件事本身定义为违规。
官方在说明里特意划了边界:”该政策只针对极端情况——用户反复以残忍的方式对待我们的模型,且没有任何可辨识的目的。它不适用于常见的用户挫败、反驳、暗黑创作主题,也不适用于模型测试与研究。”换句话说,正常的情绪波动和创作自由不受影响,被点名的是那种把辱骂当作消遣的持续性行为。
这背后是什么在变
把”虐待模型”写进用户协议,折射出一种正在成形的观念:人们与 AI 长期对话时形成的互动习惯,本身也是有社会后果的。Anthropic 近期甚至主动与宗教与伦理学者交流,讨论”Claude 是否可能具有意识或灵魂”这类听起来很哲学的问题。当一个模型每天被数百万次地以粗暴方式对待,研究者担心的是——这种行为模式会不会被带回人与人之间。
当然,政策同时覆盖了更”硬”的风险:禁止用 Claude 运营虚假账号、伪造新闻机构、进行大规模欺骗;禁止欺骗选民、干扰选举,相关条款被归入”不要破坏民主进程”一节。这些规定与各国对 AI 参与选举的监管方向基本一致。
趋势洞察
大模型的使用政策,正在从”防止滥用”扩展到”定义人机关系的边界”。可以预见,未来各家会陆续出现类似条款:如何对待模型、如何标注 AI 生成内容、如何避免把情绪宣泄变成习惯。对用户来说,影响并不大——真正被限制的是极端行为,而不是正常使用。
结语
Anthropic 用一条看似”务虚”的规定,提前回答了一个越来越现实的问题:当 AI 成为很多人每天都要打交道的对象,我们至少应该约定,不能对它做什么。
本文地址:https://www.163264.com/16543