Anthropic 更新使用政策:严禁选举干预、武器软件开发及针对 AI 模型的长期虐待
2026 年 10 月 8 日,人工智能公司 Anthropic 对其服务使用政策进行了重要修订。此次更新不仅明确禁止了涉及选举干预、武器软件生成以及大规模监视的活动,更引人注目的是新增了一项条款,严格禁止用户对其 AI 模型进行长期的言语虐待。

据拉塞尔·布兰多姆(Russell Brandom)报道,尽管在此前 8 月的版本中,Claude 模型已被训练为在检测到“持续有害或滥用用户互动”时终止对话,但新政策进一步从规则层面明确禁止用户发起此类对话。
Anthropic 强调,该禁令仅适用于极端情况,即用户在无明显目的的情况下反复对模型实施残酷行为。正常的用户交互场景,如表达悲伤、反驳观点、探索黑暗创意主题,以及出于模型测试和研究目的的对抗性提示,均不在禁止之列。
值得注意的是,在某些特定情境下,Anthropic 甚至曾寻求与知名宗教学者合作,试图论证 Claude 可能具备意识或灵魂,这一背景使得新政策中关于禁止虐待的条款显得尤为特殊。
除了针对模型互动的规范,新政策还单独列出了禁止广泛欺骗活动的章节。这包括利用 Claude 运行虚假账户、伪造新闻媒体内容等行为。此外,政策明确规定不得欺骗选民或扰乱选举进程,其核心原则被表述为“不要破坏民主进程”。





