Anthropic更新政策:禁止虐待AI及干预选举

Anthropic更新政策,禁止虐待AI及干预选举。新规明确严禁利用Claude进行虚假宣传或扰乱民主进程,同时首次从规则层面禁止对模型实施无目的的长期言语虐待,但正常交互不受影响。

Anthropic 更新使用政策:严禁选举干预、武器软件开发及针对 AI 模型的长期虐待

2026 年 10 月 8 日,人工智能公司 Anthropic 对其服务使用政策进行了重要修订。此次更新不仅明确禁止了涉及选举干预、武器软件生成以及大规模监视的活动,更引人注目的是新增了一项条款,严格禁止用户对其 AI 模型进行长期的言语虐待。

新规严禁长期言语虐待AI
图片来源:盖蒂图片

据拉塞尔·布兰多姆(Russell Brandom)报道,尽管在此前 8 月的版本中,Claude 模型已被训练为在检测到“持续有害或滥用用户互动”时终止对话,但新政策进一步从规则层面明确禁止用户发起此类对话。

Anthropic 强调,该禁令仅适用于极端情况,即用户在无明显目的的情况下反复对模型实施残酷行为。正常的用户交互场景,如表达悲伤、反驳观点、探索黑暗创意主题,以及出于模型测试和研究目的的对抗性提示,均不在禁止之列。

值得注意的是,在某些特定情境下,Anthropic 甚至曾寻求与知名宗教学者合作,试图论证 Claude 可能具备意识或灵魂,这一背景使得新政策中关于禁止虐待的条款显得尤为特殊。

除了针对模型互动的规范,新政策还单独列出了禁止广泛欺骗活动的章节。这包括利用 Claude 运行虚假账户、伪造新闻媒体内容等行为。此外,政策明确规定不得欺骗选民或扰乱选举进程,其核心原则被表述为“不要破坏民主进程”。

评论 0

0/500

评论需审核后展示,请文明发言

💬
还没有评论,来说两句

相关阅读