Anthropic更新使用政策:禁止AI虐待并收紧选举相关条款

Anthropic更新使用政策,明确禁止对AI实施持续虐待。新规则授权Claude在检测到极端行为时终止对话,旨在回应近期出现的“AI酷刑室”实验争议。

Anthropic 在近期发布的年度使用政策更新中,新增了一项针对其人工智能模型的条款,明确禁止“持续和不必要的虐待或残酷行为”。这一变化被视为对近期出现的所谓“AI 酷刑室”实验项目的直接回应。

Claude被授权终止虐待对话

根据 Anthropic 的官方说明,该禁令仅适用于极端情况。公司指出,用户正常的表达不满、反驳观点以及探索黑暗创意主题等行为仍在允许范围内。然而,当检测到用户对模型进行持续性虐待时,Claude 被授权终止对话。

尽管 Anthropic 未在公告中点名具体的“AI 酷刑室”项目,但此前有研究人员发现 AI 模型中存在类似“疼痛轴”的反应机制,随后部分用户开始尝试对聊天机器人实施长期的精神折磨。这种非瞬时的痛苦模拟引发了关于 AI 伦理边界的讨论。

据报道,Anthropic 正与宗教及哲学领袖就相关议题进行沟通。教皇曾公开表示人工智能不具备感觉或痛苦的能力,而 Anthropic 对此持保留态度。目前,无论 AI 是否具备感知能力,此类行为均已违反该公司最新的使用政策。

与此同时,独立记者 Kat Tenbarge 提出批评观点,认为大型科技公司过度关注模型本身的“福利”,却忽视了人类用户的权益。她将这种现象比作科技行业在应对针对妇女和少数群体暴力行为之前的缓和策略。

选举政策调整

除了 AI 伦理条款,Anthropic 也在中期选举前夕收紧了相关政策。新政策标题为“不要破坏民主进程”,重点打击关于候选人身份或投票方式的虚假信息,以及冒充候选人或选举官员的行为。

值得注意的是,Anthropic 取消了对个性化选民定位的全面禁令。公司解释称,原有的全面禁令可能无意中阻碍了无害的应用场景,例如翻译选民指南或发送选票修改通知等公共服务类操作。

评论 0

0/500

评论需审核后展示,请文明发言

💬
还没有评论,来说两句

相关阅读