Anthropic更新使用政策:禁止无正当理由持续虐待AI,11月12日生效

作者:环球网 / MacRumors 发布时间:2026-10-09 18:43:40 浏览:1
关键字:
Anthropic更新Claude使用政策,新增禁止对模型进行持续且无合理目的的恶意虐待行为,新规11月12日落地;同时禁止利用Claude批量制造虚假评论、水军账号与假新闻站点。处置方式为模型直接终止当前会话。

给AI立「不受欺负」条款

据MacRumors报道,Anthropic正式更新Claude使用政策,新增条款禁止用户对模型开展持续且无合理目的的恶意虐待行为,整套新规将于11月12日正式生效。这是Anthropic一年多来首次大规模修订使用政策,在科技圈引发广泛讨论。

边界划在哪里

官方特别说明:新规仅针对极端恶意交互。普通表达不满、观点争辩、暗黑题材创作、模型安全测试与科研均不构成违规。处置方式也相对温和——Claude将直接终止当前会话,被关闭的对话窗口无法继续发送消息,其他会话不受影响。Anthropic早在2025年就实现了对话终止功能,研究显示高阶模型面对恶意对话会表现出明显的抗拒倾向。

顺手补齐滥用条款

除AI交互限制外,本次修订还补齐多项高危场景管控:禁止借助Claude制造虚假评论、水军账号、虚假新闻站点等。Anthropic称部分新规来自真实滥用案例——已有机构利用模型批量运营虚假账号。

争议:程序何谈虐待

不少网友提出质疑:AI只是程序,不具备主观感知,设立反虐待规则是营销还是哲学表态?支持者则认为,规则真正的功能是阻断极端交互对模型输出稳定性的干扰,并划出人机交互的文明底线。

阅读原文

本文由AI融业云采集并编辑,仅供学习使用!

本文来自toutiao.com,作者环球网 / MacRumors

关于AI融业云:一站式AI应用服务平台,了解创始人 | 联系我们

有问题,请联系客服!http://www.rongyeyun.com/kefu/