给AI立「不受欺负」条款
据MacRumors报道,Anthropic正式更新Claude使用政策,新增条款禁止用户对模型开展持续且无合理目的的恶意虐待行为,整套新规将于11月12日正式生效。这是Anthropic一年多来首次大规模修订使用政策,在科技圈引发广泛讨论。
边界划在哪里
官方特别说明:新规仅针对极端恶意交互。普通表达不满、观点争辩、暗黑题材创作、模型安全测试与科研均不构成违规。处置方式也相对温和——Claude将直接终止当前会话,被关闭的对话窗口无法继续发送消息,其他会话不受影响。Anthropic早在2025年就实现了对话终止功能,研究显示高阶模型面对恶意对话会表现出明显的抗拒倾向。
顺手补齐滥用条款
除AI交互限制外,本次修订还补齐多项高危场景管控:禁止借助Claude制造虚假评论、水军账号、虚假新闻站点等。Anthropic称部分新规来自真实滥用案例——已有机构利用模型批量运营虚假账号。
争议:程序何谈虐待
不少网友提出质疑:AI只是程序,不具备主观感知,设立反虐待规则是营销还是哲学表态?支持者则认为,规则真正的功能是阻断极端交互对模型输出稳定性的干扰,并划出人机交互的文明底线。
