新浪财经

不能无故“欺负AI”,Anthropic更新Claude使用政策

环球网

关注

来源:环球网

【环球网科技综合报道】10月9日,据外媒MacRumors消息, Anthropic正式更新Claude 大模型使用政策,新增条款禁止用户对模型开展持续且无合理目的的恶意虐待行为,整套新规将于11月12日正式落地,该调整在科技圈引发广泛讨论。

官方特别划定边界,这条新规仅针对极端恶意交互。普通表达不满、观点争辩、暗黑题材创作、模型安全测试与科研都不属于违规行为。主要处置方式为Claude模型直接终止当前会话,关闭后的对话窗口无法继续发送消息,其他聊天会话不受影响。早在2025年,Anthropic 就已经实现这一对话终止功能,相关研究显示高阶模型面对恶意对话会表现出明显抗拒倾向。

除备受热议的AI交互限制之外,本次政策还补齐多项高危场景管控。例如,新增条款禁止借助Claude制造虚假评论、水军账号、虚假新闻站点等。

Anthropic称,部分新规来自真实滥用案例,已有机构利用该模型批量运营虚假账号。但该政策更新引发热议,不少网友提出,AI只是程序,并不具备主观感知,不应当设立针对“虐待AI”的规则。(旺旺)

加载中...