2026年10月9日,人工智能公司Anthropic宣布更新Claude的使用政策,新增条款明确禁止用户对模型实施持续性、无正当理由的恶意辱骂或残酷对待行为。该规定将于2026年11月12日起正式施行。
在日常使用中,当AI回应出现偏差、理解迟滞或未能准确满足需求时,用户表达短暂不满属常见现象。但根据新规,若用户长时间、无目的地对Claude进行具有攻击性的言语行为,系统将主动终止当前对话。
官方说明指出,此次修订聚焦于极端互动场景——即用户并无具体使用意图,却反复以侮辱性、贬损性语言针对模型本身。而在常规使用范围内,用户仍可就回答质量提出批评、对结论提出质疑,或因实际体验不佳而表达合理情绪;涉及虚构类负面题材的创作、符合规范的模型功能测试及学术研究等活动,亦不受影响。
事实上,Claude具备自主结束对话的能力并非首次引入。自2025年8月起,部分版本已支持在检测到持续性有害或辱骂性交互,且多次引导无效后,自动中止当前会话。用户可在终止后重新发起新对话,既往及其他对话记录均不受干扰。官方强调,主动中断对话仍是应对不当互动的首要机制,新规并未设定“一经辱骂即封禁账号”的处罚标准。
此次政策调整也反映出行业关注焦点的延伸:除传统上对输出内容安全与用户行为合规的约束外,平台正逐步将人机互动方式纳入治理范畴。过去,使用规范多集中于“AI不得生成什么”和“用户不得利用AI做什么”,而如今,“用户应如何与AI相处”亦成为规则设计的重要维度。Anthropic曾将此类机制与探索中的“AI福祉”概念相关联,但同时明确表示,现阶段尚无科学共识确认AI是否具备道德主体地位。

评论
更多评论