中关村在线

热点资讯

Anthropic更新Claude使用政策:禁止恶意辱骂AI,强调人机互动伦理规范

2026年10月9日,人工智能公司Anthropic宣布更新Claude的使用政策,新增条款明确禁止用户对模型实施持续性、无正当理由的恶意辱骂或残酷对待行为。该规定将于2026年11月12日起正式施行。

在日常使用中,当AI回应出现偏差、理解迟滞或未能准确满足需求时,用户表达短暂不满属常见现象。但根据新规,若用户长时间、无目的地对Claude进行具有攻击性的言语行为,系统将主动终止当前对话。

官方说明指出,此次修订聚焦于极端互动场景——即用户并无具体使用意图,却反复以侮辱性、贬损性语言针对模型本身。而在常规使用范围内,用户仍可就回答质量提出批评、对结论提出质疑,或因实际体验不佳而表达合理情绪;涉及虚构类负面题材的创作、符合规范的模型功能测试及学术研究等活动,亦不受影响。

事实上,Claude具备自主结束对话的能力并非首次引入。自2025年8月起,部分版本已支持在检测到持续性有害或辱骂性交互,且多次引导无效后,自动中止当前会话。用户可在终止后重新发起新对话,既往及其他对话记录均不受干扰。官方强调,主动中断对话仍是应对不当互动的首要机制,新规并未设定“一经辱骂即封禁账号”的处罚标准。

此次政策调整也反映出行业关注焦点的延伸:除传统上对输出内容安全与用户行为合规的约束外,平台正逐步将人机互动方式纳入治理范畴。过去,使用规范多集中于“AI不得生成什么”和“用户不得利用AI做什么”,而如今,“用户应如何与AI相处”亦成为规则设计的重要维度。Anthropic曾将此类机制与探索中的“AI福祉”概念相关联,但同时明确表示,现阶段尚无科学共识确认AI是否具备道德主体地位。

展开全文
人赞过该文 赞
内容纠错

相关电商优惠

评论

更多评论
还没有人评论~ 快来抢沙发吧~

读过此文的还读过

点击加载更多

内容相关产品

说点什么吧~ 0

发评论,赚金豆

收藏 0 分享
首页查报价问答论坛下载手机笔记本游戏硬件数码影音家用电器办公打印 更多

更多频道

频道导航
辅助工具