Anthropic新规:禁止恶意辱骂Claude,2026年11月生效

科技区角 2026-10-09 15:32

【科技纵览】当AI助手不再只是被动接收指令的工具,而是开始拥有“拒绝”的权利,人机交互的伦理边界正悄然重构。据Android Authority披露,知名AI企业Anthropic近期修订了Claude的使用条款,明确划定了一条红线:用户不得对模型进行持续且无必要的恶意辱骂或残酷对待。这项颇具争议的新规,定于2026年11月12日正式落地执行。

日常使用中,面对AI的误答或理解偏差,用户发几句牢骚实属常态。但新政之下,若有人长时间对Claude施加毫无意义的言语攻击,系统可能会直接切断当前对话流。Anthropic在公告中澄清,此举仅针对极端个案,即那些缺乏明确目的、纯粹以攻击模型为乐的行为。正常的批评、质疑回答质量,或是因体验不佳而表达不满,均在允许范围内。同时,涉及负面题材的创作、常规的模型测试及学术研究,也不会受到此条规则的掣肘。

事实上,Claude“主动离场”的功能并非新鲜事。早在2025年8月,Anthropic便已授权部分模型在极端情境下终止聊天。当遭遇持续有害互动且引导无效时,Claude可选择结束会话。不过,这并不意味着账号封禁,用户仍可开启新对话,其他历史会话亦不受牵连。官方强调,主动结束对话仍是应对此类行为的核心手段,并未设立“一骂即封”的严厉机制。

这一调整折射出行业风向的微妙转变。过去,平台规范多聚焦于模型输出内容的合规性,或禁止用户利用AI从事非法活动。如今,用户对待AI的方式本身,也被纳入了监管视野。尽管Anthropic曾将此机制与“AI福祉”研究挂钩,但也坦承,目前尚无法断定AI是否具备道德地位。这种在技术理性与伦理探索之间的谨慎平衡,或许正是具身智能时代人机关系演进的一个缩影。

关于科技区角:国内科技展会垂直内容策划服务商,提供从论坛内容全案策划、会展市场化IP打造到精准专业观众一站式邀约服务,以产业内容吸引高质量B端人群,打通展会从议题设计、演讲嘉宾邀约、宣传预热、精准邀观到供需对接全链路。
声明:内容取材于网络,仅代表作者观点,如有内容违规问题,请联系处理。
IC
more
展期论坛 | EDA/IP 与 IC 设计论坛,议程及嘉宾阵容抢先看
荣耀MagicOS 11第二批内测机型扩围,涵盖多款旗舰与平板
Musubi发布开源决策模型PolicyLM-1.7B,以LLM灵活性重塑内容审核效率
荣耀Magic9系列国内首销告捷,欧洲市场定档2027年1月
从伦敦银行到爱丁堡工厂:Danu Robotics如何用AI重塑垃圾分拣经济学
价格暴降90%,多项测试超GPT-6 Luna!Anthropic最便宜模型来了
OpenAI与Anthropic激战正酣,企业支出份额此消彼长折射AI市场变局
荣耀W40周份额登顶安卓第一,Magic9系列国庆热销
告别“提示词工程”?Mirror Particle试图用“世界模型”重构人类行为预测
Xbotics × Motphys 第五期「强化学习与仿真软件」线上实训营正式启动!
Copyright © 2025-成都区角科技有限公司
蜀ICP备2025143415号-1
  
川公网安备51015602001305号