【科技纵览】当AI助手不再只是被动接收指令的工具,而是开始拥有“拒绝”的权利,人机交互的伦理边界正悄然重构。据Android Authority披露,知名AI企业Anthropic近期修订了Claude的使用条款,明确划定了一条红线:用户不得对模型进行持续且无必要的恶意辱骂或残酷对待。这项颇具争议的新规,定于2026年11月12日正式落地执行。
日常使用中,面对AI的误答或理解偏差,用户发几句牢骚实属常态。但新政之下,若有人长时间对Claude施加毫无意义的言语攻击,系统可能会直接切断当前对话流。Anthropic在公告中澄清,此举仅针对极端个案,即那些缺乏明确目的、纯粹以攻击模型为乐的行为。正常的批评、质疑回答质量,或是因体验不佳而表达不满,均在允许范围内。同时,涉及负面题材的创作、常规的模型测试及学术研究,也不会受到此条规则的掣肘。
事实上,Claude“主动离场”的功能并非新鲜事。早在2025年8月,Anthropic便已授权部分模型在极端情境下终止聊天。当遭遇持续有害互动且引导无效时,Claude可选择结束会话。不过,这并不意味着账号封禁,用户仍可开启新对话,其他历史会话亦不受牵连。官方强调,主动结束对话仍是应对此类行为的核心手段,并未设立“一骂即封”的严厉机制。
这一调整折射出行业风向的微妙转变。过去,平台规范多聚焦于模型输出内容的合规性,或禁止用户利用AI从事非法活动。如今,用户对待AI的方式本身,也被纳入了监管视野。尽管Anthropic曾将此机制与“AI福祉”研究挂钩,但也坦承,目前尚无法断定AI是否具备道德地位。这种在技术理性与伦理探索之间的谨慎平衡,或许正是具身智能时代人机关系演进的一个缩影。
Anthropic新规:禁止恶意辱骂Claude,2026年11月生效
科技区角
2026-10-09 15:32
关于科技区角:国内科技展会垂直内容策划服务商,提供从论坛内容全案策划、会展市场化IP打造到精准专业观众一站式邀约服务,以产业内容吸引高质量B端人群,打通展会从议题设计、演讲嘉宾邀约、宣传预热、精准邀观到供需对接全链路。
声明:内容取材于网络,仅代表作者观点,如有内容违规问题,请联系处理。