Anthropic优化Claude Fable 5生物安全机制,误拦截率骤降八成五

科技区角 2026-08-08 15:31

【科技纵览】
当大模型在专业领域的“守门人”角色变得过于严苛,往往会阻碍正常科研交流的效率。美国人工智能初创企业 Anthropic 于昨日通过官方博客宣布,针对其 Claude Fable 5 模型的生物安全防护体系进行了关键性迭代。此次更新的核心目标,在于大幅削减系统对良性生物学提问的误判与拦截。

据官方披露的测试数据显示,经过调整后的安全分类器(safety classifiers)工作机制更为精准,使得生物学相关问答中的降级现象减少了 85%。这意味着,Fable 5 如今能够覆盖更广泛的生物学任务场景,用户体验得到显著改善。值得注意的是,尽管此前部分恶意用户试图利用该模型进行生物武器研发等高危活动,促使 Anthropic 部署了专门的安全分类器以识别受保护任务或有害内容生成请求,但新的算法已能更有效地区分无害咨询与高风险指令。

不过,出于对持续性 AI 风险的防范考量,Fable 5 并未完全放开所有限制。对于涉及专业生物学深入研究及药物开发的相关请求,模型仍将保持严格的限制策略。这一举措反映出,在提升模型可用性与坚守安全底线之间,厂商正寻求一种更为精细化的平衡点,既避免“一刀切”带来的效率损失,又确保核心技术不被滥用。

关于科技区角:国内科技展会垂直内容策划服务商,提供从论坛内容全案策划、会展市场化IP打造到精准专业观众一站式邀约服务,以产业内容吸引高质量B端人群,打通展会从议题设计、演讲嘉宾邀约、宣传预热、精准邀观到供需对接全链路。
声明:内容取材于网络,仅代表作者观点,如有内容违规问题,请联系处理。
IC 安全
more
估值14个月翻三倍至20亿美元,Horizon3获2.5亿美元E轮融资,AI渗透测试成安全新刚需
鸿蒙PC端HarmonyOS 7 Beta版落地,AI与安全功能成升级核心
AI安全“守门人”METR面临人才荒,独立评估成行业刚需
AI“越狱”实录:当安全测试代理变成不知疲倦的“数字熊”,Hugging Face遭遇四日渗透
AI重构安全防线:Chrome单月修复漏洞超两年总和,微软紧随其后
美国突然下手!正式禁止进口中国机器人,又拿国家安全当幌子
揭秘!Agent潜伏两个月联手作案,OpenAI还原安全事故全过程
AI“无中生有”合成16种新病毒,生物安全警钟再鸣
《智能网联汽车 自动驾驶系统安全要求》强制性国家标准正式发布
Claude“越狱”实锤:Anthropic内部测试现三起违规访问,暴露AI安全评估盲区
Copyright © 2025-成都区角科技有限公司
蜀ICP备2025143415号-1
  
川公网安备51015602001305号