【科技24时区】周二,人工智能初创公司Anthropic正式推出了其最新旗舰模型Opus 5.5。据官方披露,该模型在代码生成及知识工作领域的表现已刷新行业纪录,确立了新的“最先进”(SOTA)基准。作为Claude系列中定位最高、能力最强且价格最昂贵的梯队,Opus此次的迭代不仅意味着性能的突破,更折射出这家硅谷独角兽在技术狂奔与安全审慎之间的微妙平衡。
值得注意的是,尽管Opus 5.5在多项基准测试中超越了规模更大的Fable模型,甚至在若干非正式任务中完成了后者未能攻克的难题,但其运行成本却显著降低。输出Token的定价从上一代的每百万25美元下调至20美元,其他指标亦有类似幅度的降价。这种“加量减价”的背后,是推理所需计算资源的整体下降,使得模型运行速度更快。此外,新版本在交互逻辑上进行了大幅优化:它更少使用晦涩的专业术语,并倾向于将关键信息置于回复开头,以提升用户的信息获取效率。
距离7月24日Opus 5的发布仅过去两个月,这一快速迭代节奏似乎与CEO达里奥·阿莫代伊(Dario Amodei)近期倡导的“放缓前沿进展”理念形成某种张力。阿莫代伊在本月初的一篇博文中坦言:“我深信,要充分应对风险,需要更加审慎的态度——不仅要投资预防风险,还要控制能力提升的速度,以便让风险预防措施有足够的时间跟上。”Opus 5.5正是自他公开呼吁“为对齐进度匹配能力增速”以来,Anthropic发布的首个模型。
在生物安全与网络安全领域,Opus 5.5的能力被评估为与Mythos模型相当,因此其部署受到与Fable模型同等严格的安全护栏限制。这些措施旨在防止模型被用于发现编译程序中的漏洞或开发生物武器等高风险行为。虽然本次模型的安全训练框架与前代大致相同,并经过了METR和Frontier Design等外部机构的对齐测试与预发布评估,但Anthropic强调,针对未来模型的更高级训练与评估系统已在筹备中,包括升级后的安全监控基础设施。
随着AI能力的指数级增长,公共政策在确保系统安全性方面的角色日益凸显。正如官方博客所言,“构建这种能力需要时间,而我们已开始搭建支持它的基础设施”。据悉,同系列的Sonnet 5.5和Haiku 5.5也将在未来几周内陆续发布,预计将带来类似的能效比提升。从某种角度看,Opus 5.5的发布不仅是技术的胜利,更是Anthropic在“加速主义”与“安全至上”之间寻找新均衡点的一次重要实践。
Anthropic发布Opus 5.5:性能跃升背后的“减速”哲学
科技区角
2026-09-23 02:00
关于科技区角:国内科技展会垂直内容策划服务商,提供从论坛内容全案策划、会展市场化IP打造到精准专业观众一站式邀约服务,以产业内容吸引高质量B端人群,打通展会从议题设计、演讲嘉宾邀约、宣传预热、精准邀观到供需对接全链路。
声明:内容取材于网络,仅代表作者观点,如有内容违规问题,请联系处理。