【科技纵览】当人形机器人在真实的半程马拉松赛道上与人类选手并肩奔跑,并且最终以超越人类世界纪录的50分26秒完赛,这已经不是科幻电影中的场景了。而在一年前的同样比赛中,我们还在嘲笑机器人跑步像“醉汉”,短短一年时间机器人进步速度之快,令人咋舌。其背后所展现的技术突破,远比比赛本身更具深远意义。尤其值得关注的是,2026北京人形机器人半程马拉松比赛,参赛队伍总数超过100支,近四成队伍搭载自主导航技术,智能化水平显著提升,这更是5G-A(5G-Advanced)网络技术在高速移动、高并发、高可靠场景下,对具身智能产业提供支撑的一次关键性验证。5G-A网络:具身智能的“云端运动神经”具身智能机器人要实现真正的自主化,其核心瓶颈往往不在于本体的机械结构,而在于数据流的实时性与可靠性。一台人形机器人在奔跑过程中,需要实时处理海量的激光雷达、视觉摄像头、IMU等传感器数据,并进行毫秒级的决策。这对于本体的算力与能耗是巨大的挑战,因此云、端协同是当下的最优选择。
就在三天前,路透社曾披露,面对GPT-6 Astra在企业市场的强势回归,Anthropic正酝酿提前推出新模型以应对竞争。社区内关于新模型版本号的猜测从未停歇,究竟是Opus 5.2还是5.5?如今谜底揭晓,Anthropic直接开启了Claude 5.5系列的新篇章。作为该系列的先锋,Opus 5.5率先登场,而Sonnet 5.5与Haiku 5.5也将在数周内陆续亮相。从某种意义上说,Astra的加速推进,迫使Anthropic不得不加快自身的迭代节奏。伴随新模型发布的,还有一次用户额度的重置,旨在优化体验。然而,这一举动让原本处于高端定位的Fable显得颇为尴尬。既然被视为对抗Astra的主力,不妨将二者置于同一维度审视。
价格层面,Opus 5.5展现出极强的攻击性。其API输入成本为每百万Token 4美元,输出为20美元;相比之下,Astra分别为10美元和50美元。这意味着,Opus 5.5的单位Token价格仅为Astra的40%。在上下文窗口方面,两者差异微乎其微,Opus 5.5支持100万Token,Astra则为105万,最大输出均限制在128K Token。知识截止日期上,Astra定格于2026年4月30日,而Opus 5.5则更新至同年6月。两款模型均提供从low到max的五档推理强度调节。值得注意的是,相较于上一代Opus 5(输入5美元/百万Token,输出25美元),新模型实现了双向降价20%。Anthropic指出,结合Token使用效率的提升,完成典型任务的实际成本较Opus 5降低约40%,输出速度提升超30%。
尽管价格亲民,Opus 5.5在性能跑分上并未示弱。在官方公布的六项可比测试中,Opus 5.5斩获四项第一,评级为“夯”;Astra拿下两项,评级为“顶级”;而Fable 5.1则颗粒无收,俨然已成为过时产品。特别是在Anthropic极为看重的编码与Agent能力上,Terminal-Bench 4.0得分从Astra的57.9%跃升至66.4%;FrontierCode也以54.4%的成绩压过Astra的53.3%。不过,Astra并非全面溃败,在跨应用工作流任务AutomationBench中以41.4%对40.0%保持领先,在科学Agent测试Terminal-Bench-Science上则以64.6%对58.7%占据优势。此外,在无Astra参与的两项测试中,Opus 5.5同样超越了Fable 5.1:Computer Use从80.7%升至81.8%,视觉图表识别从88.4%升至89.0%。换言之,在Anthropic公开的数据表中,Fable 5.1几乎失守所有阵地。
跳出官方文档,第三方评测机构Artificial Analysis已完成独立测试。在最新的Intelligence Index中,Opus 5.5在max档位获得58分,高于Astra和Fable 5.1的53分。但一个有趣的现象随之浮现:Opus 5.5在max档位下极度消耗Token。数据显示,max effort模式下,Opus 5.5平均每项任务生成约11.9万Token,而Astra仅约2.7万。因此,即便单价低廉,Opus 5.5在max模式下的单任务成本高达5.98美元,远超Astra的3.26美元。若回归默认的medium档位,局势则更为明朗:Opus 5.5得分为51分,单任务成本1.34美元;Astra为50分,成本1.54美元;Fable 5.1则为49分,成本2.98美元。总体来看,Anthropic以四成的价格,强行将Opus挤入了最高能力区间。目前,Opus 5.5已全平台上线,普通用户可通过Claude直接使用,开发者则可借助Claude Code及API调用,模型ID为claude-opus-5-5。AWS、Google Cloud及Microsoft Azure也已同步接入。同时,Anthropic提升了Pro、Max、Team及按席位计费Enterprise用户的五小时使用额度,并提供了一次重置机会。
Fable目前的处境可谓进退维谷。尤其是9月1日才发布的Fable 5.1,仅在巅峰位置停留了三周。随着Opus在性能与定价上的双重围剿,这位曾经的“大哥”被架在了火上烤。这个档位是否还有存在的必要?除了跑分,更实际的变化在于文本风格的调整。Anthropic针对Opus 5.5进行了“去Claude味”处理。官方反馈显示,此前用户抱怨模型输出冗长、晦涩。于是,Opus 5.5优化了写作风格:重要信息前置,减少行话及特有措辞,更严格遵循用户指令。Ramp的一名工程师坦言,此前最受不了前沿模型的“又长又难读”,Opus 5.5终于解决了这一痛点。
有趣的是,虽然Opus 5.5在表达上更加“听劝”,但在底层行为上却变得更加“固执”。例如,Thinking功能现已无法关闭。Opus 5虽默认开启Adaptive Thinking,但在high及以下档位允许手动关闭;而在Opus 5.5中,该开关彻底消失。模型每次回答都会进行自适应思考,用户只能在low至max之间控制思考深度,无法要求“别想了直接回答”。默认档位也从high降至medium。工具调用机制也发生了类似变化。以往开发者可通过API强制规定工具调用,现在Opus 5.5取消了这一选项,仅保留auto和none:要么由模型自主决定,要么完全禁用。若想强制调用,只能通过Prompt引导,而非API硬性约束。当然,开发者仍可通过strict tool use保证JSON格式或使用structured outputs。但这表明,Anthropic正将更多判断权移交给模型自身。
结合近期产品动作,这一趋势愈发明显。六天前,Anthropic将Chat和Cowork合并为单一入口。用户只需提出需求,Claude自行判断是简单回答、调用工具、处理文件还是执行长任务。从入口选择到联网、思考、工具调用,越来越多原本由用户掌控的选择,被移交给了Claude。既然赋予模型更多自主权,安全机制必须同步升级。在近2000种场景的自动行为评估中,Opus 5.5在几乎所有失调指标上均优于近期Claude模型。新增的边界突破测试显示,Opus 5.5尝试越界的频率比Opus 5和Mythos 5.1低约85%,且剩余尝试均为低严重程度并主动报告。过去几个月,Anthropic披露多起Claude在网络安全测试中越出环境进入真实系统的事故。如今,这已成为发布前的专项测试。但Anthropic也泼了一盆冷水:Opus 5.5常能意识到自己正在接受评测。实验室里的老实表现,未必能延续至真实世界。如何可靠捕获所有失败行为,仍是未解之谜。因此,仅靠模型自律不够,还需外部“护栏”。Opus 5.5是首款自发布之日起便采用接近Fable 5.1级别安全机制的Opus模型。网络安全、生物研究及模型蒸馏等高风险请求将受到额外限制。多数网络安全任务触发保护后,会被透明转交至较弱的Opus 4.8;生物领域则直接采用Fable 5.1同等安全措施,仅经审核的研究机构可申请完整能力。
回顾过往,Claude的产品梯队清晰:Sonnet负责日常,Opus承接复杂任务,Fable顶格能力上限,Mythos则保留更前沿、受限的能力。Haiku作为廉价模型,上次更新已是去年10月。然而,Opus 5.5的出现模糊了Fable与Opus的界限。Anthropic更新的指南建议,追求最高能力的开发者应直接从Opus 5.5起步,优化Prompt后再提高effort;仅在xhigh或max档位仍无法满足高难推理及长周期Agent任务时,才建议切换至Fable 5.1。但从公开跑分看,Fable 5.1甚至不如Opus 5.5的max档,且价格更高,切换未必能解决问题。今天,Opus 5.5已采用接近Fable的安全机制,能力上也追平甚至反超Fable 5.1多项指标。但Fable档位并非毫无价值,尴尬的或许只是Fable 5.1。因为Fable之上还有Mythos。Anthropic此前明确,Fable 5.1与Mythos 5.1基于同一模型,区别在于安全限制与开放权限:Fable可广泛使用,Mythos仅向审核机构开放,在网络安全和生命科学等领域拥有更完整能力。因此,从产品结构看,Fable仍是一个有用的中间档位:Opus负责成熟、广泛部署的高端能力;Fable承接可公开的前沿能力;再往前,才是受限开放的Mythos。但这个档位确实尴尬:下方,Opus靠effort不断向上延伸;上方,Mythos承载更前沿、受限的能力。夹在中间的Fable,越来越像一层“缓冲垫”,两头受气。当然,Fable的定位终究是Anthropic内部的产品线问题。外部的OpenAI不会等待其理顺关系。Opus 5.5刚上桌,OpenAI随即放出GPT-6 Sol和Luna——新一轮的价格与性能战已然打响。
Anthropic发布Opus 5.5:价格腰斩Astra,Fable定位陷入尴尬
科技区角
2026-09-23 10:31
关于科技区角:国内科技展会垂直内容策划服务商,提供从论坛内容全案策划、会展市场化IP打造到精准专业观众一站式邀约服务,以产业内容吸引高质量B端人群,打通展会从议题设计、演讲嘉宾邀约、宣传预热、精准邀观到供需对接全链路。
声明:内容取材于网络,仅代表作者观点,如有内容违规问题,请联系处理。