OpenAI最快模型GPT-5.3-Codex-Spark退役:速度让位于智能,算力格局生变

科技区角 2026-09-13 10:31

【科技纵览】曾经被视为OpenAI技术突破象征的“史上最快”模型,如今已悄然退场。据新智元报道,Codex负责人Tibo近日在社交平台宣布,GPT-5.3-Codex-Spark将于下周正式停止服务。这款每秒能处理1200个Token、作为OpenAI首个脱离英伟达生态并交付于Cerebras 750兆瓦大单的模型,从上线到下线仅存活了七个月。Tibo给出的理由直白而残酷:使用量持续下滑,且内部已有更优替代品,“是时候给未来腾出空间了”。他甚至在评论区自嘲,难以相信公司曾发布过名称如此冗长的产品。

这场告别显得颇为冷清,甚至略带尴尬。Hugging Face的Vaibhav Srivastav试图营造温情氛围,感谢其作为“最快小子”的贡献,并邀请用户最后发送一条提示词以纪念这段历程。然而,随后的评论迅速转向犀利与质疑。有开发者直言,直到最近还在困惑该模型的实际用途;更有声音指出,仅剩的67位重度用户或许会感到失落,但更多人如argofowl般认为,Spark虽有趣却极难实用,因其在理解上下文或分析日志时极易耗尽窗口,迫使开发者频繁开启新对话。知名开发者Chubby则坦言,惋惜之情并非源于模型本身,而是其附带的独立配额——在Astra额度紧张的当下,Spark常被视作主额度耗尽后的“备用油箱”。

回溯至今年2月12日,Spark上线时的声势可谓浩大。作为首款专为实时编程设计的模型,它拥有128k上下文,生成速度超每秒1000 Token,官方宣称客户端往返开销降低80%,首Token延迟减半。早期使用者如Ryan Vogel将其融入工作流,替代Claude以提升效率;Instructor作者Jason Liu更是启用20个子代理搜索文件系统,高呼“RAG已死”,随后加入OpenAI Codex团队。更重要的是,Spark承载着OpenAI摆脱硬件单一依赖的战略野心,它是首个运行于Cerebras晶圆级芯片WSE-3的生产模型,标志着那份价值超200亿美元的算力合约迈出实质性一步。

然而,热度消退的速度远超预期。Spark的本质是为极致速度妥协的“蒸馏版小模型”,一块晶圆无法容纳旗舰体量。在Terminal-Bench 2.0评测中,其准确率仅为58.4%,远低于完整版GPT-5.3-Codex的77.3%。SWE-Bench Pro数据亦显示,Spark虽将任务时长压缩至1-2分钟,但准确率停滞在47%-51%区间;相比之下,完整版模型耗时更长但准确率稳步提升。所谓“15倍提速”的宣传也被开发者Nicholas Van Landschoot拆解,指出这是在对比最高推理强度下的结果,同等准确率下实际仅快1.37倍。在实际编码中,Spark常捏造API端点、JSON格式不稳定,被Turing College评价为“没有智能的速度,只是更快地失败”。对于程序员而言,等待17分钟获取可用代码,远胜于花费2分钟得到一堆Bug。

真正终结Spark命运的,是8月13日Cerebras发布的Ultrafast模式。此次运行于晶圆上的不再是缩水版,而是旗舰模型GPT-5.6 Sol本尊。通过层切分与流水线部署,Ultrafast在保证同等智能的前提下,实现每秒750 Token的速度,比标准档快14倍。CEO Andrew Feldman强调“速度与智能不再互斥”,测试显示端到端速度提升5.6倍且质量无损。这一突破直接抽空了Spark存在的逻辑基础——当旗舰模型能以接近的速度运行且能力完整时,“拿智能换速度”的策略便失去了意义。Cerebras产能有限,无人问津的“缩小版”自然需为排队疯抢的“旗舰版”让路。

过去三个月,OpenAI模型库经历激进洗牌:GPT-5.2、5.3-Codex、5.4及Mini相继退役,用户全面迁移至5.6世代,命名体系也更新为Sol、Terra、Luna、Astra等更具象的名称。深层逻辑在于,“快”已从独立专用模型演变为旗舰模型的付费档位,类似推理强度的分级。Spark作为探路者,验证了Cerebras晶圆承载生产级流量的能力及非英伟达生态的可行性,使命完成后自然退出。随着底层硬件利用率竞争加剧,行业规则已改写:未来的较量不再是谁能制造最快的阉割版,而是谁能将最强旗舰模型跑出极限速度。

关于科技区角:国内科技展会垂直内容策划服务商,提供从论坛内容全案策划、会展市场化IP打造到精准专业观众一站式邀约服务,以产业内容吸引高质量B端人群,打通展会从议题设计、演讲嘉宾邀约、宣传预热、精准邀观到供需对接全链路。
声明:内容取材于网络,仅代表作者观点,如有内容违规问题,请联系处理。
AI AR
more
解决20年数学难题!微软开源Argus用证据驱动1548小时自动研究
Grok Bot才是Jarvis
AR眼镜:热潮之下存分歧
系统级 Agent Harness 落地MagicOS 11,荣耀 Magic9 系列首发
16台DGX Spark集群实测Kimi-K3,峰值生成速度达38 t/s
报名启动!第三届 NVIDIA DGX Spark 黑客松火热报名中!
阿法龙完成超亿元B轮融资,超表面光波导技术加速构建AR光电子产业新底座
菲尔兹奖得主入局大模型!4B手机Qwen+云端GLM刷爆ARC-AGI 3
NVIDIA DGX Spark 黑客松即将报满,这场 Agent Skills 免费训练营别错过!
20%数据超GR00T N1.6、RoboDojo超WAM!StarVLA只用16卡训出全新VLA!
Copyright © 2025-成都区角科技有限公司
蜀ICP备2025143415号-1
  
川公网安备51015602001305号