【科技纵览】当大模型从单纯的对话工具向复杂工作流平台演进,底层架构的优化与调度机制的革新便成了决定体验的关键。近日,OpenAI在内部Slack频道披露的消息显示,ChatGPT正经历一场堪称“史诗级”的性能重构,与此同时,Codex也同步上线了GPT-5.6“多智能体v2”版本,旨在通过自动化任务分发彻底改变用户交互模式。
此次前端优化的数据表现令人咋舌。据测试数据显示,应用加载速度提升了94%,堆内存增长幅度缩减87.8%,整体内存占用下降41.2%。更为夸张的是,网络请求数暴跌98.2%,而对话记录的加载量更是锐减99.6%。这一系列改动直接回应了长期困扰用户的痛点:随着Agent时代的到来,动辄数百轮的超长对话让页面卡顿甚至崩溃成为常态。此前,OpenAI官方论坛上不乏用户抱怨新版Codex响应变慢,甚至有开发者发帖询问是否因系统升级导致性能倒退。
为了验证优化效果,Codex负责人Andrew Ambrosino晒出了一组极端测试数据。测试对象是一个包含741轮对话、体积高达231MB的“怪物级”会话记录。在优化前,打开这样一个对话平均需要27.62秒,内存增长达1030.7 MiB,需发起894次网络请求并加载15529条会话条目。优化后,打开时间骤降至1.66秒,内存增长压至606 MiB,网络请求仅需16次,加载条目仅保留64条。这种变化意味着,系统不再强制渲染全部历史记录,而是采用按需加载策略,只呈现用户当前关注的部分。对于重度依赖长上下文进行代码调试或逻辑推演的开发者而言,这种“丝滑”的体验提升是感知极强的。
值得注意的是,这次性能大换血被视为“编程之王”Scott Gray离职后的关键一役。它解决了基础设施层面的历史包袱,为上层应用的复杂化铺平了道路。几乎在同一时间,后端调度机制也迎来了重大更新。OpenAI工程师Eric Provencher正式宣布,“多智能体v2”已全面上线。该版本的核心在于主Agent能够自动将子任务委派给不同的模型,且每个子Agent可独立设置推理强度。
目前,ChatGPT与Codex背后的模型矩阵包括:负责复杂Agentic编码的最强模型GPT-5.6 Sol、日常编程主力GPT-5.6 Terra、最快最便宜的GPT-5.6 Luna,以及专攻网络安全的Daybreak和通用任务的GPT-5.5。此前,由于Luna被标记为v1而Sol和Terra为v2,导致主Agent无法调用Luna,曾在GitHub上引发多个Issue,甚至有用户通过钩子强行绕过限制以使用Luna。如今,随着v2的全量上线,系统能够自动拆分任务,仅将20%的高难度步骤交给最强模型,其余交由低成本模型处理。
OpenAI总裁Greg Brockman对此评价道,这是朝着“告别手动选模型”方向迈出的重要一步。从某种角度看,这标志着大模型正在加速从聊天工具向全自动工作流平台进化。用户无需再纠结于模型选择与成本权衡,只需抛出复杂任务,系统便会自动完成拆解、调度与渲染。这种“无感”却强大的技术迭代,或许正是具身智能时代生产力爆发的先声。
OpenAI双管齐下:ChatGPT前端性能飙升94%,多智能体v2全量上线
科技区角
2026-08-16 10:32
关于科技区角:国内科技展会垂直内容策划服务商,提供从论坛内容全案策划、会展市场化IP打造到精准专业观众一站式邀约服务,以产业内容吸引高质量B端人群,打通展会从议题设计、演讲嘉宾邀约、宣传预热、精准邀观到供需对接全链路。
声明:内容取材于网络,仅代表作者观点,如有内容违规问题,请联系处理。