OpenAI双管齐下:ChatGPT前端性能飙升94%,多智能体v2全量上线

科技区角 2026-08-16 10:32

【科技纵览】当大模型从单纯的对话工具向复杂工作流平台演进,底层架构的优化与调度机制的革新便成了决定体验的关键。近日,OpenAI在内部Slack频道披露的消息显示,ChatGPT正经历一场堪称“史诗级”的性能重构,与此同时,Codex也同步上线了GPT-5.6“多智能体v2”版本,旨在通过自动化任务分发彻底改变用户交互模式。

此次前端优化的数据表现令人咋舌。据测试数据显示,应用加载速度提升了94%,堆内存增长幅度缩减87.8%,整体内存占用下降41.2%。更为夸张的是,网络请求数暴跌98.2%,而对话记录的加载量更是锐减99.6%。这一系列改动直接回应了长期困扰用户的痛点:随着Agent时代的到来,动辄数百轮的超长对话让页面卡顿甚至崩溃成为常态。此前,OpenAI官方论坛上不乏用户抱怨新版Codex响应变慢,甚至有开发者发帖询问是否因系统升级导致性能倒退。

为了验证优化效果,Codex负责人Andrew Ambrosino晒出了一组极端测试数据。测试对象是一个包含741轮对话、体积高达231MB的“怪物级”会话记录。在优化前,打开这样一个对话平均需要27.62秒,内存增长达1030.7 MiB,需发起894次网络请求并加载15529条会话条目。优化后,打开时间骤降至1.66秒,内存增长压至606 MiB,网络请求仅需16次,加载条目仅保留64条。这种变化意味着,系统不再强制渲染全部历史记录,而是采用按需加载策略,只呈现用户当前关注的部分。对于重度依赖长上下文进行代码调试或逻辑推演的开发者而言,这种“丝滑”的体验提升是感知极强的。

值得注意的是,这次性能大换血被视为“编程之王”Scott Gray离职后的关键一役。它解决了基础设施层面的历史包袱,为上层应用的复杂化铺平了道路。几乎在同一时间,后端调度机制也迎来了重大更新。OpenAI工程师Eric Provencher正式宣布,“多智能体v2”已全面上线。该版本的核心在于主Agent能够自动将子任务委派给不同的模型,且每个子Agent可独立设置推理强度。

目前,ChatGPT与Codex背后的模型矩阵包括:负责复杂Agentic编码的最强模型GPT-5.6 Sol、日常编程主力GPT-5.6 Terra、最快最便宜的GPT-5.6 Luna,以及专攻网络安全的Daybreak和通用任务的GPT-5.5。此前,由于Luna被标记为v1而Sol和Terra为v2,导致主Agent无法调用Luna,曾在GitHub上引发多个Issue,甚至有用户通过钩子强行绕过限制以使用Luna。如今,随着v2的全量上线,系统能够自动拆分任务,仅将20%的高难度步骤交给最强模型,其余交由低成本模型处理。

OpenAI总裁Greg Brockman对此评价道,这是朝着“告别手动选模型”方向迈出的重要一步。从某种角度看,这标志着大模型正在加速从聊天工具向全自动工作流平台进化。用户无需再纠结于模型选择与成本权衡,只需抛出复杂任务,系统便会自动完成拆解、调度与渲染。这种“无感”却强大的技术迭代,或许正是具身智能时代生产力爆发的先声。

关于科技区角:国内科技展会垂直内容策划服务商,提供从论坛内容全案策划、会展市场化IP打造到精准专业观众一站式邀约服务,以产业内容吸引高质量B端人群,打通展会从议题设计、演讲嘉宾邀约、宣传预热、精准邀观到供需对接全链路。
声明:内容取材于网络,仅代表作者观点,如有内容违规问题,请联系处理。
AI
more
万亿IPO前大震荡!OpenAI三天走俩高管,十年元老改简介走人
从边缘智能到云端融合,RISC-V 在 AI 领域的落地纪实
本周AI项目推荐|智能知识、Copula Lab、UniPat…谁在给中国模型造后训练数据与考场?
AI宣布森多夫猜想告破!陶哲轩发现它隐藏的更强结果
OpenAI研究员,曝光ASI降临时间线:大多数已成现实!
议程公布 | “优质融合下的通用学习设计与AI赋能”交流会
AI账号遭入侵?三大主流平台自查与防御指南
手机厂老板预算受限不敢做AI,攒够钱后拉起百人自研团队;云厂高管遇内网999+讨伐帖,亲自下场回应;某大厂挖角竞对被地方警告丨AI情报局
AI浪潮下的就业悖论:科技巨头一边豪赌大模型,一边挥刀裁员
曝苹果联合阿里,自研中国区AI大模型
Copyright © 2025-成都区角科技有限公司
蜀ICP备2025143415号-1
  
川公网安备51015602001305号