【科技纵览】当人工智能从被动执行指令转向主动优化自身,行业竞争的维度便发生了根本性位移。2026年云栖大会现场,阿里巴巴披露了大模型技术的一系列突破性进展,其中最引人注目的莫过于大模型递归自我改进(RSI)技术已实质性嵌入训练、推理及芯模协同等核心环节。据悉,基于全新架构的Qwen4正处于紧锣密鼓的训练中,而未来的Qwen4.5及Qwen5版本,其参数规模将大幅扩展至5万亿至10万亿区间。与此同时,阿里的视频、语音、图像、世界、音乐及全模态模型均在近期或当天推出了迭代版本。
值得注意的是,阿里计划于11月发布下一代视频生成模型。该模型旨在突破时长限制,保持长时间序列的一致性,并赋予创作者对人物、场景及镜头的精准控制权。更关键的是,它将具备类似导演的叙事思维,实现从单一镜头生成向完整故事理解的跨越。
在千问大模型的自我进化探索上,Qwen3.8-Max展现了惊人的自主能力。在人类完全“零参与”的状态下,该模型通过自主搭建流程、构造数据、设计实验并定位缺陷,持续迭代超过一个月,完成了33轮有效更新。得益于RSI与后训练技术的联合优化,其在Artificial Analysis上的得分由40分跃升至45分,不仅跻身与Claude、GPT最强模型并列的第一阵营,更超越了GLM5.3、Kimi-K3等所有国产竞品。
在底层算力适配方面,Qwen3.8-Max同样表现出色。面对从未接触过的平头哥新款GPU,它自主适配并优化了Qwen3.8-Flash新模型的推理框架,使得单实例推理吞吐量激增96%。而在芯片模型协同设计领域,仅凭一份真实的总线模块规范,该模型自主展开了涵盖前端、验证及后端的全链路自迭代。经过超60小时的自主运行及逾万次EDA工具调用,最终实现了物理实现面积减少42%的显著优化。
阿里巴巴ATH技术副总裁、淘天集团首席科学家郑波在现场指出,三年内原生全模态统一模型将成为现实,用户体验将不再受限于模态边界。此外,阿里正加速推动大模型走向终端,发布了专为手机场景深度优化的AI手机全栈解决方案Qwen Intelligence。该平台为合作伙伴提供基于千问大模型的Agent技术底座,助力手机更可靠地处理跨应用的复杂任务。这一系列动作表明,大模型正从云端算力中心向边缘终端渗透,形成云边端协同的新生态。
阿里大模型迈入“自我进化”新阶段,Qwen4训练启动
科技区角
2026-09-22 13:30
关于科技区角:国内科技展会垂直内容策划服务商,提供从论坛内容全案策划、会展市场化IP打造到精准专业观众一站式邀约服务,以产业内容吸引高质量B端人群,打通展会从议题设计、演讲嘉宾邀约、宣传预热、精准邀观到供需对接全链路。
声明:内容取材于网络,仅代表作者观点,如有内容违规问题,请联系处理。