阿里Qwen 3.8 Max-0902发布:编程性能飙升,价格不变登顶Code Arena

科技区角 2026-09-02 15:01

【区角快讯】9月2日这一天,全球大模型领域可谓热闹非凡。除了Fable 5.1与Mythos 5.1相继亮相外,谷歌也推出了Gemini 3.8 Flash。与此同时,阿里巴巴正式发布了Qwen 3.8 Max-0902。值得注意的是,在短短一个月内,该系列模型的编程能力实现了成倍增长,这一迭代速度令人印象深刻。

目前,Qwen 3.8 Max-0902已全面接入QwenCloud API服务。尽管性能大幅跃升,其定价策略却保持了极高的诚意:输入端维持2美元/百万Token,输出端为6美元/百万Token,真正做到了“升级不加价”,此举在开发者社区中收获了广泛好评。

从技术底层来看,新版模型与8月发布的Qwen 3.8 Max共享同一底座,参数量依旧高达2.4万亿,并支持100万上下文窗口。此次更新的核心聚焦于Coding(编码)与Cowork(协作)的后训练优化,旨在显著增强其在复杂工作流处理及长时间Agent任务中的表现力。

千问官方披露的最新基准测试数据显示,其在Coding编程领域的八项关键任务中均取得全面提升。其中,TerminalBench 3.0得分从11.3激增至29.0;DeepSWE 1.1由56.6攀升至69.3;QwenSWEbench V2则从55.1上涨到70.0。此外,职业任务JobBench也从53.4提升至64.0。虽然在Agent及多模态任务上也有进步,但幅度相对温和,变化不如编程领域那般剧烈。

尤为值得关注的是,在Code Arena的WebDev评测中,Qwen 3.8 Max-0902以1691分的高分强势登顶榜首。这一成绩不仅超越了众多竞争对手,更将Opus5等美国顶级大模型甩在身后,彰显了中国大模型在垂直编码场景下的强劲竞争力。

关于科技区角:国内科技展会垂直内容策划服务商,提供从论坛内容全案策划、会展市场化IP打造到精准专业观众一站式邀约服务,以产业内容吸引高质量B端人群,打通展会从议题设计、演讲嘉宾邀约、宣传预热、精准邀观到供需对接全链路。
声明:内容取材于网络,仅代表作者观点,如有内容违规问题,请联系处理。
AR 阿里
more
英国车迷自制单座跑车Gasolini AR1,成本仅5万元合法上路
MCU可扩展软件框架:BSP、HAL、Middleware与RTOS解析
JioHotstar出海首战:剥离体育版权,能否撬动全球南亚裔市场?
XREAL a01体验报告:当“随身巨幕”遇上散热尴尬,AR眼镜的观影悖论
手把手实测!openEuler 24.03 部署 SGLang,Benchmark 数据出炉
如何搭建嵌入式软件工程师的专属Harness?
为Agent Harness做自进化,CREAO AI完成千万级美元新融资|智能涌现首发
Harness Continual Learning:持续学习,从模型参数走向Agent Harness
对话 Sharpa 李一帆:通用机器人要么全能,要么无能
Paradromics获得FDA批准,脑机接口开始接入个人设备
Copyright © 2025-成都区角科技有限公司
蜀ICP备2025143415号-1
  
川公网安备51015602001305号