【区角快讯】9月2日这一天,全球大模型领域可谓热闹非凡。除了Fable 5.1与Mythos 5.1相继亮相外,谷歌也推出了Gemini 3.8 Flash。与此同时,阿里巴巴正式发布了Qwen 3.8 Max-0902。值得注意的是,在短短一个月内,该系列模型的编程能力实现了成倍增长,这一迭代速度令人印象深刻。
目前,Qwen 3.8 Max-0902已全面接入QwenCloud API服务。尽管性能大幅跃升,其定价策略却保持了极高的诚意:输入端维持2美元/百万Token,输出端为6美元/百万Token,真正做到了“升级不加价”,此举在开发者社区中收获了广泛好评。
从技术底层来看,新版模型与8月发布的Qwen 3.8 Max共享同一底座,参数量依旧高达2.4万亿,并支持100万上下文窗口。此次更新的核心聚焦于Coding(编码)与Cowork(协作)的后训练优化,旨在显著增强其在复杂工作流处理及长时间Agent任务中的表现力。
千问官方披露的最新基准测试数据显示,其在Coding编程领域的八项关键任务中均取得全面提升。其中,TerminalBench 3.0得分从11.3激增至29.0;DeepSWE 1.1由56.6攀升至69.3;QwenSWEbench V2则从55.1上涨到70.0。此外,职业任务JobBench也从53.4提升至64.0。虽然在Agent及多模态任务上也有进步,但幅度相对温和,变化不如编程领域那般剧烈。
尤为值得关注的是,在Code Arena的WebDev评测中,Qwen 3.8 Max-0902以1691分的高分强势登顶榜首。这一成绩不仅超越了众多竞争对手,更将Opus5等美国顶级大模型甩在身后,彰显了中国大模型在垂直编码场景下的强劲竞争力。
阿里Qwen 3.8 Max-0902发布:编程性能飙升,价格不变登顶Code Arena
科技区角
2026-09-02 15:01
关于科技区角:国内科技展会垂直内容策划服务商,提供从论坛内容全案策划、会展市场化IP打造到精准专业观众一站式邀约服务,以产业内容吸引高质量B端人群,打通展会从议题设计、演讲嘉宾邀约、宣传预热、精准邀观到供需对接全链路。
声明:内容取材于网络,仅代表作者观点,如有内容违规问题,请联系处理。