智谱GLM-5.3-FlashX发布,推理速度突破200 tokens/s

科技区角 2026-09-18 13:31

【科技纵览】9月18日,智谱正式对外发布了全新模型GLM-5.3-FlashX。这款新品最引人注目的指标,是其最高可达200 tokens/s的生成速度,旨在为企业级用户及广大开发者提供更为迅捷、丝滑的交互体验。

回溯此前,该系列模型曾以“Ox Alpha”的代号亮相全球开发者社区,随着调用量的持续激增,市场需求日益旺盛。为应对这一挑战,智谱依托于十万张国产芯片构建的庞大推理算力底座,显著加大了对基础设施(Infra)层面的资源倾斜与底层优化力度。

从行业视角看,GLM-5.3-Flash长期以来在同尺寸模型中保持着顶尖的智能水准。此次在速度上的大幅跃升,不仅补齐了性能短板,更使其在智能表现、成本控制以及响应速度三个维度上,形成了极具竞争力的综合优势。这种“又快又好又省”的策略,或许正是大模型走向大规模商业化落地的关键破局点。

关于科技区角:国内科技展会垂直内容策划服务商,提供从论坛内容全案策划、会展市场化IP打造到精准专业观众一站式邀约服务,以产业内容吸引高质量B端人群,打通展会从议题设计、演讲嘉宾邀约、宣传预热、精准邀观到供需对接全链路。
声明:内容取材于网络,仅代表作者观点,如有内容违规问题,请联系处理。
more
OPPO 姜昱辰:大模型的差距越来越小,AI 手机的差距才刚拉开
出海陌生市场,AI 先替品牌读懂当地人
马斯克再住工地:xAI孟菲斯超算中心扩建,首富身家逼近万亿
当AI走进工厂,它需要看见什么?
新架构・芯产品 | 苏州睿芯高光D35:全球领先的RISC‑V数据流物理AI量产芯片
豆包座舱助手发布,华为专营店将调整问界售卖方式,苹果自研AI服务器芯片,抖音声音侵权举报入口上线,这就是今天的其他大新闻!
Astera Labs发布CXL 3.2内存控制器,AI推理延迟大幅降低
开源模型夯爆了!ZDTaichu5.0-9B,10B以内空间具身智能卷出通用类第一
9月21日-23日,世界人工智能开源大赛GOAI开源周开放报名中!
AI助手“电话战”打响:Instinct估值剑指百亿,Meta Muse紧追不舍
Copyright © 2025-成都区角科技有限公司
蜀ICP备2025143415号-1
  
川公网安备51015602001305号