【科技纵览】9月18日,智谱正式对外发布了全新模型GLM-5.3-FlashX。这款新品最引人注目的指标,是其最高可达200 tokens/s的生成速度,旨在为企业级用户及广大开发者提供更为迅捷、丝滑的交互体验。
回溯此前,该系列模型曾以“Ox Alpha”的代号亮相全球开发者社区,随着调用量的持续激增,市场需求日益旺盛。为应对这一挑战,智谱依托于十万张国产芯片构建的庞大推理算力底座,显著加大了对基础设施(Infra)层面的资源倾斜与底层优化力度。
从行业视角看,GLM-5.3-Flash长期以来在同尺寸模型中保持着顶尖的智能水准。此次在速度上的大幅跃升,不仅补齐了性能短板,更使其在智能表现、成本控制以及响应速度三个维度上,形成了极具竞争力的综合优势。这种“又快又好又省”的策略,或许正是大模型走向大规模商业化落地的关键破局点。
智谱GLM-5.3-FlashX发布,推理速度突破200 tokens/s
科技区角
2026-09-18 13:31
关于科技区角:国内科技展会垂直内容策划服务商,提供从论坛内容全案策划、会展市场化IP打造到精准专业观众一站式邀约服务,以产业内容吸引高质量B端人群,打通展会从议题设计、演讲嘉宾邀约、宣传预热、精准邀观到供需对接全链路。
声明:内容取材于网络,仅代表作者观点,如有内容违规问题,请联系处理。