【科技纵览】当国产算力从“可用”向“好用、易用、普惠”迈进时,硬件底座的突破显得尤为关键。8月21日,中诚华隆在北京举行2026 GPU新品发布会,正式推出第二代HL200推理芯片及超节点智算集群方案。工业和信息化部电子信息科技委执行副主任毕开春、中国科技咨询协会理事长刘志光出席并致辞。
HL200推理芯片直指万亿参数大模型的商业化痛点,原生支持FP4、FP8超低精度推理,同时兼容主流FP16精度。在性能指标上,该芯片单卡FP16/BF16算力为0.5P,FP8算力达2P,FP4算力更是高达4P,能效比达到5.12 TFLOPS/W。生态兼容性方面,全面适配PyTorch、ONNX、vLLM等主流技术栈。据现场披露的数据,在DeepSeek V4 Flash、GLM 5.2等主流大模型的适配测试中,HL200相较于国际同级芯片,Prefill全流程性能全面领先,解码延迟优势显著。
同步亮相的HL200超节点智算集群方案,展现了强大的扩展能力。单机柜支持64张GPU高速互联,单节点最高可堆叠1024卡,横向扩展最高可达10240卡,覆盖从8卡到万卡的全场景部署需求。发布会现场,中诚华隆与中国能建所属中电工程、浪潮信息、紫光智算、光环云等十余家企业达成战略合作。
中诚华隆董事长王嘉诚表示,公司坚持“不做参数的追随者,只做推理效率的定义者”。作为国内少数具备“芯片+整机+解决方案”全栈自主可控能力的科技企业,其核心产品已中标中国移动、中国电信等头部运营商及全国20余省份近50个重点标段。这一系列动作表明,国产算力正通过软硬协同与生态共建,加速填补高端推理市场的空白。
中诚华隆发布第二代HL200推理芯片,瞄准万亿参数大模型商业化落地
科技区角
2026-08-24 13:30
关于科技区角:国内科技展会垂直内容策划服务商,提供从论坛内容全案策划、会展市场化IP打造到精准专业观众一站式邀约服务,以产业内容吸引高质量B端人群,打通展会从议题设计、演讲嘉宾邀约、宣传预热、精准邀观到供需对接全链路。
声明:内容取材于网络,仅代表作者观点,如有内容违规问题,请联系处理。