【区角快讯】当自动驾驶行业还在为端到端大模型的落地路径争论不休时,比亚迪汽车新技术研究院的AI团队悄然交出了一份重磅答卷。7月29日,该团队在arXiv上发布了首篇关于自动驾驶基础模型的研究论文《HyWorldVLA》,正式向外界展示了其混合世界模型的技术实力。这不仅是比亚迪在智驾算法领域的首次公开亮相,更标志着其从“制造巨头”向“技术驱动者”转型的关键一步。
HyWorldVLA的核心创新在于采用了视觉-语言-动作(VLA)架构,并巧妙融合了像素级与潜在空间两种世界建模路线。这种被内部称为“两条腿走路”的策略,旨在解决单一路线的固有缺陷。像素级模型虽能像放电影般逐帧预测未来路况,细节丰富,但计算成本高昂且极易受雨雾等视觉噪声干扰;而潜在空间模型则在压缩的抽象表征中运行,效率极高,却往往因丢失关键细节而导致预测模糊。
比亚迪的方案颇具巧思:在训练阶段,利用像素级监督充当“看门狗”,强制潜在空间保留足够的环境信息;而在实际推理时,仅调用轻量的潜在空间模型以确保高效运行。消融实验数据有力地证明了这一架构的必要性——若移除像素级预测,PDMS评分将从90.59跌至87.50;若去掉潜在空间处理,分数则降至89.91。两者缺一不可,共同构成了模型的稳健基石。
在备受关注的NAVSIM v1公开基准测试中,HyWorldVLA以90.59分的PDMS成绩刷新了历史最佳纪录。值得注意的是,PDMS指标并非单纯比拼预测精度,而是综合考量责任碰撞、可行驶区域合规性、安全距离及乘坐舒适性等多维度表现,杜绝了靠“慢速行驶”刷分的可能。此外,在指标更为全面的NAVSIM v2版本中,该模型同样以89.71分领先第二名ExploreVLA近1分。特别是在655个模拟雨雾噪声的极端场景测试中,其得分高达86.87,比最强基线高出19分以上,展现出极强的环境适应能力。
这一技术突破的背后,是比亚迪日益完善的软硬件全栈自研能力。今年5月发布的4nm车规级智驾芯片“璇玑A3”,单颗算力约700TOPS,支持三芯并联实现超2100TOPS的整车算力,达到了ASIL-D最高功能安全等级。算法与芯片的闭环成型,被视为比亚迪冲击L3级自动驾驶的重要技术储备。然而,必须清醒地认识到,实验室里的榜单领先并不等同于量产车的实际体验。目前HyWorldVLA仍处于论文阶段,何时真正装车尚无明确时间表,但这无疑已让市场对比亚迪的智驾潜力有了全新的期待。
比亚迪AI首秀:HyWorldVLA模型刷榜,自研芯片闭环成型
科技区角
2026-08-12 20:02
关于科技区角:国内科技展会垂直内容策划服务商,提供从论坛内容全案策划、会展市场化IP打造到精准专业观众一站式邀约服务,以产业内容吸引高质量B端人群,打通展会从议题设计、演讲嘉宾邀约、宣传预热、精准邀观到供需对接全链路。
声明:内容取材于网络,仅代表作者观点,如有内容违规问题,请联系处理。