头版Folia Daily Briefing
← 返回头版
科技人工智能

比亚迪AI团队首次曝光,自动驾驶大模型首发即成SOTA

比亚迪汽车新技术研究院公开发表AI论文HyWorldVLA,这是一个融合Vision-Language-Action与混合世界模型的自动驾驶基础模型[1]。该模型在NAVSIM v1公开基准测试中取得PDMS 90.59的业界最佳成绩[1],体现了比亚迪在物理AI基础模型研究方面的进展。

从消融实验数据来看,混合世界模型的架构设计起到了关键作用[1]。去掉画面预测功能后,PDMS从90.59下降至87.50;去掉隐空间则降至89.91[1]。在雨雾场景测试中,HyWorldVLA达到86.87的性能表现,而纯像素方法仅为60.65[1],显示出该模型的鲁棒性优势。

论文由比亚迪汽车新技术研究院独立完成,没有外部高校或研究机构合作署名[1]。团队核心成员包括来自哈工大机器人技术与系统国家重点实验室的Liulong Ma以及具有哈工大和CMU背景的Hongbiao Zhu[1],反映出比亚迪在聚集机器人领域人才上的投入。这一论文的发表标志着比亚迪从传统汽车电子向机器人与自动驾驶一体化AI研发的转变。


比亚迪HyWorldVLA自动驾驶世界模型Vision-Language-Action