智能驾驶 VLA/VOA 模型架构范式与厂商路线分析

会议纪要 行业研究 / 行业交流纪要 申万: 乘用车 理想汽车-W (02015.HK)
🔒
登录解锁完整投研深度报告与行情联动: 免费查阅完整机构研报原件、音频转写、五维画像模型与异动监控
立即登录 / 免费注册

📰 研报摘要

查看全文

本文探讨了自动驾驶架构从模块化流水线、端到端模型、VLM 演进至 VOA(Vision-Oriented-Action)的路径,重点分析了 VOA 通过增加显式动作头补齐动作生成缺口的核心价值。在技术路径上,扩散头(Diffusion Head)因轨迹平滑度高成为量产首选,而自回归分词器则在实时性上存在挑战。厂商路线方面:理想汽车的 MindVLA 采用 3D 高斯表征与 MoE 架构,实现单一 VOA 模型统一;小鹏汽车第二代 VLA 剔除显式语言中间层,利用“视觉思维链”提升推理效率并降低误差,计划 2026Q1 推送;元戎启行通过 40B VOA 模型构建 Driver、Analyst、Critic 三角色内生数据闭环。目前规模化落地核心瓶颈在于 30Hz 推理帧率带来的算力压力及多模态对齐数据的稀缺。