📰 研报摘要
查看全文 ➔本文探讨了自动驾驶架构从模块化流水线、端到端模型、VLM 演进至 VOA(Vision-Oriented-Action)的路径,重点分析了 VOA 通过增加显式动作头补齐动作生成缺口的核心价值。在技术路径上,扩散头(Diffusion Head)因轨迹平滑度高成为量产首选,而自回归分词器则在实时性上存在挑战。厂商路线方面:理想汽车的 MindVLA 采用 3D 高斯表征与 MoE 架构,实现单一 VOA 模型统一;小鹏汽车第二代 VLA 剔除显式语言中间层,利用“视觉思维链”提升推理效率并降低误差,计划 2026Q1 推送;元戎启行通过 40B VOA 模型构建 Driver、Analyst、Critic 三角色内生数据闭环。目前规模化落地核心瓶颈在于 30Hz 推理帧率带来的算力压力及多模态对齐数据的稀缺。