📰 研报摘要
查看全文 ➔摘要: 本次会议由浙商证券分析师分享,重点讨论“世界模型”如何成为AI产业共识,分析了从渲染器(Renderer)到模拟器(Simulator)再到规划器(Planner)的技术演进路径,并点评了全球头部多模态模型的商业化进展与竞争格局。
行业主线:
- 世界模型三层能力演进:模型能力正从单纯的画面生成(Renderer)向理解状态预测(Simulator)及行动闭环(Planner)演进。目前行业处于 Renderer 阶段,中期的核心壁垒在于 Simulator 的突破,以实现长视频生成和真实物理交互。
- 技术范式转移:多模态建模正从传统的“串联模式”转向“联合建模模式”,旨在减少理解与生成之间的信息断裂,提升主体一致性和空间连续性。
- 商业化早期阶段:视频生成市场潜力巨大(测算约为千亿美金),目前处于优质供给推动需求的早期,模型质量仅是“入场券”,最终胜出取决于生态嵌入、分发能力及推理成本。
关键变化与分歧:
- 语言先验 vs 视觉证据:强调语言模型无法替代世界模型,因为语言先验容易走捷径导致不 Grounded,真正的 AGI 需要基于视觉证据的状态预测。
- 榜单不代表终局:SOTA 模型的排名轮换极快,技术尚未完全收敛,竞争核心将从单点效果转向产品差异化和商业闭环。
受益方向与风险:
- 受益方向:具备高质量模型供给能力并能将其转化为实质收入的公司。重点关注快手(可林模型 ARR 增长迅速)及 MiniMax 等公司。
- 核心风险:技术收敛速度低于预期、推理成本过高、合规与政策风险。