📰 研报摘要
查看全文 ➔本报告深入探讨视频生成模型的发展现状与趋势。技术端,DiT(Diffusion Transformer)已成为主流架构,模型正由单纯的视觉生成向原生音视频联合生成、多模态上下文理解与长叙事创作演进。报告指出,随着技术范式趋于规模化(Scaling),核心瓶颈已从生成画质转变为物理合理性、时序一致性及长时逻辑控制。产业端,以AI微短剧为代表的商业化应用持续爆发,Seedance、Kling、H3、Veo等头部模型在叙事控制、角色一致性及专业分镜编辑等领域各具特色。尽管Sora的阶段性关停反映了高昂成本与商业模式不确定的挑战,但视频生成赛道整体正处于商业化加速验证期,具备良好的长期潜力。