📰 研报摘要
查看全文 ➔摘要: 本次会议重点解读了 Seedance 2.0 等文生视频模型的技术进展,对比了国内(字节、阿里、快手等)与海外(Sora、Vidu 等)模型的差异,并深入分析了 AI Agent 的商业化路径以及字节、阿里、腾讯三大厂的 AI 战略布局。
行业主线:
- 文生视频技术迭代:模型演进方向集中在音画同声(输入输出侧的声音增强)、联网 RAG 能力提升以及 Agent 化(支持分镜连续性),旨在提升生产力。
- 算力资源瓶颈转移:除了 GPU 需求外,高级视频模型的推理对内存(Memory)和存储(SSD)产生极大压力,资源短缺正从算力向内存/存储端延伸。
- Agent 商业化分层:C 端 Agent 呈现“虚假繁荣”,用户对付费意愿低且活跃度有限;B 端 Agent 则依托云服务和生态话语权(如火山引擎),具备更强的驱动力和商业落地潜力。
关键变化与分歧:
- 模型流派分化:视频模型分为追求大片艺术效果的“导演系”和追求快节奏、泛生活实拍感的“Real 系”(如 Sora 2)。
- 大厂战略差异:字节跳动采取“农村包围城市”策略,通过豆包等泛生活功能渗透用户,并争夺“下一代小程序”的智能体入口;阿里侧重于依托阿里云的企业基数进行 AI 转化;腾讯在模型能力上相对滞后,但在社交数据和生态闭环上具有潜在优势。
受益方向与风险:
- 受益方向:具备强 B 端生态驱动力的 AI 云服务商、高性能存储与内存硬件供应商。
- 核心风险:C 端 AI 应用商业化变现不及预期、自研模型研发成本高企且风险大、算力基础设施供应受限。