📰 研报摘要
查看全文 ➔摘要: 本报告分析了 DeepSeek-V4 的发布及其对国产 AI 算力生态的深远影响。DeepSeek-V4 通过技术创新(如 CSA 与 HCA 混合架构)实现了极致的性价比,并与昇腾、寒武纪等国产芯片完成深度适配,标志着国产 AI 模型与国产芯片的生态闭环初步形成,将驱动 B 端应用规模化落地并拉动算力基础设施需求。
行业主线:
- 极致性价比驱动应用:DeepSeek-V4 的 Pro 和 Flash 版本大幅降低了 Token 推理成本,降低了 B 端应用的门槛。
- 国模国芯全栈适配:模型与国产芯片(如昇腾 950、寒武纪)的 Day 0 适配,实现了从模型到算力底层的协同优化。
关键变化与分歧:
- 推理效率大幅提升:采用 CSA(压缩稀疏注意力)与 HCA(重度压缩注意力)交替部署,显著降低了 KV 缓存占用和推理 FLOPs,尤其在长上下文场景下性能提升明显。
- 国产适配落地:在昇腾节点上实现了高吞吐量,且相关适配代码同步开源,加速了国产 AI 基础设施的部署。
受益方向与风险:
- 受益方向:关注国产芯片厂商(寒武纪、天数智芯等)及其上游供应链(盛合晶微、芯原股份、华虹半导体等)。
- 核心风险:AI 模型迭代不及预期、地缘政治导致的供应链中断、电力供应瓶颈及市场竞争加剧。