📰 研报摘要
查看全文 ➔摘要: 本报告分析了 DeepSeek V4 模型的发布及其对国产算力产业链的带动作用。DeepSeek V4 通过架构创新(CSA/HCA)实现了超长上下文处理能力与极高性价比,且已快速适配华为昇腾、寒武纪、海光信息等国产芯片平台,强化了“芯模协同”生态,有望加速 AI 大模型及国产算力需求的释放。
行业主线:
- 模型架构突破:DeepSeek V4 融合 CSA 与 HCA 混合注意力架构,大幅降低长上下文推理的显存占用与计算量,将 1M 超长上下文能力设为全系标配。
- 国产算力适配加速:华为昇腾、寒武纪、摩尔线程、沐曦股份、海光信息等厂商均相继完成适配,标志着国产芯模协同生态的完善,为模型规模化落地提供支撑。
关键变化与分歧:
- 精度策略演进:DeepSeek V4 采用“FP4+FP8”混合精度策略,相比传统 BF16 显著降低显存带宽压力,驱动硬件架构向支持 FP8 演进。
- 成本与性能对标:DeepSeek V4 在 Agent 交互、编程能力及世界知识储备上已比肩顶级闭源模型,且 API 价格具备显著竞争优势,降低了企业级 AI 应用门槛。
受益方向与风险:
- 受益方向:建议关注国产 AI 芯片产业链,尤其是能够快速适配前沿模型且具备高性能硬件架构的算力厂商。
- 核心风险:技术迭代不及预期、商业化落地放缓、行业竞争加剧导致 API 价格下行压缩盈利空间。