计算机行业深度报告:国产化训练从 0 到 1 里程碑,战略意义大于性能意义

机构研报 行业研究 / 行业深度专题 申万: 半导体 禾盛新材 (002290.SZ) 寒武纪 (688256.SH) 海光信息 (688041.SH) 中科曙光 (603019.SH) 华丰科技 (688629.SH) 航天电器 (002025.SZ)
🔒
登录解锁完整投研深度报告与行情联动: 免费查阅完整机构研报原件、音频转写、五维画像模型与异动监控
立即登录 / 免费注册

📰 研报摘要

查看全文

摘要: 本报告聚焦于国产大模型训练侧对国产算力适配的里程碑突破,以 DeepSeek V4 为核心案例,深度分析其在脱离英伟达 CUDA 生态及 FP8 绑定方面的技术路径及其对国产算力产业链的战略意义。

行业主线:

  1. 国产化训练实现从 0 到 1 突破:DeepSeek V4 首次由华为昇腾芯片参与训练,验证了国产算力支撑顶级通用大模型全链路训练的可行性,标志着国产算力应用从推理侧向训练侧的实质性跨越。
  2. 底层技术去绑定:通过引入 MXFP4 量化感知训练、TileLang 领域专用语言以及 MegaMoE2 融合内核,系统性降低了对 NVIDIA 硬件和软件生态的依赖,降低了国产芯片的迁移成本。

关键变化与分歧:

  1. 战略意义高于性能表现:尽管在多模态等领域与国际顶尖模型仍有差距,但实现了算力生态的自主可控,解决了 AI 产业发展的底线安全问题。
  2. 超长上下文效率飞跃:首创 CSA+HCA 混合注意力架构,将百万 token 上下文的推理计算量和显存占用大幅降低,解决了长程 Agent 任务的算力瓶颈。

受益方向与风险:

  1. 受益方向:国产 AI 芯片与算力基础设施核心厂商、CPU 产业链核心配套标的以及算力硬件上游核心供应链。
  2. 核心风险:大模型迭代节奏及国产算力软硬件生态适配进度不及预期,行业竞争加剧以及政策监管趋严。