AI 时代 CPU 协调效率与需求复兴分析会议纪要

会议纪要 行业研究 / 行业交流纪要 申万: 半导体 海光信息 (688041.SH)
🔒
登录解锁完整投研深度报告与行情联动: 免费查阅完整机构研报原件、音频转写、五维画像模型与异动监控
立即登录 / 免费注册

📰 研报摘要

查看全文

摘要: 本次会议重点探讨了在 AI 时代,计算瓶颈正从 GPU 算力转移至 CPU 的协调效率。分析指出,n-gram 架构、MOE(混合专家模型)以及长上下文等技术创新在降低 GPU 负载的同时,极大地增加了 CPU 在内存管理、任务调度和地址翻译方面的压力。

行业主线:

  1. 技术驱动需求:n-gram 架构通过存储分层卸载增加 CPU 调度负担;MOE 模型的专家路由和动态加载提升了 CPU 的协调开销;Agentic AI 的多步推理增加了对 CPU 基础能力的依赖。
  2. 供需关系紧张:海外 AI 推理侧需求激增,国内在信创与 AI 双轮驱动下,高性能 CPU 出现溢价且供不应求,部分型号交货周期显著拉长。
  3. 协同优化趋势:产业界正通过 CGAM(时间换效率)、自适应任务分发、算子融合等策略缓解 CPU 瓶颈。

关键变化与分歧:

  1. 认知转变:打破了“GPU 越多越快”和“模型越小越省成本”的传统假设,CPU 的调度效率成为新的系统壁垒。
  2. 性能对标:国产 CPU 在特定计算场景下的性能已达到主流高端型号的 70%-80%,且具备显著的性价比优势。

受益方向与风险:

  1. 受益方向:高核数、大内存的国产 CPU 厂商(如海光、飞腾等)迎来历史机遇;系统级调度优化方案。
  2. 核心风险:高端 CPU 供应链安全风险(禁运);产能扩充速度低于需求增长速度;系统优化效果不及预期。