📰 研报摘要
查看全文 ➔摘要: 本次会议重点探讨了在 AI 时代,计算瓶颈正从 GPU 算力转移至 CPU 的协调效率。分析指出,n-gram 架构、MOE(混合专家模型)以及长上下文等技术创新在降低 GPU 负载的同时,极大地增加了 CPU 在内存管理、任务调度和地址翻译方面的压力。
行业主线:
- 技术驱动需求:n-gram 架构通过存储分层卸载增加 CPU 调度负担;MOE 模型的专家路由和动态加载提升了 CPU 的协调开销;Agentic AI 的多步推理增加了对 CPU 基础能力的依赖。
- 供需关系紧张:海外 AI 推理侧需求激增,国内在信创与 AI 双轮驱动下,高性能 CPU 出现溢价且供不应求,部分型号交货周期显著拉长。
- 协同优化趋势:产业界正通过 CGAM(时间换效率)、自适应任务分发、算子融合等策略缓解 CPU 瓶颈。
关键变化与分歧:
- 认知转变:打破了“GPU 越多越快”和“模型越小越省成本”的传统假设,CPU 的调度效率成为新的系统壁垒。
- 性能对标:国产 CPU 在特定计算场景下的性能已达到主流高端型号的 70%-80%,且具备显著的性价比优势。
受益方向与风险:
- 受益方向:高核数、大内存的国产 CPU 厂商(如海光、飞腾等)迎来历史机遇;系统级调度优化方案。
- 核心风险:高端 CPU 供应链安全风险(禁运);产能扩充速度低于需求增长速度;系统优化效果不及预期。