📰 研报摘要
查看全文 ➔摘要: 本次会议邀请互联网大厂专家探讨 AI Agent 时代对 CPU 需求的潜在驱动。专家详细分析了 Agent 在执行复杂任务(如多网页检索、代码运行)时对 CPU 算力的依赖,提出了“工作型 CPU 集群”与“调度型 CPU 集群”的架构概念,并讨论了 GPU 利用率与 CPU 配置的联动关系以及 AI 应用对存储(SSD/DRAM)的影响。
行业主线:
- CPU 需求分层:Agent 任务分为调度型(资源消耗低,受限于 OS 沙箱线程数)和工作型(资源消耗高,如无头浏览器渲染,一个网页对应一个物理核)。需求爆发将驱动专门的“工作型 CPU 集群”建设。
- GPU 与 CPU 的协同增强:为避免 CPU 成为瓶颈并提升 GPU 利用率,硬件规格趋向于增加 CPU 配比(如英伟达 GB 系列)。同时,多模态检索增加了 CPU 在模态识别、分发与寻址上的时间片消耗。
- 存储需求演进:文生视频应用驱动 SSD 需求长期增长。针对 KV Cache,行业在探索从 DRAM 向 SSD 迁移及文本压缩优化,以平衡成本与用户体验。
关键变化与分歧:
- 国内外需求落差:海外 Agent(如 Grok, OpenAI)在深层研究和付费场景下已显现强 CPU 需求;国内目前仍以助手型 Chatbot 为主,高频 Agent 场景活跃度较低,尚未触及 CPU 需求爆发点。
- 瓶颈转移:在极速推理模型普及后,任务瓶颈可能从 GPU 推理转移到 CPU 执行的网页浏览、信息清洗等前置处理环节。
受益方向与风险:
- 受益方向:高核数高性能 CPU 供应商(如英特尔、AMD)、AI 服务器硬件厂商、高速存储(SSD)供应商。
- 核心风险:国内 Agent 应用落地节奏慢于预期;GPU 厂商通过定制化芯片完全替代通用 CPU 的风险。