📰 研报摘要
查看全文 ➔摘要: 本报告深入分析了阿里云在 AI 基础设施领域的全栈布局,重点探讨了自研的磐久 AL128 超节点服务器与 UPN512 高性能网络架构。阿里云通过 IaaS、PaaS、MaaS 三层体系构建核心竞争力,旨在通过硬件垂直整合解决 AI 算力与网络短板。
行业主线:
- 全栈 AI 基础设施构建:阿里云通过发布 AL128 单机柜超节点和 UPN512 技术架构,实现了从底层芯片(真武 M890)、超节点服务器到高性能网络的完整补全,强化了其在中国 AI 云市场的龙头地位。
- 超节点技术演进:AL128 采用定制双宽机柜与三层互连网络架构(Scale Up/Scale Out/DCN),通过正交架构降低损耗,提升 GPU 互连带宽至 14T-28Tb。
- 网络架构解耦:UPN512 推动从紧耦合 AI Rack 向盒式化解耦系统转变,利用 LPO/NPO 光互连方案降低成本 30% 以上并提升可靠性。
关键变化与分歧:
- 从电互连向光互连迁移:UPN512 通过光互连打破物理距离限制,使 xPU 能够分布在多个机柜中,改变了传统的超节点部署形态。
- 以太网生态的深度应用:基于高通量以太网的单层网络架构,挑战传统 IB 网络的统治地位,通过内置计算引擎实现算力卸载。
受益方向与风险:
- 受益方向:重点关注高性能交换芯片、AI 算力芯片、内存接口芯片等产业链环节。
- 核心风险:AI 应用商业化落地不及预期导致资本开支放缓;国产替代技术成熟度不足;行业竞争加剧导致价格压力。