📰 研报摘要
查看全文 ➔本次会议主要讨论了算力租赁行业从“裸金属出租”向“Token 工厂(按 Token 计费)”模式的转型逻辑。Token 工厂模式通过分时调度提升 GPU 利用率(从 30%-50% 提升至 80% 以上),使服务商毛利率由传统模式的 20% 提升至 50%-70%,回本周期由 3-4 年缩短至 2 年以内。客户结构已从大模型厂商向中小型企业及海外客户迁移。
在算力供给侧,由于英伟达高端 GPU 获取难度加大及价格上涨,算力厂商正加速向国产卡(华为、寒武纪、海光、沐曦等)适配转型。通过软件层面的算子调优与模型管理,国产算力在推理场景的性价比已达到可用水平。目前业内头部厂商正通过与华为、运营商及地方政府的深度绑定获取算力资源,并利用“Token 工厂”模式优化国产算力的落地效率。风险方面,关注国产算力大规模铺开后的稳定性、下游 AI 应用需求的持续性以及相关政策对算力出海的规范影响。