📰 研报摘要
查看全文 ➔本次交流主要讨论算力租赁行业从“卖卡时”向“卖Token”模式的转型趋势。专家指出,Token工厂模式通过将计费方式从GPU时长转变为Token产出,配合高频模型调度与技术优化,能显著提升算力使用效率(由传统30%-50%提升至80%以上),毛利率从20%左右提升至50%以上。当前市场需求已从单纯的大模型厂商外溢转向中小企业及海外开发者。针对英伟达算力受限背景,国产卡(如华为昇腾、海光、沐曦等)在推理场景的性价比优势逐渐凸显,通过软件层面编译与算子调优,国产算力在Token工厂模式下已具备可用性。此外,会议探讨了出海模式、与运营商的合作分成机制,以及具身智能领域带来的算力训练需求增长。未来具备核心技术优化能力及运营商/政府资源优势的厂商将具备更强的竞争壁垒。