全球模型厂技术演进与算力基础设施解读纪要

会议纪要 行业研究 / 行业交流纪要 申万: 半导体
🔒
登录解锁完整投研深度报告与行情联动: 免费查阅完整机构研报原件、音频转写、五维画像模型与异动监控
立即登录 / 免费注册

📰 研报摘要

查看全文

摘要: 本次会议重点解读了 Google、Anthropic 及 OpenAI 等全球主流模型厂的最新技术路径、模型参数规模、数据策略以及算力与电力基础设施的瓶颈情况。

行业主线:

  1. 模型规模与架构演进:下一代公开模型参数量预计将提升至 10T-20T 级别。技术路径上,模型架构正从“小专家” MoE 转向“大专家”模式,以更好地适配长文本任务和长程目标。
  2. 数据策略升级:高质量的“looping”轨迹数据(捕捉解决问题的完整流程而非静态片段)成为提升 Coding 等复杂任务能力的关键,预训练阶段的轨迹数据积累决定了基础能力上限。

关键变化与分歧:

  1. 算力瓶颈转移:算力约束已从单纯的芯片短缺转向电力供应短缺,导致部分新芯片无法通电,迫使厂商通过租用外部数据中心或拆除旧卡来腾出空间。
  2. 能力领先的可持续性:Anthropic 凭借对用户反馈闭环数据的有效利用在 Coding 领域建立领先,而 Google 和 OpenAI 在预训练数据质量或架构选型上存在追赶压力。

受益方向与风险:

  1. 受益方向:能够提供低成本、高能效算力方案的芯片供应商;拥有大规模真实用户入口并能形成高质量数据闭环的模型厂。
  2. 核心风险:电力供应缺口导致算力部署进度低于预期;算力租赁价格大幅上调增加模型研发成本;架构选型失误导致后训练迭代效率低下。