融资构成

智谱 9 月 13 日宣布完成约 50 亿美元融资,按公告时的汇率约合 336.54 亿元人民币,由两部分构成:约 20 亿美元(约 156.8 亿港币)的股份配售,以及约 30 亿美元(约 201.4 亿人民币)的可转债发行。

钱要花在哪

公告写明的主要用途是下一代 GLM 基础模型与「完全自训练」(Fully Self Training)体系的研发,以及大规模训练、生产推理、算力资源及相关技术基础设施的部署与升级。

其中「完全自训练」的定义值得单独看:下一代 GLM 在上一代 GLM 构建的环境中训练,形成递归式自我改进循环。具体投入包括自动化生成与筛选训练数据、构建任务环境、提升长程推理能力,以及国产芯片适配、算子开发和推理优化。

两条线同时押

智谱称这套安排同时瞄准模型能力与算力效率两个变量:完全自训练探索由模型参与构建训练资源,为后续迭代拓展数据和任务环境;芯片适配与推理优化则着眼提高同等硬件条件下的有效产出。两条路径同步投入,目的是在扩大训练规模的同时探索更高效的模型改进方式。

值得追问的三件事

  • 递归循环的判据:什么算「下一代更强」,由谁评、用什么基准评,外部能否复核
  • 训练数据来源:自动化生成与筛选的数据如何控制质量与污染,是否可追溯
  • 算力效率目标:国产芯片适配后的实测有效产出,与现有集群相比到底差多少
同一周里,一边是「给前沿减速」的公开主张,一边是把「让模型造下一代模型」写进融资用途。