英伟达 Vera Rubin 瞄准智能体后训练:用更少的 GPU 训更大的模型

Vera Rubin 平台面向 agentic AI 后训练,NVIDIA 称可将最大模型训练所需 GPU 降至 Blackwell 世代的四分之一。

架构算力能效量产
算力军备竞赛

后训练(post-training)包括强化学习对齐、工具调用与多步规划的能力塑造,正成为模型能力差异化的核心环节,而非仅看预训练规模。

配合 Nemotron 3 Ultra 等开放权重模型,NVIDIA 在「硬件+训练栈+开放模型」上试图形成闭环,巩固其平台地位。

算力是 AI 的地基,选方案先算清楚显存和功耗账。