十条举措,抓手是把 Token 当成商品
9 月 18 日,北京市经信局与市发改委联合印发《北京市加快词元经济发展的行动方案(2026—2028 年)》。文件开篇写明依据是《国务院关于深入实施「人工智能+」行动的意见》(国发〔2025〕11 号),目标是以词元(Token)为抓手培育智能经济新形态,施行期到 2028 年 12 月 31 日。
这套方案的结构值得注意:它没有沿用「算力券」「智算中心补贴」这类以硬件规模为口径的老思路,而是把词元当作可计量、可定价、可流通的中间产品,围绕它去搭生产、评测、分发三个环节。
生产端:词元工厂要按指标分级
方案提出「高标准建设词元工厂」,并制定北京市词元工厂分级评价标准。评价覆盖的核心技术指标包括模型适配数量、词元吞吐速度、首字延迟、缓存命中率、电能利用效率(PUE)等,同时优化土地资源、能耗指标、通信网络等要素保障,对具有行业引领力的词元工厂给予支持。
这组指标里,只有 PUE 是传统数据中心的考核项;首字延迟与缓存命中率是推理服务的服务质量指标,过去基本停留在厂商内部的 SLO 文档里。把它们写进分级标准,意味着词元工厂之间要比的不再是卡的数量,而是同样的电与网络能产出多少真正可用的输出。
流通端:计量、结算与统一接口
- 建立词元质量评测体系,探索建设词元测试平台,形成客观公正的词元性能与质量评测标准;
- 打造词元分发平台,为开发者提供统一接口、模型聚合、词元计量与结算服务;
- 推动词元分发平台纳入新型基础设施布局,形成面向智能经济的高效服务入口;
- 健全词元市场化定价流通机制。
十条举措还覆盖了基础模型技术迭代与芯模适配、模型轻量化与边缘端部署、智能体培育与应用、智能体核心软件生态、海外服务能力、数据本体技术等方向,并在人才侧提出「词元工程师再技能化培训」,对软件工程师开展模型调优、推理加速、平台运维、安全合规等培训。
把首字延迟、缓存命中率、PUE 写进分级标准,等于要求算力供给方把过去只在内部看的指标变成可对外审计的报表。
谁会被这份文件改变
最直接的两类主体:一是以推理服务为主要产品形态的算力供给方,分级评价标准一旦落地,它们的对外披露口径、能拿到的能耗与土地指标都会跟着变;二是做多模型接入的开发者工具与应用团队,如果分发平台真的统一了接口与计量结算,模型比价与切换的成本会明显下降。
需要保持清醒的是,方案给的是框架与方向,分级标准的具体门槛、评测方法、支持力度都还没有随文件一起公布。判断进展该盯三件事:词元工厂分级评价标准的细则、词元测试平台的实际功能、以及分发平台能不能完成跨厂商的计量与结算——最后一条是它区别于普通 API 聚合页的关键。