台上只有名字和路线图
刘大一恒在 2026 云栖大会主论坛的演讲题为「Qwen:走向真实世界的智能体」,但大屏内容写的是「Qwen4 系列,即将推出」,下方三个名字:Qwen4-Max、Qwen4-Flash 与 Qwen4-Plus、Qwen4-27B。据现场报道,三条线的分工是 Max 推能力上限、Flash 与 Plus 平衡效率与价格、27B 面向本地部署。官方没有发布任何模型,表示 Qwen4 仍在训练阶段——也就是说,这四个名字对应的是计划,而不是本周能调用的端点。
参数规模的时间表
官方给出的路径是:Qwen2.5 时代旗舰规模 72B,如今 Qwen3.8-Max 达到 2.4 万亿总参数,两年约 33 倍;Qwen4 基于新一代架构已经进入训练;再往后 Qwen4.5 与 Qwen5 规划把总参数推到 5 万亿到 10 万亿。需要分清的是,5 到 10 万亿属于 Qwen4.5 与 Qwen5 的规划目标,不是 Qwen4 的规格,公开材料里这两个数字经常被混着说。
现在能验证的只有两件事
- 能力基线:Qwen3.8-Max 自 2026 年 8 月 3 日起正式可用,定价每百万输入 2 美元、输出 6 美元,在完整 1M 上下文上不加长文附加费;
- 开源线索:Qwen3.8-Flash 的权重在 8 月 26 日开源,官方称它是 Qwen4 架构的前身版本——125B 参数加 51B N-gram embedding,每个 token 只激活约 6B,原生 262K 上下文、可用 YaRN 扩展到 1M。
顺带公开的 RSI 进展
会上也讲了递归自我改进(RSI)的实证结果:Qwen3.8-Max 在完全自动化的流程里跑了一个多月,覆盖流水线设计、数据校验、迭代实验与错误诊断,完成 33 轮迭代,Artificial Analysis 分数从 40 提升到 45;另一个芯片设计实验里,模型在 60 多个小时里走完整个设计周期、调用 EDA 工具超过 1 万次,产出了可用于生产的总线模块,官方称芯片面积减少 42% 且性能没有损失。这些数字都是厂商口径,没有第三方复核。
对今天要动手的人来说,结论很简单:能用的是 Qwen3.8 这一代;Qwen4 现在只是一个有纸面线索的路线图。