“为生产力而生”的新一代混元
8 月 28 日,腾讯混元发布并开源 Hy4 preview。模型采用 MoE 架构,总参数 770B、激活参数 49B,上下文长度突破 1M;据腾讯介绍,这是混元自 2 月重建基础设施以来平均每两个月一次大版本迭代后的最新一版,采用 preview 先行、正式版跟进的方式。模型权重已开源,可通过腾讯云 Tokenhub 与 OpenRouter 接入 API,WorkBuddy/CodeBuddy 国内版及国际版、元宝、ima 等产品同步首发,WorkBuddy/CodeBuddy 面向用户推出为期 2 周的限时免费活动。
能力验证上,腾讯给出了一组内部数据:163 名内部专家、203 个工程任务盲测中,Hy4 preview 均分 2.99/4,略优于 GLM 5.3(2.92/4)与 Kimi K3(2.94/4)。方向上,模型重点强化软件工程、办公分析、游戏开发与科学研究四类真实生产力场景,并首次参与自身训练方法、数据策略、评估体系的自动优化,形成初步的递归自我改进闭环。
- 总参数 770B、激活参数 49B,上下文突破 1M
- 盲测均分 2.99/4,略优于 GLM 5.3 与 Kimi K3(腾讯内部 163 专家 / 203 任务)
- API 定价输入 6 元、输出 18 元/百万 tokens,缓存命中 0.3 元
- 自主推理优化:端到端吞吐较基线提升 31.8%
混元把 preview 当作收集真实反馈的窗口:先开源让产品与开发者用起来,再把问题带回下一版迭代,这次的数据与定价都指向同一件事——让开源模型在真实生产力任务里站住。