一句话定位
9 月 8 日面壁智能联合 OpenBMB 开源的 MiniCPM5-2B,是 2B 级端侧基座里第一个把“Agent 能力”当主要卖点的模型:综合成绩在 AA 榜压过 4B 以下全部开源模型,让端侧跑工具调用与多步任务第一次有了值得认真评估的选项。
数据表现
- AA 榜综合 23 分,位居全球 4B 参数以下开源基座模型第一;同等 token 消耗下智力得分接近同级模型的一倍
- Agentic Index 20 分,高于 Granite 4.2 8B(9 分)、Qwen3.5 9B(7 分)等参数数倍于己的模型
- 代码、数学、长文本、指令遵循、工具调用等 34 项任务平均 53.9 分同级第一;真实任务评测 891 分(人类基线 1000),高于 Gemma 4 12B(647 分)
规格与开源程度
- 总参数约 2.5B(非嵌入 1.98B),上下文 131,072(128K),Apache-2.0 协议
- 支持工具调用、深度搜索、代码生成,权重已上线 Hugging Face(openbmb/MiniCPM5-2B)
- 同步公开训练配方与数据集:UltraData-Code、UltraData-SFT-Agent-2609、UltraData-RL-2609 等
边界:该开源版本为文本生成模型;榜单与能力数据以官方和公开评测口径为主,端侧真实场景的延迟、功耗与稳定性,需按目标芯片和具体任务实测后再下结论。
端侧 Agent 的选型表里,MiniCPM5-2B 第一次让 2B 档位变得值得认真比较。