面壁智能开源 MiniCPM5-2B 模型
面壁智能开源 MiniCPM5-2B AI 模型:AA 榜单全球 4B 以下第一,初具端侧通用 Agent 能力
面壁智能开源了 2B 参数的 MiniCPM5-2B,在 4B 以下模型中表现第一,还支持工具调用和智能体任务。
面壁智能联合 OpenBMB 开源 MiniCPM5-2B 模型,参数规模为 2B。在 AA 榜单评测中,该模型以 23 分成为全球 4B 以下开源基座模型综合表现第一。在 Agentic Index 指标上,MiniCPM5-2B 得分 20 分,远超同级模型的 2 分。在 34 项基准评测中平均得分 53.9 分,领先第二名 20.7 分。
面壁智能开源 MiniCPM5-2B AI 模型:AA 榜单全球 4B 以下第一,初具端侧通用 Agent 能力
IT之家 9 月 9 日消息,面壁智能昨日联合 OpenBMB 开源社区正式开源新一代“小钢炮” MiniCPM5-2B 。 MiniCPM5-2B 的参数规模为 2B,是一款高密度端侧语言基座模型,支持工具调用、深度搜索、代码生成等任务,官方称 初步实现了 端侧通用 Agent 雏形 。 根据榜单 Artificial Analysis Intelligence Index(以下简称「AA 榜单」)的最新评测,MiniCPM5-2B 综合能力得分 23 分, 在全球 4B 参数规模以下的开源基座模型中综合表现第一 。 官方表示,在评测智能体能力的 Agentic Index 指标上,MiniCPM5-2B 更是断层式领先:总分达 20 分,同级模型(如 LFM2.5-2.6B、Granite 4.2 3B、Mistral 3 3B)仅 2 分。 MiniCPM5-2B 在覆盖代码推理、数学推理、指令遵循、综合知识、长文本、工具调用和智能体任务等方向的 34 项基准评测中,平均得分 53.9 分,排名第一,不仅领先同级 2B 模型第二名的 33.2 分,也超过 4B 模型中表现最佳的 Qwen3.5-4B。 以 1000 分为人类基线,MiniCPM5-2B 在真实任务评测中获得 891 分,居于 4B 以下模型榜首。 随着 MiniCPM5-2B 的开源,面壁智能与 OpenBMB 还开源了全新的自研强化学习框架 Meshy 与基于奖励的强化学习策略 JustRL II,IT之家附相关链接: MiniCPM5-2B 开源链接 (含模型与 UltraData 系列数据) HuggingFace: https://huggingface.co/collections/openbmb/minicpm5 GitHub: https://github.com/OpenBMB/MiniCPM Meshy 框架开源链接 GitHub: https://github.com/OpenBMB/Meshy 博客: https://maydomain.notion.site/meshy-blog-zh JustRL II 强化学习算法 博客: https://panhaoxuan.notion.site/justrl-ii-small-llms-to-128k-reasoning-with-a-critic-cn