面壁智能MiniCPM5-2B发布:2B参数拿下4B以下最强,端侧模型卷出新高度
面壁智能联合OpenBMB推出端侧大模型MiniCPM5-2B,在AA-Index榜单以54.26平均分登顶4B以下区间,原生支持混合思考与512K上下文,发布即完成9款芯片Day0适配并即将开源,端侧AI竞争进入新阶段。

9月底,面壁智能联合OpenBMB正式推出端侧大模型MiniCPM5-2B,参数规模只有2B,却在第三方榜单AA-Index上拿下4B以下模型的最高分17分和平均分54.26,把同档位的Qwen3.5-2B等对手甩在身后。
这次发布最值得关注的不是"又多了一个2B模型",而是"小模型能做到什么程度"被刷新了。2B参数量意味着它可以在主流笔记本、手机甚至边缘设备上直接跑起来,不必完全依赖云端推理。
一份榜单成绩单里的真实信号
AA-Index是行业内用于横向比较端侧模型的综合评测,覆盖推理、知识、代码、长文本等多个维度。MiniCPM5-2B拿到平均分54.26,是当前4B以下区间最高分。"小模型也能拿到接近中尺寸模型的综合能力",是这轮成绩最有信息量的部分。
和Qwen3.5-2B等热门同档对手相比,MiniCPM5-2B在多项子任务上领先,但模型压到2B后的稳定性、复杂任务上限仍要看社区跑分。榜单只是起点,不是终点,真实落地才是分水岭。
混合思考 + 512K上下文,原生而非外挂
MiniCPM5-2B原生支持混合思考模式,同一个权重可以切换"快思考"和"慢思考"两种推理节奏,不必切换不同模型。对端侧场景来说这很关键:日常问答省电省算力,复杂问题再调深度推理。
512K上下文长度,对2B模型而言是不小的工程挑战。长上下文让端侧模型第一次具备"读完一整本书、跑完一整段代码"的可能,不再只能做碎片化的短问答。
9款芯片Day0适配,国产算力是重头
MiniCPM5-2B发布当天就完成了对华为昇腾、英伟达等9款主流芯片的适配。"Day0"意味着模型权重和推理框架在硬件上线的同一天就能跑通,开发者不必等厂商补驱动。
对国产端侧AI生态来说,这是个积极信号。当模型能同时覆盖消费级GPU和国产AI芯片,企业在私有化部署时就不用在性能和供应链之间二选一,金融、法律、医疗等敏感行业也更容易把模型放进自家内网。
对独立开发者而言,2B模型把显存门槛压到主流笔记本和工作站就能跑,写代码、写文档、做本地知识库不再是高成本的事;对内容创作者来说,端侧+长上下文的组合让"本地AI助手"能真正理解完整创作上下文,而不只是看一段答一句。
后续值得观察的几件事
第一,模型即将开源,社区实测能不能复现官方榜单成绩,是判断"纸面参数"和"真实能力"差距的关键。第二,混合思考模式在不同芯片上的功耗和延迟数据,决定它能不能在手机和IoT设备上长期运行。第三,端侧模型接下来一年的竞争焦点,会从"谁参数更大"转向"谁在真实场景里更省电、更稳"。
同主题阅读路径
查看「模型发布」栏目读完文章后,如果你想继续筛选 AI 工具,可以从真实使用场景开始做横向比较。
查看 AI 工具