智迹闻AuraTracer
EN

EVENT DOSSIER

OpenBMB发布了MiniCPM5-2B:这是一个拥有52亿参数、在34个基准测试中平均得分达53.9分的密集模型,专为在设备上运行而设计。

2026-09-08 03:18 大模型 🔥 42.2 事件热度
1家信源
1天持续发酵
42.2事件热度
5个提及
摘要由 AI 生成

OpenBMB 于 2026 年 9 月 7 日发布 MiniCPM5-2B 大语言模型。该模型拥有约 25.2 亿参数,采用稠密架构设计,旨在实现高效的端侧部署。在涵盖的 34 项基准测试中,其平均得分为 53.9。

相关事件RELATED EVENTS
关键实体KEY ENTITIES
LlamaForCausalLMMiniCPM5-2BOpenBMBQwen3.5-4Bgranite-4.2-3B

事件框架EVENT FRAME

产品发布

OpenBMB MiniCPM5-2B 开源2.52B参数大模型,34项基准平均分53.9

报道态势 · 每日报道量LANGUAGE SPLIT

实体关系
LlamaForCausalLM × Mini…1LlamaForCausalLM × Open…1LlamaForCausalLM × Qwen…1LlamaForCausalLM × gran…1MiniCPM5-2B × OpenBMB1MiniCPM5-2B × Qwen3.5-4B1

信号强度SIGNALS

关键词热度
  • OpenBMB1
  • MiniCPM5-2B1
  • Qwen3.5-4B1
  • granite-4.2-3B1
  • LlamaForCausalLM1

全部报道(1)SOURCES

M MarkTechPost en 2026-09-08 03:18

OpenBMB Releases MiniCPM5-2B: A 2.52B Dense Model Averaging 53.9 Across 34 Benchmarks and Built to Run On Device

OpenBMB 发布了 MiniCPM5-2B,这是一个拥有 2.52B 参数的稠密语言模型。该模型采用标准 Llama 架构,原生上下文窗口为 131,072 tokens,支持 vLLM、SGLang 等主流引擎部署。在 34 个基准测试中平均得分为 53.9,优于同尺寸类中的 Qwen3.5-4B(51.1)。模型在工具使用、代码推理及长上下文检索任务上表现突出,但在通用知识方面落后于大模型。训练流程包含 SFT、RL 及基于 JustRL II 算法的 on-policy 蒸馏,并开源了 UltraData 系列数据集及中间检查点。