群发资讯网

#每天一个AI模型# 面壁 MiniCPM|不卷参数卷“智能密度”,把 GPT-4o 级能力塞进手机和笔记本 很多人以为端侧 AI = 阉割版云端模型,面壁智能(OpenBMB × 清华 THUNLP)的 MiniCPM 系列 偏要反着走:提出“密度定律”——达到同智能水平所需参数量约每 3.5 个月减半,用小模型打中大模型的脸。 #ai# ​

每天一个AI模型 面壁 MiniCPM|不卷参数卷“智能密度”,把 GPT-4o 级能力塞进手机和笔记本

很多人以为端侧 AI = 阉割版云端模型,面壁智能(OpenBMB × 清华 THUNLP)的 MiniCPM 系列 偏要反着走:提出“密度定律”——达到同智能水平所需参数量约每 3.5 个月减半,用小模型打中大模型的脸。ai 🧩 它不是单个模型,而是一整套端侧栈

MiniCPM5(文本基座):最新 MiniCPM5-2B 在 AA-Index 拿 17 分,4B 以下全球第一,原生混合思考+512K 上下文,INT4 后手机能跑;另有 1B 版(AA 超越所有 2B 以下模型,权重 0.5GB 可跑浏览器)。- MiniCPM-V(视觉多模态):V 4.6 仅 1.3B,6GB 内存手机端运行,iOS/安卓/鸿蒙通吃;LLaVA-UHD v4 把视觉编码 FLOPs 砍掉 50%+,4×/16× 双档 token 压缩,AA 智能密度同尺寸最高,OpenCompass 逼近 2B 级。- MiniCPM-o(全模态全双工):o 4.5 共 9B(SigLIP-ViT+Whisper+Qwen3-8B+语音解码),业界首个端到端全双工全模态,边看边听边说、可被打断、可主动提醒;INT4 仅需 12GB 显存(RTX 5070/4090 或 M 系 Mac 16G+ 离线跑),OpenCompass 视觉 77.6 对标 Gemini 2.5 Flash。- VoxCPM(语音):端侧零样本音色克隆+30 语种/9 方言合成。

MiniCPM-Robot:1.5B VLA 具身模型,支持 1 分钟原生记忆。

⚙️ 为什么小还能打

- 视觉端 LLaVA-UHD v4 早压缩+高分辨率切片,编码开销减半;

全双工靠 Omni-Flow 流式框架,多模态流对齐到毫秒时间片,无需 VAD 切轮次;

文本端 InfLLM v2 稀疏注意力+双频换挡,长文提速最高 220×;- 全系兼容 llama.cpp / Ollama / vLLM / SGLang / OpenVINO,消费级显卡可微调。

📱 真落地,不是 Demo 玩具

系列两年半 15 个大版本,GitHub+HF 累计下载 3800 万+(o 4.5 单模型 HF 25 万+),已上车长安马自达 EZ-60、吉利银河 M9 智能座舱,进联想 AIPC、多家头部手机厂预装,松果派开发板直接跑。

一句话定性:云端大模型在拼“谁能更大”,MiniCPM 在证明“智能的下一个形态是离用户最近、断网也能用、1GB 级权重”。

👉 体验入口:huggingface.co/openbmb、github.com/OpenBMB、minicpmo45.modelbest.cn

你觉得“端侧小模型”会先颠覆手机 App,还是先颠覆车机/机器人?一天一个ai大模型