小模型开源端侧面壁 开源模型

MiniCPM(端侧模型) 3.0

MiniCPM系列 · 面壁智能(OpenBMB) · 2024-02发布

开源支持本地部署国内可直连有免费额度

模型介绍

面壁智能开源的端侧大模型,2.4B~8B 却能表现接近大模型的推理能力,可部署到手机、笔记本、树莓派等设备,隐私友好免费商用。

模型基础信息

模型系列MiniCPM系列
开发机构面壁智能(OpenBMB)
发布时间2024-02
参数规模2.4B / 4B / 8B
上下文窗口32K
模型类型文本
中文能力优秀
使用方式网页体验 / API调用 / 本地部署

免费额度与收费政策

开源免费

免费规则详情

Apache-2.0 完全免费商用。

收费标准简介

本地零成本。

模型能力介绍

✅ 核心优势

  • 端侧性能业界领先
  • 小参数推理能力强
  • 手机 / 桌面皆可跑
  • pache 商用无忧

⚠️ 短板与局限

  • 知识广度有限
  • 长上下文较弱
  • 通用能力受限

🎯 适用场景

  • 手机端 AI 应用
  • 离线隐私助手
  • 嵌入式设备
  • 低端硬件推理

模型使用教程

本章节整理 MiniCPM(端侧模型) 的在线体验、API调用、本地部署全套入门教程,快速上手使用该模型。

面壁智能的端侧模型,主打小体积高性能。

本地:ollama run minicpm,也可用官方推理脚本部署到手机。

HF_ENDPOINT=https://hf-mirror.com huggingface-cli download openbmb/MiniCPM3-4B --local-dir ./minicpm
ollama run minicpm "用中文介绍一下MiniCPM"

MiniCPM 是面壁智能开源的中文小模型(端侧 2.4B~多模态 8B),手机上即可部署,端侧优先选 2.4B 量化版。

  1. Ollama 一键:

ollama pull minicpm3

  1. 交互使用:

ollama run minicpm3

  1. 端侧(手机/笔记本)用 llama.cpp 跑 GGUF 量化版,CPU 即可推理。

Tips:MiniCPM-V 支持图片输入;1.5B/2.4B 端侧友好,8B 适合 16GB 显存机器。

💡 使用小技巧

ollama pull minicpm 直接体验。

端侧部署优先选量化版。

❓ 常见问题 FAQ

Q1:MiniCPM 有多小?

A1:最小 2.4B,消费级设备能跑。

Q2:能力如何?

A2:小尺寸中表现顶级。

访问备注与注意事项