CPULocalAI开源本地 本地部署模型

LocalAI LocalAI 2.x

LocalAI系列 · LocalAI 社区 · 2023-03发布

开源支持本地部署多模态国内可直连有免费额度长上下文

模型介绍

LocalAI 是 OpenAI API 本地替代方案,纯 CPU/GPU 皆可跑,支持文本、语音、图像生成,无需 GPU 也能体验。

模型基础信息

模型系列LocalAI系列
开发机构LocalAI 社区
发布时间2023-03
参数规模本地推理服务器(多模态)
上下文窗口可配
模型类型本地推理服务器
中文能力良好
使用方式网页体验 / API调用 / 本地部署

免费额度与收费政策

开源免费

免费规则详情

MIT 免费商用。

收费标准简介

完全免费(自托管)。

模型能力介绍

✅ 核心优势

  • CPU 可跑
  • OpenAI 兼容
  • 多模态
  • Docker

⚠️ 短板与局限

  • 速度慢
  • 需自备模型
  • 功能繁多

🎯 适用场景

  • 本地 API
  • 离线部署
  • 隐私场景
  • 多模态实验

模型使用教程

本章节整理 LocalAI 的在线体验、API调用、本地部署全套入门教程,快速上手使用该模型。

  • 本地工具,安装后即可使用。
  • 支持对接主流模型与本地推理引擎。

启动服务后按提示操作即可。

export HF_ENDPOINT=https://hf-mirror.com

模型权重通过 HuggingFace 镜像或 ModelScope 下载。

提供 HTTP API:

curl http://localhost:PORT/v1/chat/completions -H "Content-Type: application/json" -d '{"model":"default","messages":[{"role":"user","content":"你好"}]}'

LocalAI 是把任意本地模型封装成 OpenAI 兼容 API 的服务,Docker 一条命令即可。

  1. Docker 部署:

docker run -d -p 8080:8080 --name localai -v ./models:/models quay.io/go-skynet/local-ai:latest

  1. 把 GGUF 模型放入 models/ 目录。
  2. 调用与 OpenAI 完全兼容:

curl http://localhost:8080/v1/chat/completions -H "Content-Type: application/json" -d '{"model":"ggml-model.gguf","messages":[{"role":"user","content":"你好"}]}'

Tips:支持文本/图像/音频多模态;有桌面端与 CLI,也可二进制安装。

💡 使用小技巧

一行 Docker 起 OpenAI 替代。

❓ 常见问题 FAQ

Q1:LocalAI 特点?\nA1:本地 OpenAI 替代。

访问备注与注意事项