OllamaOpenAI兼容工具本地部署 本地部署模型

Ollama(本地部署工具) Latest

Ollama系列 · Ollama 社区 · 2023-06发布

开源支持本地部署国内可直连有免费额度

模型介绍

最流行的本地大模型一键运行工具,支持 Llama、Qwen、DeepSeek 等数百个模型,一条命令下载、运行、提供 OpenAI 兼容 API。

模型基础信息

模型系列Ollama系列
开发机构Ollama 社区
发布时间2023-06
参数规模-
上下文窗口-
模型类型推理框架 / 工具
中文能力待评估
使用方式网页体验 / API调用 / 本地部署

免费额度与收费政策

完全免费开源

免费规则详情

Ollama 本体与内置模型完全免费,本地运行无任何费用。

收费标准简介

完全免费;仅需自备电脑 / 显卡硬件成本。

模型能力介绍

✅ 核心优势

  • 一条命令下载
  • 运行数百个模型
  • 自带 OpenAI 兼容本地 API
  • 支持 Windows / macOS / Linu
  • 模型管理(list / pull / rm)极简单

⚠️ 短板与局限

  • 本身不是模型,需依赖社区模型
  • 大模型仍需要足够的显存
  • 高并发生产场景建议改用 vLLM

🎯 适用场景

  • 个人本地体验大模型
  • 开发调试与原型验证
  • 数据不出网的私有使用
  • 新手本地部署入门

模型使用教程

本章节整理 Ollama(本地部署工具) 的在线体验、API调用、本地部署全套入门教程,快速上手使用该模型。

  • 安装:官网下载对应系统安装包(macOS/Windows/Linux)。
  • 拉取模型ollama pull qwen2.5:7b
  • 运行对话ollama run qwen2.5:7b
  • API 服务:安装后默认监听 11434 端口,提供 /v1/chat/completions(OpenAI 兼容)。
  • 管理模型:ollama list(查看)、ollama rm(删除)。

Windows/macOS:官网下载安装包,双击安装。

Linux:

curl -fsSL https://ollama.com/install.sh | sh

验证:

ollama --version
# 命令行对话
ollama run llama3.1 "用中文写一句话"

# HTTP API(OpenAI 兼容)
curl http://localhost:11434/v1/chat/completions \
  -H "Content-Type: application/json" \
  -d '{"model":"qwen2.5:7b","messages":[{"role":"user","content":"你好"}]}'

Python:

from openai import OpenAI
client = OpenAI(base_url="http://localhost:11434/v1", api_key="ollama")
print(client.chat.completions.create(model="qwen2.5:7b", messages=[{"role":"user","content":"你好"}]).choices[0].message.content)

Windows / macOS 直接下载官网安装包,Linux:

curl -fsSL https://ollama.com/install.sh | sh

拉取并运行模型:

ollama pull qwen2.5:7b
ollama run qwen2.5:7b

验证本地 API:

curl http://localhost:11434/v1/chat/completions \
  -H "Content-Type: application/json" \
  -d '{"model":"qwen2.5:7b","messages":[{"role":"user","content":"你好"}]}'

💡 使用小技巧

常用命令:ollama pull qwen2.5:7bollama listollama rm <模型名>

默认端口 11434,服务自带 /v1 OpenAI 兼容接口,可被任何 SDK 调用。

❓ 常见问题 FAQ

Q1:Ollama 是模型吗?

A1:不是,它是一个本地运行开源模型的工具,本身不包含推理能力。

Q2:和 LM Studio 比选哪个?

A2:Ollama 偏命令行与自动化,LM Studio 偏图形界面,看使用习惯。

访问备注与注意事项