Ollama本地大模型部署完全指南:一行命令运行70+开源模型

Ollama本地大模型部署完全指南:一行命令运行70+开源模型

资源概览

名称:Ollama
版本:v0.5.7
授权:Apache-2.0(开源免费)
适用平台:Windows 10/11、macOS 12+、Linux (Ubuntu/CentOS/Fedora)
体积:约82MB(安装包)
官网:https://ollama.com

Ollama是一款开源的本地大模型运行框架,支持Qwen、Llama、DeepSeek等70+开源模型一键下载和运行。所有推理在本地完成,数据不上传云端。

核心功能

  1. 一键安装:安装包仅82MB,自动配置GPU驱动

  2. 70+模型库:涵盖文本、代码、多模态等多种模型

  3. API兼容:OpenAI兼容接口,即插即用

  4. LLM服务:内置Web UI和命令行界面

  5. 模型管理:支持模型拉取、删除、版本管理

适用场景

  • 个人开发者本地测试AI应用

  • 企业私有化部署AI服务

  • 教育培训机构本地AI实验室

  • 数据敏感场景的离线推理

下载与安装

官方下载

官方下载:https://ollama.com/download


Windows安装

# 方法1:下载安装包运行
# 下载地址:https://ollama.com/download/OllamaSetup.exe

# 方法2:使用winget
winget install Ollama.Ollama

# 验证安装
ollama --version

macOS安装

# Homebrew安装
brew install ollama

# 或直接下载安装包
curl -L https://ollama.com/download/Ollama.dmg -o Ollama.dmg
hdiutil attach Ollama.dmg
cp -R /Volumes/Ollama/Ollama.app /Applications/

Linux安装

# Ubuntu/Debian
curl -fsSL https://ollama.com/install.sh | sh

# CentOS/RHEL
yum install -y ollama
systemctl enable ollama
systemctl start ollama

快速上手

运行第一个模型

# 拉取并运行Qwen2.5-7B
ollama run qwen2.5:7b

# 输出示例:
# >>> Hello, how can I help you?
# 我是一个AI助手,很高兴为你服务...

常用命令

# 列出已安装模型
ollama list

# 拉取新模型
ollama pull qwen2.5:14b

# 删除模型
ollama rm qwen2.5:7b

# 启动Web UI
ollama serve
# 访问 http://localhost:11434

Python API调用

from openai import OpenAI

client = OpenAI(base_url="http://localhost:11434/v1", api_key="ollama")

response = client.chat.completions.create(
    model="qwen2.5:7b",
    messages=[{"role": "user", "content": "解释量子计算"}]
)
print(response.choices[0].message.content)

同类资源对比

工具授权模型数量GPU支持特点
OllamaApache-2.070+NVIDIA/Apple Silicon最简单上手
LM StudioGPL-3.0100+NVIDIA/AMD/IntelGUI友好
text-generation-webuiGPL-3.050+NVIDIA/AMD功能丰富
vLLMApache-2.030+NVIDIA高吞吐服务

注意事项

  1. 硬件要求

  2. CPU推理:建议16GB以上内存

  3. GPU推理:NVIDIA RTX 20系列或更高,显存8GB+

  4. Apple Silicon:M1/M2/M3系列原生支持

  5. 网络问题:模型下载可能需要科学上网,可使用镜像站

  6. 权限问题:Linux用户可能需要添加到video组:sudo usermod -aG video $USER

  7. 模型选择:7B模型适合消费级GPU,14B+需要专业卡