1️⃣ 打开 Ollama 官网

👉 https://ollama.com

2️⃣ 下载Installer

一路 Next 安装即可(根据自己电脑选择即可,我拿Mac做示例,下载的是macOS Installer (.dmg))

3️⃣ 验证

ollama --version

启动 Ollama(一般会自动启动):

ollama serve

如果报端口占用,说明它已经在跑了,没问题

4️⃣ 下载一个模型

👉 推荐模型

ollama pull qwen2.5:7b

也可以备选:

ollama pull llama3.1:8b


5️⃣ 本地直接测试模型

ollama run qwen2.5:7b

你应该能看到:

>>> 你好 👉 输入一句话测试即可

不用每天敲命令行聊天。

6️⃣ 用 Docker 启动 Open WebUI

docker run -d \
  -p 3000:8080 \
  -e OLLAMA_BASE_URL=http://host.docker.internal:11434 \
  -v open-webui:/app/backend/data \
  --name open-webui \
  --restart always \
  ghcr.io/open-webui/open-webui:main

第一次执行本地没有会进行下载,可能会比较慢,等结束即可


7️⃣ 打开网页界面

浏览器访问:

http://localhost:3000

第一次:

  • 创建一个账号(本地的)
  • 进入后,模型一般会自动识别 Ollama

测试对话:

  • 选择 qwen2.5:7b
  • 随便聊一句

👉 现在你已经有一个 完全本地的 ChatGPT 网页版

可以通过以下几种方式确认使用的是否是本地大模型:

✅ 看端口是谁在占用

lsof -nP -iTCP:11434 -sTCP:LISTEN

你应该能看到类似 ollama 的进程在监听(PID 不同没关系)。

✅ Ollama API 自检

curl http://localhost:11434/api/tags

能返回 JSON(列出模型)就说明:本机 Ollama 服务正常

✅ 看你的 Open WebUI 容器环境变量是否正确

docker inspect open-webui | grep -n "OLLAMA_BASE_URL"

你应该看到:

OLLAMA_BASE_URL=http://host.docker.internal:11434

如果没看到,说明 WebUI 可能没按我们那条命令启动,需要重启容器(第 4 步给你一键修复命令)。

✅ 直接在容器里 curl 到你的本机 Ollama

docker exec -it open-webui sh -lc "curl -s http://host.docker.internal:11434/api/tags | head"

能返回内容就说明:WebUI 确实能访问你本机 Ollama

♻️ 重新启动

docker stop open-webui
docker rm open-webui
docker volume rm open-webui

更多推荐