在本机跑一个可对话的本地大模型。四步搞定。

1. 装 Ollama

ollama.com 下载安装(用户级,无需管理员)。装完自动在后台 11434 端口起服务,验证:

curl http://127.0.0.1:11434/api/version

2. 装 Open WebUI(Python)

需要 Python 3.11(不支持 3.12+)。

# 建隔离环境
uv venv open-webui-venv --python 3.11
​
# 装(用清华镜像,直连 pypi 可能失败)
VIRTUAL_ENV="$(pwd)/open-webui-venv" \
  uv pip install open-webui --index-url https://pypi.tuna.tsinghua.edu.cn/simple

没有 uv 也可以用 pip:pip install open-webui

3. 下模型

curl -X POST http://127.0.0.1:11434/api/pull -d '{"name":"qwen2.5-coder:7b"}'

常用模型:qwen2.5:3b(小而快)、qwen2.5-coder:7b(代码,约 4.5GB)。核显机器走 CPU,别拉 14B+。

4. 启动

open-webui-venv/Scripts/open-webui serve --port 3000

浏览器打开 http://localhost:3000 → 注册账号(第一个即管理员)→ 选模型开聊。

关机后 Open WebUI 不自启,重开跑一下启动命令即可。

Logo

欢迎加入DeepSeek 技术社区。在这里,你可以找到志同道合的朋友,共同探索AI技术的奥秘。

更多推荐