−25%

Windows 按年付费,截至 10 月 31 日。 查看套餐

EQVPS

Open WebUI 专用 VPS:属于你的大模型私密聊天界面

在 VPS 上托管 Open WebUI,作为任意 OpenAI 兼容 API 或本地 Ollama 模型的私密聊天前端:Docker 部署、安全访问和配置选择。

你同时用着三家模型服务,每家都有自己的聊天窗口、订阅和历史记录。Open WebUI 把它们收拢到一个你自己托管的界面后面:每段对话单独选模型,所有历史都留在你的服务器上,可以和团队共享,还能在不想让任何数据离开机器时接入本地模型。

两种用法

作为 API 的前端。 Open WebUI 能连接任何 OpenAI 兼容的 API——托管服务商、一个 LiteLLM 代理,或者你自己的端点。服务器几乎不干活;小套餐绰绰有余。

搭配本地模型。 在同一台服务器上加装 Ollama,在本地运行开放权重的模型。这时内存就成了瓶颈,CPU 推理也很慢。实话实说的取舍是:完全的隐私,一般的速度。

配置套餐
API 前端,个人使用Micro — 1 vCPU、2 GB、每月 $5(SSH 隧道)
API 前端,团队通过 HTTPS 访问Micro-IP — 1 vCPU、2 GB、每月 $10
通过 Ollama 运行本地 3B 模型AI-Agent — 2 vCPU、4 GB、每月 $10
本地 7–8B 模型Medium — 4 vCPU、6 GB、每月 $12,更大的模型用 Pro 套餐

用 Docker 安装

在装好了 Docker 的服务器上:

docker run -d --name open-webui --restart always \
  -p 127.0.0.1:3000:8080 \
  -v open-webui:/app/backend/data \
  ghcr.io/open-webui/open-webui:main

绑定到 127.0.0.1 能让它在你决定怎么公开之前,都不出现在公网上。聊天记录、用户和设置都存在 open-webui 卷里。

安全地访问

SSH 隧道——所有套餐都能用,包括 NAT:

ssh -p 22 -N -L 3000:127.0.0.1:3000 you@203.0.113.10

打开 http://localhost:3000。NAT 套餐请使用你的专属 SSH 端口。

在你的域名上用 HTTPS——适合独立 IP 套餐上的团队。把一个子域名解析到服务器(指南),再用 nginx 反向代理,别忘了 WebSocket 头:

location / {
    proxy_pass http://127.0.0.1:3000;
    proxy_set_header Host $host;
    proxy_set_header Upgrade $http_upgrade;
    proxy_set_header Connection upgrade;
    proxy_read_timeout 300s;
}

然后运行 certbot --nginx -d chat.example.com。较长的读取超时很重要:慢模型会连续几分钟流式输出回答。

进去后的第一步

  1. 马上注册。 第一个账号会成为管理员。别让刚装好的实例公开晾着——可能被别人抢先占了。
  2. 关闭注册。 管理设置 → 把新用户的默认角色设为待审批,或者直接关闭注册。
  3. 添加连接。 设置 → 连接 → 粘贴 API 的基础 URL 和密钥。该服务商的模型就会出现在模型选择器里。

添加本地模型

在主机上安装 Ollama(我们的指南),拉一个小模型,再以能访问到它的方式启动 Open WebUI:

ollama pull llama3.2:3b
docker rm -f open-webui
docker run -d --name open-webui --restart always \
  -p 127.0.0.1:3000:8080 --add-host=host.docker.internal:host-gateway \
  -e OLLAMA_BASE_URL=http://host.docker.internal:11434 \
  -v open-webui:/app/backend/data ghcr.io/open-webui/open-webui:main

有卷在,重启后聊天记录还在。CPU 上预计每秒几个 token——写摘要、记私人笔记可以,写长文就慢了。更重的本地推理,见 Ollama 专用 VPS。

值得知道

套餐限制和升级方式见套餐文档。

准备好部署了?加密货币付款、无需KYC——约一分钟上线。

立即部署 →

常见问题

Open WebUI 需要多少内存?

Open WebUI 本身大约 1 GB 就能跑。如果它只和远程 API 对话,2 GB 的套餐就够了。真正吃内存的是通过 Ollama 运行的本地模型——3B 小模型要 4 GB,7–8B 模型要 6 GB 或更多。

没有 GPU 的 VPS 能跑本地模型吗?

能,但要有合理预期。量化后的小模型在 CPU 上每秒能出几个 token。做短任务和私下试验没问题,要快速来回、回答又长的聊天就不合适了。

NAT 套餐能用吗?

能,通过你专属 SSH 端口上的 SSH 隧道使用。如果想要一个团队能在浏览器里打开的公开 HTTPS 地址,就需要独立 IP 套餐。

谁可以创建账号?

第一个注册的账号会成为管理员。之后请在管理设置里把新注册设为待审批或直接关闭,否则任何找到 URL 的人都能注册账号。

我的对话存在哪里?

存在你服务器上的一个 Docker 卷里。除了你发给所连接模型 API 的提示词,什么都不会交给第三方。

评论

暂无评论。来做第一个吧。

发表评论

评论在显示前会经过审核。