−25%

на годовую оплату Windows, до 31.10. К тарифам

EQVPS

VPS для Open WebUI: приватный чат для LLM

Open WebUI на VPS как приватный чат для любого OpenAI-совместимого API или локальных моделей Ollama: установка в Docker, безопасный доступ и ресурсы.

У вас три разных провайдера моделей, и у каждого своё окно чата, своя подписка и своя история. Open WebUI собирает их в один интерфейс на вашем сервере: выбираете модель для каждого разговора, вся история хранится у вас, можно поделиться с командой и подключить локальные модели, когда нужно, чтобы ничего не покидало машину.

Два способа использования

Как интерфейс к API. Open WebUI подключается к любому OpenAI-совместимому API — облачным провайдерам, прокси LiteLLM или вашему эндпоинту. Сервер при этом почти не работает; маленького тарифа хватит с запасом.

С локальными моделями. Ставите на тот же сервер Ollama и запускаете открытые модели прямо на нём. Теперь ограничение — память, а инференс на процессоре медленный. Честный компромисс: полная приватность, скромная скорость.

ВариантТариф
Интерфейс к API, для себяMicro — 1 vCPU, 2 ГБ, $5/мес (SSH-туннель)
Интерфейс к API, доступ команды по HTTPSMicro-IP — 1 vCPU, 2 ГБ, $10/мес
Локальные модели на 3B через OllamaAI-Agent — 2 vCPU, 4 ГБ, $10/мес
Локальные модели на 7–8BMedium — 4 vCPU, 6 ГБ, $12/мес или тарифы Pro для моделей крупнее

Установка в Docker

На сервере с установленным Docker:

docker run -d --name open-webui --restart always \
  -p 127.0.0.1:3000:8080 \
  -v open-webui:/app/backend/data \
  ghcr.io/open-webui/open-webui:main

Привязка к 127.0.0.1 держит сервис вне публичного интернета, пока вы не решите, как его открыть. Чаты, пользователи и настройки хранятся в томе open-webui.

Безопасный доступ

SSH-туннель — работает на любом тарифе, включая NAT:

ssh -p 22 -N -L 3000:127.0.0.1:3000 you@203.0.113.10

Откройте http://localhost:3000. На NAT-тарифе используйте персональный SSH-порт.

HTTPS на своём домене — для команды на тарифе с выделенным IP. Направьте поддомен на сервер (инструкция) и проксируйте его через nginx с заголовками WebSocket:

location / {
    proxy_pass http://127.0.0.1:3000;
    proxy_set_header Host $host;
    proxy_set_header Upgrade $http_upgrade;
    proxy_set_header Connection upgrade;
    proxy_read_timeout 300s;
}

Затем выполните certbot --nginx -d chat.example.com. Длинный таймаут чтения важен: медленные модели стримят ответ минутами.

Первые шаги внутри

  1. Зарегистрируйтесь сразу. Первый аккаунт становится администратором. Не оставляйте свежую установку открытой — её может забрать кто-то другой.
  2. Закройте регистрацию. Настройки администратора → роль новых пользователей по умолчанию «в ожидании» или отключение регистрации.
  3. Добавьте подключение. Настройки → Подключения → вставьте базовый URL API и ключ. Модели этого провайдера появятся в выборе модели.

Добавляем локальные модели

Установите Ollama на хост (наша инструкция), скачайте маленькую модель и запустите Open WebUI так, чтобы он её видел:

ollama pull llama3.2:3b
docker rm -f open-webui
docker run -d --name open-webui --restart always \
  -p 127.0.0.1:3000:8080 --add-host=host.docker.internal:host-gateway \
  -e OLLAMA_BASE_URL=http://host.docker.internal:11434 \
  -v open-webui:/app/backend/data ghcr.io/open-webui/open-webui:main

Том сохраняет чаты при перезапуске. На процессоре ждите несколько токенов в секунду — для конспектов и личных заметок нормально, для длинных текстов медленно. Для серьёзного локального инференса смотрите VPS для Ollama.

Что стоит знать

Лимиты тарифов и апгрейд — в документации по тарифам.

Готовы развернуть? Оплата криптой, без KYC — сервер за минуту.

Развернуть →

Частые вопросы

Сколько памяти нужно Open WebUI?

Сам Open WebUI укладывается примерно в 1 ГБ. Если он общается только с удалёнными API, хватит тарифа на 2 ГБ. Память нужна для локальных моделей через Ollama: 4 ГБ для маленьких моделей на 3B, 6 ГБ и больше для моделей на 7–8B.

Можно ли запускать локальные модели на VPS без GPU?

Да, но без завышенных ожиданий. Маленькие квантованные модели отвечают на процессоре со скоростью несколько токенов в секунду. Для коротких задач и приватных экспериментов нормально, для бодрого чата с длинными ответами — нет.

Подойдёт ли NAT-тариф?

Да, через SSH-туннель на ваш персональный SSH-порт. Для публичного HTTPS-адреса, который команда откроет в браузере, нужен тариф с выделенным IP.

Кто может создавать аккаунты?

Первый зарегистрированный аккаунт становится администратором. После этого переведите новые регистрации в режим ожидания или отключите их в настройках, иначе аккаунт сможет завести любой, кто найдёт адрес.

Где хранятся мои чаты?

В томе Docker на вашем сервере. Третьим лицам уходят только промпты, которые вы отправляете в подключённый API модели.

Комментарии

Пока нет комментариев. Будьте первым.

Оставить комментарий

Комментарии проходят модерацию перед публикацией.