−25%

Windows 年払い、10月31日まで。 プランを見る

EQVPS

Open WebUI 向け VPS:LLM 用のプライベートなチャット画面

Open WebUI を VPS でホストし、OpenAI 互換のあらゆる API やローカルの Ollama モデル向けのプライベートなチャット画面に。Docker での構築、安全なアクセス、スペック選び。

3 つのモデル提供元を使い分けていて、それぞれにチャット画面、サブスクリプション、履歴がある。Open WebUI はそれらを自分でホストする 1 つの画面の裏にまとめます。会話ごとにモデルを選び、履歴はすべて自分のサーバーに残し、チームで共有し、何も外に出したくないときはローカルモデルをつなぐ。そんな使い方ができます。

2 つの使い方

API のフロントエンドとして。 Open WebUI は OpenAI 互換のあらゆる API につながります。ホスティング型の提供元、LiteLLM プロキシ、自前のエンドポイントなど。サーバーはほとんど何もしないので、小さなプランで十分すぎるほどです。

ローカルモデルと一緒に。 同じサーバーに Ollama を入れ、オープンウェイトのモデルをローカルで動かします。この場合はメモリが制約になり、CPU での推論は遅くなります。正直なトレードオフは、完全なプライバシーと控えめな速度です。

構成プラン
API のフロントエンド、個人利用Micro — 1 vCPU、2 GB、月 $5(SSH トンネル)
API のフロントエンド、チームで HTTPS アクセスMicro-IP — 1 vCPU、2 GB、月 $10
Ollama でローカルの 3B モデルAI-Agent — 2 vCPU、4 GB、月 $10
ローカルの 7〜8B モデルMedium — 4 vCPU、6 GB、月 $12。より大きなモデルには Pro プラン

Docker でインストールする

Docker をインストールしたサーバーで:

docker run -d --name open-webui --restart always \
  -p 127.0.0.1:3000:8080 \
  -v open-webui:/app/backend/data \
  ghcr.io/open-webui/open-webui:main

127.0.0.1 にバインドしておけば、公開方法を決めるまで公衆のインターネットからは見えません。チャット、ユーザー、設定は open-webui ボリュームに保存されます。

安全にアクセスする

SSH トンネル — NAT を含むすべてのプランで使えます。

ssh -p 22 -N -L 3000:127.0.0.1:3000 you@203.0.113.10

http://localhost:3000 を開きます。NAT プランでは個別の SSH ポートを使ってください。

自分のドメインで HTTPS — 専用 IP のプランでチームが使う場合。サブドメインをサーバーに向け(ガイド)、WebSocket のヘッダーも含めて nginx でプロキシします。

location / {
    proxy_pass http://127.0.0.1:3000;
    proxy_set_header Host $host;
    proxy_set_header Upgrade $http_upgrade;
    proxy_set_header Connection upgrade;
    proxy_read_timeout 300s;
}

続けて certbot --nginx -d chat.example.com を実行します。長い読み取りタイムアウトには意味があります。遅いモデルは回答を何分もかけてストリーミングするからです。

中に入ったら最初にやること

  1. すぐに登録する。 最初のアカウントが管理者になります。インストール直後の状態を公開のまま放置しないでください。他人に乗っ取られるおそれがあります。
  2. 新規登録を閉じる。 管理者設定 → 新規ユーザーの既定ロールを承認待ちにするか、登録を無効にします。
  3. 接続を追加する。 設定 → 接続 → API のベース URL とキーを貼り付けます。その提供元のモデルがモデル選択に現れます。

ローカルモデルを追加する

ホストに Ollama をインストールし(ガイド)、小さなモデルを取得して、Open WebUI がそこに届くように起動します。

ollama pull llama3.2:3b
docker rm -f open-webui
docker run -d --name open-webui --restart always \
  -p 127.0.0.1:3000:8080 --add-host=host.docker.internal:host-gateway \
  -e OLLAMA_BASE_URL=http://host.docker.internal:11434 \
  -v open-webui:/app/backend/data ghcr.io/open-webui/open-webui:main

ボリュームがあるので再起動してもチャットは残ります。CPU では毎秒数トークン程度と考えてください。要約や個人的なメモには十分ですが、長文には遅すぎます。より本格的なローカル推論については Ollama 向け VPS を参照してください。

知っておきたいこと

プランの上限やアップグレードについてはプランのドキュメントをご覧ください。

デプロイの準備はできましたか?暗号通貨で支払い、KYC不要 — 約1分でオンライン。

今すぐデプロイ →

FAQ

Open WebUI にはどのくらいのメモリが必要ですか?

Open WebUI 自体は 1 GB ほどで動きます。リモートの API とやり取りするだけなら 2 GB のプランで十分です。メモリを食うのは Ollama 経由のローカルモデルで、3B の小型モデルなら 4 GB、7〜8B のモデルなら 6 GB 以上が目安です。

GPU のない VPS でローカルモデルを動かせますか?

動かせますが、期待値は現実的に。量子化された小型モデルなら CPU で毎秒数トークンの速さで答えます。短いタスクや個人的な実験には使えますが、長い回答をテンポよく返すチャットには向きません。

NAT プランでも使えますか?

使えます。個別の SSH ポート経由の SSH トンネルでアクセスしてください。チームがブラウザで開く公開の HTTPS アドレスが欲しいなら、専用 IP のプランが必要です。

アカウントは誰が作れますか?

最初に登録したアカウントが管理者になります。その後、管理者設定で新規登録を承認待ちにするか無効にしてください。そうしないと URL を見つけた人なら誰でもアカウントを作れてしまいます。

会話はどこに保存されますか?

サーバー上の Docker ボリュームです。接続したモデルの API に送るプロンプト以外、第三者には何も渡りません。

コメント

まだコメントはありません。最初になりましょう。

コメントを残す

コメントは表示される前にモデレートされます。