3 つのモデル提供元を使い分けていて、それぞれにチャット画面、サブスクリプション、履歴がある。Open WebUI はそれらを自分でホストする 1 つの画面の裏にまとめます。会話ごとにモデルを選び、履歴はすべて自分のサーバーに残し、チームで共有し、何も外に出したくないときはローカルモデルをつなぐ。そんな使い方ができます。
2 つの使い方
API のフロントエンドとして。 Open WebUI は OpenAI 互換のあらゆる API につながります。ホスティング型の提供元、LiteLLM プロキシ、自前のエンドポイントなど。サーバーはほとんど何もしないので、小さなプランで十分すぎるほどです。
ローカルモデルと一緒に。 同じサーバーに Ollama を入れ、オープンウェイトのモデルをローカルで動かします。この場合はメモリが制約になり、CPU での推論は遅くなります。正直なトレードオフは、完全なプライバシーと控えめな速度です。
| 構成 | プラン |
|---|---|
| API のフロントエンド、個人利用 | Micro — 1 vCPU、2 GB、月 $5(SSH トンネル) |
| API のフロントエンド、チームで HTTPS アクセス | Micro-IP — 1 vCPU、2 GB、月 $10 |
| Ollama でローカルの 3B モデル | AI-Agent — 2 vCPU、4 GB、月 $10 |
| ローカルの 7〜8B モデル | Medium — 4 vCPU、6 GB、月 $12。より大きなモデルには Pro プラン |
Docker でインストールする
Docker をインストールしたサーバーで:
docker run -d --name open-webui --restart always \
-p 127.0.0.1:3000:8080 \
-v open-webui:/app/backend/data \
ghcr.io/open-webui/open-webui:main
127.0.0.1 にバインドしておけば、公開方法を決めるまで公衆のインターネットからは見えません。チャット、ユーザー、設定は open-webui ボリュームに保存されます。
安全にアクセスする
SSH トンネル — NAT を含むすべてのプランで使えます。
ssh -p 22 -N -L 3000:127.0.0.1:3000 you@203.0.113.10
http://localhost:3000 を開きます。NAT プランでは個別の SSH ポートを使ってください。
自分のドメインで HTTPS — 専用 IP のプランでチームが使う場合。サブドメインをサーバーに向け(ガイド)、WebSocket のヘッダーも含めて nginx でプロキシします。
location / {
proxy_pass http://127.0.0.1:3000;
proxy_set_header Host $host;
proxy_set_header Upgrade $http_upgrade;
proxy_set_header Connection upgrade;
proxy_read_timeout 300s;
}
続けて certbot --nginx -d chat.example.com を実行します。長い読み取りタイムアウトには意味があります。遅いモデルは回答を何分もかけてストリーミングするからです。
中に入ったら最初にやること
- すぐに登録する。 最初のアカウントが管理者になります。インストール直後の状態を公開のまま放置しないでください。他人に乗っ取られるおそれがあります。
- 新規登録を閉じる。 管理者設定 → 新規ユーザーの既定ロールを承認待ちにするか、登録を無効にします。
- 接続を追加する。 設定 → 接続 → API のベース URL とキーを貼り付けます。その提供元のモデルがモデル選択に現れます。
ローカルモデルを追加する
ホストに Ollama をインストールし(ガイド)、小さなモデルを取得して、Open WebUI がそこに届くように起動します。
ollama pull llama3.2:3b
docker rm -f open-webui
docker run -d --name open-webui --restart always \
-p 127.0.0.1:3000:8080 --add-host=host.docker.internal:host-gateway \
-e OLLAMA_BASE_URL=http://host.docker.internal:11434 \
-v open-webui:/app/backend/data ghcr.io/open-webui/open-webui:main
ボリュームがあるので再起動してもチャットは残ります。CPU では毎秒数トークン程度と考えてください。要約や個人的なメモには十分ですが、長文には遅すぎます。より本格的なローカル推論については Ollama 向け VPS を参照してください。
知っておきたいこと
- アップデートは頻繁。
docker pull ghcr.io/open-webui/open-webui:mainのあとコンテナを作り直します。先にボリュームをバックアップしましょう。 - API の費用は自分持ち。 Open WebUI は初期状態ではユーザーごとの利用量を制限しません。チームで共有するなら出費に目を配ってください。
- これはチャットアプリで、モデルではない。 回答の質は裏にあるモデル次第です。
プランの上限やアップグレードについてはプランのドキュメントをご覧ください。
コメント
まだコメントはありません。最初になりましょう。