EQVPS

VPS で LiteLLM プロキシをセルフホスト:あらゆるモデルへの単一の OpenAI 互換エンドポイント

2026年9月2日 · 1 分で読める · EQVPS Team

複数のアプリ——または複数モデルへ分岐する一つのエージェント——を動かすなら、いずれ同じ壁に突き当たります:各プロバイダーには独自の SDK、独自の鍵、独自のレート制限があり、支出を一望できる場所がありません。LiteLLM はすべての前に OpenAI 互換 エンドポイントを置くことでこれを解決します。あなたのコードはモデル名で一つの URL を呼び、LiteLLM がそれを OpenAI、Anthropic、Groq、Together、Mistral、ローカルの Ollama——設定したものへ——ルーティングし、予算、フォールバック、すべての呼び出しの単一のログを提供します。

VPS でセルフホストするということは、プロバイダーの鍵、プロンプト、支出データが あなた の管理するマシンに存在し、暗号通貨で KYC なしに支払われるということです。

LiteLLM プロキシに必要なもの

Docker セットアップ(Ubuntu 24.04)

apt update && apt install -y docker.io docker-compose-v2
systemctl enable --now docker

mkdir -p /opt/litellm && cd /opt/litellm
cat > config.yaml <<'EOF'
model_list:
  - model_name: gpt-4o
    litellm_params:
      model: openai/gpt-4o
      api_key: os.environ/OPENAI_API_KEY
  - model_name: claude
    litellm_params:
      model: anthropic/claude-sonnet-4-5
      api_key: os.environ/ANTHROPIC_API_KEY
  - model_name: local-llama
    litellm_params:
      model: ollama/llama3.1
      api_base: http://host.docker.internal:11434
general_settings:
  master_key: sk-CHANGE-ME
EOF

cat > docker-compose.yml <<'EOF'
services:
  litellm:
    image: ghcr.io/berriai/litellm:main-latest
    restart: always
    ports: [ "127.0.0.1:4000:4000" ]
    environment:
      OPENAI_API_KEY: sk-...
      ANTHROPIC_API_KEY: sk-ant-...
      DATABASE_URL: postgresql://litellm:change_me@postgres:5432/litellm
    volumes: [ ./config.yaml:/app/config.yaml ]
    command: [ "--config", "/app/config.yaml" ]
  postgres:
    image: postgres:16
    restart: always
    environment:
      POSTGRES_USER: litellm
      POSTGRES_PASSWORD: change_me
      POSTGRES_DB: litellm
    volumes: [ ./pgdata:/var/lib/postgresql/data ]
EOF

docker compose up -d

ドメインの自動 HTTPS のため前段に Caddy か Nginx を置けば、あらゆる OpenAI SDK がそのまま動きます:

curl https://llm.yourdomain.com/v1/chat/completions \
  -H "Authorization: Bearer sk-your-virtual-key" \
  -H "Content-Type: application/json" \
  -d '{"model":"claude","messages":[{"role":"user","content":"ping"}]}'

なぜこれがエージェントに最適なのか

AI エージェントマルチエージェント運用は通常、多くのモデル呼び出しを行います。LiteLLM プロキシの背後で、次のことができます:各エージェントを固有の仮想鍵と予算で制限し、フロンティアモデルから安価なモデルへ自動でフォールバックし、ローカルの Ollama をクラウド API と混在させ、各エージェントが正確に何を消費したかの単一のログを読む。エージェントのコードに触れずにモデルを切り替え——設定を変えるだけ。

なぜ LiteLLM ゲートウェイに EQVPS なのか

AI エージェント向け VPS → · VPS で Ollama をセルフホスト →

FAQ

LiteLLM プロキシは実際に何をくれますか?

多数のプロバイダーの前に置く単一の OpenAI 互換エンドポイントです。アプリとエージェントは単一の URL とモデル名を呼び、LiteLLM が OpenAI、Anthropic、Groq、Together、ローカルの Ollama などへルーティングします。鍵ごとの予算、レート制限、フォールバック、そしてログとコストの単一の場所が得られます——モデルを切り替えてもアプリのコードを変えずに。

どのプランが必要ですか?

LiteLLM 自体は軽量です——Small(月額 $8、4 GB RAM)でプロキシと鍵/支出用の Postgres が快適に動きます。これはゲートウェイであり推論マシンではありません:重い計算はプロバイダー側(または別の GPU/ホスト)で動きます。ドメインと HTTPS のため専用 IP プランを選んでください。

なぜ自前ホストなのか、ホスト型ゲートウェイではなく?

プロバイダーの鍵、プロンプト、支出データ、ログが第三者ではなくあなたの管理するマシンに残ります。予算はあなたが設定し、すべてのリクエストが見えます。多くの呼び出しを分散するエージェントにとって、その可視性とコスト管理こそが要点です。

ローカルモデルでも動きますか?

はい。LiteLLM のモデルエントリの一つをローカルの Ollama(同じ VPS か別マシン)に向ければ、クラウドモデルと同じ OpenAI 互換 API で公開されます——アプリは単一のエンドポイントの背後で安価なローカルモデルとフロンティア API を混在させられます。

身分証やカードを求めますか?

いいえ。メールで登録、USDC または USDT で支払い。書類なし、カードなし、KYC なし。

← ブログに戻るプランと価格を見る →

コメント

まだコメントはありません。最初になりましょう。

コメントを残す

コメントは表示される前にモデレートされます。