EQVPS

Self-hosta en LiteLLM-proxy på en VPS: en OpenAI-kompatibel endpoint för varje modell

2 sep. 2026 · 3 min läsning · EQVPS Team

Om du kör mer än en app — eller en agent som fläktar ut till flera modeller — stöter du till slut i samma vägg: varje leverantör har sin egen SDK, sina egna nycklar, sina egna rate limits, och ingen enda plats att se spend. LiteLLM fixar det genom att sätta en OpenAI-kompatibel endpoint framför allt. Din kod anropar en URL med ett modellnamn; LiteLLM dirigerar den till OpenAI, Anthropic, Groq, Together, Mistral, en lokal Ollama — vad du än konfigurerade — och ger dig budgetar, fallbacks, och en logg av varje anrop.

Att self-hosta det på en VPS betyder att dina leverantörsnycklar, dina prompter och din spend-data lever på en box du kontrollerar, betald i krypto utan KYC.

Vad en LiteLLM-proxy behöver

Docker-uppsättning (Ubuntu 24.04)

# dedicated-IP plan, root shell
apt update && apt install -y docker.io docker-compose-v2
systemctl enable --now docker

mkdir -p /opt/litellm && cd /opt/litellm
cat > config.yaml <<'EOF'
model_list:
  - model_name: gpt-4o
    litellm_params:
      model: openai/gpt-4o
      api_key: os.environ/OPENAI_API_KEY
  - model_name: claude
    litellm_params:
      model: anthropic/claude-sonnet-4-5
      api_key: os.environ/ANTHROPIC_API_KEY
  - model_name: local-llama
    litellm_params:
      model: ollama/llama3.1
      api_base: http://host.docker.internal:11434
general_settings:
  master_key: sk-CHANGE-ME          # admin key; issue per-app virtual keys instead
EOF

cat > docker-compose.yml <<'EOF'
services:
  litellm:
    image: ghcr.io/berriai/litellm:main-latest
    restart: always
    ports: [ "127.0.0.1:4000:4000" ]
    environment:
      OPENAI_API_KEY: sk-...            # your provider keys
      ANTHROPIC_API_KEY: sk-ant-...
      DATABASE_URL: postgresql://litellm:change_me@postgres:5432/litellm
    volumes: [ ./config.yaml:/app/config.yaml ]
    command: [ "--config", "/app/config.yaml" ]
  postgres:
    image: postgres:16
    restart: always
    environment:
      POSTGRES_USER: litellm
      POSTGRES_PASSWORD: change_me
      POSTGRES_DB: litellm
    volumes: [ ./pgdata:/var/lib/postgresql/data ]
EOF

docker compose up -d

Sätt Caddy eller Nginx framför för automatisk HTTPS på din domän, sedan fungerar vilken OpenAI SDK som helst:

curl https://llm.yourdomain.com/v1/chat/completions \
  -H "Authorization: Bearer sk-your-virtual-key" \
  -H "Content-Type: application/json" \
  -d '{"model":"claude","messages":[{"role":"user","content":"ping"}]}'

Varför detta är utmärkt för agenter

En AI-agent eller en multi-agent-flotta gör oftast många model-anrop. Bakom en LiteLLM-proxy kan du: begränsa varje agent med sin egen virtuella nyckel och budget, falla tillbaka från en frontier-modell till en billigare automatiskt, blanda en lokal Ollama med cloud-API:er, och läsa en logg av exakt vad varje agent spenderade. Byt modeller utan att röra agent-kod — ändra bara configen.

Varför EQVPS för en LiteLLM-gateway

VPS för AI-agenter → · Self-hosta Ollama på en VPS →

FAQ

Vad ger en LiteLLM-proxy mig egentligen?

En OpenAI-kompatibel endpoint framför många leverantörer. Dina appar och agenter anropar en enda URL och modellnamn; LiteLLM dirigerar till OpenAI, Anthropic, Groq, Together, en lokal Ollama, etc. Du får per-nyckel budgetar, rate limits, fallbacks och en plats för loggar och kostnad — utan att ändra app-kod när du byter modeller.

Vilket plan behöver den?

LiteLLM själv är lätt — Small ($8/mån, 4 GB RAM) är bekvämt för proxyn plus Postgres för nycklar/spend. Det är en gateway, inte en inferens-box: den tunga computen körs hos leverantörerna (eller på en separat GPU/värd). Ta ett dedikerad-IP-plan så att du kan sätta en domän och HTTPS framför.

Varför self-hosta istället för att använda en hostad gateway?

Dina leverantörsnycklar, prompter, spend-data och loggar stannar på en maskin du kontrollerar istället för en tredje parts. Du sätter budgetarna och ser varje förfrågan. För agenter som fläktar ut många anrop är den synligheten och kostnadskontrollen hela poängen.

Fungerar det med lokala modeller också?

Ja. Rikta en av LiteLLM-modell-posterna mot en lokal Ollama (samma VPS eller annan box) och den exponeras genom samma OpenAI-kompatibla API som cloud-modellerna — så en app kan blanda en billig lokal modell och ett frontier-API bakom en endpoint.

Frågar ni om ID eller ett kort?

Nej. Registrera med en e-post, betala i USDC eller USDT. Inga dokument, inget kort, ingen KYC.

← Tillbaka till bloggenSe planer & priser →

Kommentarer

Inga kommentarer än. Bli först.

Lämna en kommentar

Kommentarer modereras innan de visas.