EQVPS

Self-host en LiteLLM-proxy på en VPS: ét OpenAI-kompatibelt endpoint til hver model

2. sep. 2026 · 3 min. læsning · EQVPS Team

Hvis du kører mere end én app — eller én agent, der fanner ud til flere modeller — rammer du til sidst den samme mur: hver udbyder har sin egen SDK, sine egne nøgler, sine egne rate limits og intet enkelt sted at se forbrug. LiteLLM fikser det ved at sætte ét OpenAI-kompatibelt endpoint foran alt. Din kode kalder én URL med et modelnavn; LiteLLM router det til OpenAI, Anthropic, Groq, Together, Mistral, en lokal Ollama — hvad end du konfigurerede — og giver dig budgetter, fallbacks og én log over hvert kald.

At self-hoste den på en VPS betyder, at dine udbyder-nøgler, dine prompts og dine forbrugsdata bor på en boks, du kontrollerer, betalt for i krypto uden KYC.

Hvad en LiteLLM-proxy har brug for

Docker-opsætning (Ubuntu 24.04)

# dedikeret-IP-abonnement, root-shell
apt update && apt install -y docker.io docker-compose-v2
systemctl enable --now docker

mkdir -p /opt/litellm && cd /opt/litellm
cat > config.yaml <<'EOF'
model_list:
  - model_name: gpt-4o
    litellm_params:
      model: openai/gpt-4o
      api_key: os.environ/OPENAI_API_KEY
  - model_name: claude
    litellm_params:
      model: anthropic/claude-sonnet-4-5
      api_key: os.environ/ANTHROPIC_API_KEY
  - model_name: local-llama
    litellm_params:
      model: ollama/llama3.1
      api_base: http://host.docker.internal:11434
general_settings:
  master_key: sk-CHANGE-ME          # admin-nøgle; udsted per-app virtuelle nøgler i stedet
EOF

cat > docker-compose.yml <<'EOF'
services:
  litellm:
    image: ghcr.io/berriai/litellm:main-latest
    restart: always
    ports: [ "127.0.0.1:4000:4000" ]
    environment:
      OPENAI_API_KEY: sk-...            # dine udbyder-nøgler
      ANTHROPIC_API_KEY: sk-ant-...
      DATABASE_URL: postgresql://litellm:change_me@postgres:5432/litellm
    volumes: [ ./config.yaml:/app/config.yaml ]
    command: [ "--config", "/app/config.yaml" ]
  postgres:
    image: postgres:16
    restart: always
    environment:
      POSTGRES_USER: litellm
      POSTGRES_PASSWORD: change_me
      POSTGRES_DB: litellm
    volumes: [ ./pgdata:/var/lib/postgresql/data ]
EOF

docker compose up -d

Sæt Caddy eller Nginx foran for automatisk HTTPS på dit domæne, hvorefter enhver OpenAI-SDK bare virker:

curl https://llm.yourdomain.com/v1/chat/completions \
  -H "Authorization: Bearer sk-your-virtual-key" \
  -H "Content-Type: application/json" \
  -d '{"model":"claude","messages":[{"role":"user","content":"ping"}]}'

Hvorfor dette er fantastisk til agenter

En AI-agent eller en multi-agent-flåde laver som regel mange model-kald. Bag en LiteLLM-proxy kan du: sætte et loft på hver agent med sin egen virtuelle nøgle og budget, falde tilbage fra en frontier-model til en billigere automatisk, blande en lokal Ollama med sky-API'er, og læse én log over præcis, hvad hver agent brugte. Skift modeller uden at røre agent-kode — ændr bare konfigurationen.

Hvorfor EQVPS til en LiteLLM-gateway

VPS til AI-agenter → · Self-host Ollama på en VPS →

FAQ

Hvad giver en LiteLLM-proxy mig egentlig?

Ét OpenAI-kompatibelt endpoint foran mange udbydere. Dine apps og agenter kalder en enkelt URL og et modelnavn; LiteLLM router til OpenAI, Anthropic, Groq, Together, en lokal Ollama osv. Du får per-nøgle-budgetter, rate limits, fallbacks og ét sted til logs og omkostning — uden at ændre app-kode, når du skifter model.

Hvilket abonnement har den brug for?

LiteLLM selv er let — Small ($8/md, 4 GB RAM) er komfortabelt til proxyen plus Postgres til nøgler/forbrug. Det er en gateway, ikke en inferens-boks: den tunge compute kører hos udbyderne (eller på en separat GPU/vært). Tag et dedikeret-IP-abonnement, så du kan sætte et domæne og HTTPS foran.

Hvorfor self-hoste i stedet for at bruge en hostet gateway?

Dine udbyder-nøgler, prompts, forbrugsdata og logs forbliver på en maskine, du kontrollerer, i stedet for en tredjeparts. Du sætter budgetterne og ser hver forespørgsel. For agenter, der fanner mange kald ud, er den synlighed og omkostningskontrol hele pointen.

Virker det med lokale modeller også?

Ja. Peg en af LiteLLM-model-posterne mod en lokal Ollama (samme VPS eller en anden boks), og den eksponeres gennem det samme OpenAI-kompatible API som sky-modellerne — så en app kan blande en billig lokal model og et frontier-API bag ét endpoint.

Beder I om ID eller et kort?

Nej. Registrér med en e-mail, betal i USDC eller USDT. Ingen dokumenter, intet kort, ingen KYC.

← Tilbage til blogSe planer & priser →

Kommentarer

Ingen kommentarer endnu. Vær den første.

Skriv en kommentar

Kommentarer modereres, før de vises.