Als je meer dan één app draait — of één agent die uitwaaiert naar verschillende modellen — stuit je uiteindelijk op dezelfde muur: elke provider heeft zijn eigen SDK, zijn eigen keys, zijn eigen rate limits, en geen enkele plek om spend te zien. LiteLLM fixt dat door één OpenAI-compatibel endpoint vóór alles te zetten. Je code roept één URL aan met een modelnaam; LiteLLM routeert het naar OpenAI, Anthropic, Groq, Together, Mistral, een lokale Ollama — wat je ook configureerde — en geeft je budgetten, fallbacks, en één log van elke call.
Het zelf-hosten op een VPS betekent dat je provider-keys, je prompts en je spend-data op een box leven die jij beheert, betaald in crypto zonder KYC.
Wat een LiteLLM-proxy nodig heeft
- Niet veel compute — het is een gateway. Het zware werk gebeurt bij de providers; LiteLLM routeert alleen. Small ($8/mnd — 4 vCPU, 4 GB RAM) draait comfortabel de proxy plus een Postgres voor virtuele keys en spend-tracking.
- Een dedicated IP, een domein en HTTPS. Je apps en agents verbinden inkomend, dus je wilt een dedicated-IPv4-plan, een domein en TLS. NAT-plannen nemen geen inkomend webverkeer.
- Uitgaand naar de providers. De box heeft normale uitgaande HTTPS nodig om de model-API's te bereiken — elk plan heeft dat.
Docker-setup (Ubuntu 24.04)
# dedicated-IP plan, root shell
apt update && apt install -y docker.io docker-compose-v2
systemctl enable --now docker
mkdir -p /opt/litellm && cd /opt/litellm
cat > config.yaml <<'EOF'
model_list:
- model_name: gpt-4o
litellm_params:
model: openai/gpt-4o
api_key: os.environ/OPENAI_API_KEY
- model_name: claude
litellm_params:
model: anthropic/claude-sonnet-4-5
api_key: os.environ/ANTHROPIC_API_KEY
- model_name: local-llama
litellm_params:
model: ollama/llama3.1
api_base: http://host.docker.internal:11434
general_settings:
master_key: sk-CHANGE-ME # admin key; issue per-app virtual keys instead
EOF
cat > docker-compose.yml <<'EOF'
services:
litellm:
image: ghcr.io/berriai/litellm:main-latest
restart: always
ports: [ "127.0.0.1:4000:4000" ]
environment:
OPENAI_API_KEY: sk-... # your provider keys
ANTHROPIC_API_KEY: sk-ant-...
DATABASE_URL: postgresql://litellm:change_me@postgres:5432/litellm
volumes: [ ./config.yaml:/app/config.yaml ]
command: [ "--config", "/app/config.yaml" ]
postgres:
image: postgres:16
restart: always
environment:
POSTGRES_USER: litellm
POSTGRES_PASSWORD: change_me
POSTGRES_DB: litellm
volumes: [ ./pgdata:/var/lib/postgresql/data ]
EOF
docker compose up -d
Zet Caddy of Nginx ervoor voor automatische HTTPS op je domein, dan werkt elke OpenAI SDK gewoon:
curl https://llm.yourdomain.com/v1/chat/completions \
-H "Authorization: Bearer sk-your-virtual-key" \
-H "Content-Type: application/json" \
-d '{"model":"claude","messages":[{"role":"user","content":"ping"}]}'
Waarom dit geweldig is voor agents
Een AI-agent of een multi-agent-vloot maakt meestal veel model-calls. Achter een LiteLLM-proxy kun je: elke agent aftoppen met zijn eigen virtuele key en budget, automatisch terugvallen van een frontier-model naar een goedkopere, een lokale Ollama mixen met cloud-API's, en één log lezen van precies wat elke agent uitgaf. Wissel modellen zonder agent-code aan te raken — verander gewoon de config.
Waarom EQVPS voor een LiteLLM-gateway
- Dedicated IPv4 vanaf $8/mnd, domein + HTTPS-vriendelijk, alle poorten, self-service rDNS.
- EU-locaties (Duitsland, Finland) — schone routes, echte data-beschermingswet; je keys en logs blijven in de EU.
- Geen KYC, cryptobetaling. E-mail om aan te melden, USDC/USDT om te betalen.
- Root in ~60 seconden. Schone Ubuntu/Debian-images;
docker compose upen je gateway is live.
Reacties
Nog geen reacties. Wees de eerste.