EQVPS

Self-host ένα LiteLLM proxy σε VPS: ένα OpenAI-compatible endpoint για κάθε μοντέλο

Sep 2, 2026 · 3 λεπτά ανάγνωσης · EQVPS Team

Αν τρέχετε περισσότερες από μία εφαρμογές — ή έναν πράκτορα που φαν-άουτ σε αρκετά μοντέλα — τελικά χτυπάτε τον ίδιο τοίχο: κάθε πάροχος έχει το δικό του SDK, τα δικά του keys, τα δικά του rate limits, και κανένα μοναδικό μέρος να δείτε το spend. Το LiteLLM το διορθώνει βάζοντας ένα OpenAI-compatible endpoint μπροστά από τα πάντα. Ο κώδικάς σας καλεί ένα URL με ένα όνομα μοντέλου· το LiteLLM το δρομολογεί σε OpenAI, Anthropic, Groq, Together, Mistral, ένα τοπικό Ollama — ό,τι διαμορφώσατε — και σας δίνει προϋπολογισμούς, fallbacks, και ένα log κάθε κλήσης.

Το self-hosting σε VPS σημαίνει ότι τα keys παρόχων, τα prompts και τα δεδομένα spend σας ζουν σε ένα box που εσείς ελέγχετε, πληρωμένο σε crypto χωρίς KYC.

Τι χρειάζεται ένα LiteLLM proxy

Εγκατάσταση Docker (Ubuntu 24.04)

# dedicated-IP plan, root shell
apt update && apt install -y docker.io docker-compose-v2
systemctl enable --now docker

mkdir -p /opt/litellm && cd /opt/litellm
cat > config.yaml <<'EOF'
model_list:
  - model_name: gpt-4o
    litellm_params:
      model: openai/gpt-4o
      api_key: os.environ/OPENAI_API_KEY
  - model_name: claude
    litellm_params:
      model: anthropic/claude-sonnet-4-5
      api_key: os.environ/ANTHROPIC_API_KEY
  - model_name: local-llama
    litellm_params:
      model: ollama/llama3.1
      api_base: http://host.docker.internal:11434
general_settings:
  master_key: sk-CHANGE-ME          # admin key; issue per-app virtual keys instead
EOF

cat > docker-compose.yml <<'EOF'
services:
  litellm:
    image: ghcr.io/berriai/litellm:main-latest
    restart: always
    ports: [ "127.0.0.1:4000:4000" ]
    environment:
      OPENAI_API_KEY: sk-...            # your provider keys
      ANTHROPIC_API_KEY: sk-ant-...
      DATABASE_URL: postgresql://litellm:change_me@postgres:5432/litellm
    volumes: [ ./config.yaml:/app/config.yaml ]
    command: [ "--config", "/app/config.yaml" ]
  postgres:
    image: postgres:16
    restart: always
    environment:
      POSTGRES_USER: litellm
      POSTGRES_PASSWORD: change_me
      POSTGRES_DB: litellm
    volumes: [ ./pgdata:/var/lib/postgresql/data ]
EOF

docker compose up -d

Βάλτε Caddy ή Nginx μπροστά για αυτόματο HTTPS στο domain σας, μετά οποιοδήποτε OpenAI SDK απλώς λειτουργεί:

curl https://llm.yourdomain.com/v1/chat/completions \
  -H "Authorization: Bearer sk-your-virtual-key" \
  -H "Content-Type: application/json" \
  -d '{"model":"claude","messages":[{"role":"user","content":"ping"}]}'

Γιατί αυτό είναι εξαιρετικό για πράκτορες

Ένας AI πράκτορας ή ένας στόλος πολλαπλών πρακτόρων συνήθως κάνει πολλές κλήσεις μοντέλου. Πίσω από ένα LiteLLM proxy μπορείτε να: περιορίσετε κάθε πράκτορα με το δικό του virtual key και προϋπολογισμό, να κάνετε fallback από ένα frontier μοντέλο σε ένα φθηνότερο αυτόματα, να αναμείξετε ένα τοπικό Ollama με cloud APIs, και να διαβάσετε ένα log ακριβώς του τι ξόδεψε κάθε πράκτορας. Αλλάξτε μοντέλα χωρίς να αγγίξετε τον κώδικα πράκτορα — απλώς αλλάξτε τη config.

Γιατί EQVPS για ένα LiteLLM gateway

VPS για AI πράκτορες → · Self-host το Ollama σε VPS →

Συχνές ερωτήσεις

Τι μου δίνει πραγματικά ένα LiteLLM proxy;

Ένα OpenAI-compatible endpoint μπροστά από πολλούς παρόχους. Οι εφαρμογές και οι πράκτορές σας καλούν ένα μοναδικό URL και όνομα μοντέλου· το LiteLLM δρομολογεί σε OpenAI, Anthropic, Groq, Together, ένα τοπικό Ollama, κ.λπ. Αποκτάτε προϋπολογισμούς ανά key, rate limits, fallbacks και ένα μέρος για logs και κόστος — χωρίς αλλαγή κώδικα εφαρμογής όταν αλλάζετε μοντέλα.

Ποιο πακέτο χρειάζεται;

Το ίδιο το LiteLLM είναι ελαφρύ — το Small ($8/μήνα, 4 GB RAM) είναι άνετο για το proxy συν Postgres για keys/spend. Είναι gateway, όχι inference box: το βαρύ compute τρέχει στους παρόχους (ή σε ξεχωριστό GPU/host). Πάρτε ένα πακέτο αποκλειστικού IP ώστε να βάλετε domain και HTTPS μπροστά.

Γιατί self-host αντί να χρησιμοποιώ ένα hosted gateway;

Τα keys παρόχων, τα prompts, τα δεδομένα spend και τα logs σας μένουν σε μια μηχανή που ελέγχετε αντί για ένα τρίτο μέρος. Εσείς ορίζετε τους προϋπολογισμούς και βλέπετε κάθε αίτημα. Για πράκτορες που κάνουν πολλές κλήσεις, αυτή η ορατότητα και ο έλεγχος κόστους είναι όλο το νόημα.

Λειτουργεί και με τοπικά μοντέλα;

Ναι. Στρέψτε μία από τις καταχωρήσεις μοντέλου LiteLLM σε ένα τοπικό Ollama (ίδιο VPS ή άλλο box) και εκτίθεται μέσω του ίδιου OpenAI-compatible API με τα cloud μοντέλα — οπότε μια εφαρμογή μπορεί να αναμείξει ένα φθηνό τοπικό μοντέλο και ένα frontier API πίσω από ένα endpoint.

Ζητάτε ID ή κάρτα;

Όχι. Εγγραφείτε με ένα email, πληρώστε σε USDC ή USDT. Χωρίς έγγραφα, χωρίς κάρτα, χωρίς KYC.

← Πίσω στο BlogΔείτε πακέτα & τιμές →

Σχόλια

Δεν υπάρχουν ακόμη σχόλια. Γίνετε ο πρώτος.

Αφήστε ένα σχόλιο

Τα σχόλια ελέγχονται πριν εμφανιστούν.