EQVPS

LiteLLM proxy በVPS ላይ self-host ማድረግ: ለእያንዳንዱ model አንድ OpenAI-compatible endpoint

ሴፕቴ 2 2026 · 2 ደቂቃ ንባብ · EQVPS Team

ከአንድ በላይ app ካሄዱ — ወይም ወደ በርካታ models የሚfan out አንድ agent — በመጨረሻ ተመሳሳይ ግድግዳ ይመታሉ: እያንዳንዱ provider የራሱ SDK፣ የራሱ keys፣ የራሱ rate limits አለው፣ እና spend ለማየት አንድ ቦታ የለም። LiteLLM ከሁሉም ፊት አንድ OpenAI-compatible endpoint በማስቀመጥ ያንን ያስተካክላል። codeዎ አንድ URLን ከmodel name ጋር ይጠራል፤ LiteLLM ወደ OpenAI፣ Anthropic፣ Groq፣ Together፣ Mistral፣ local Ollama — ያዋቀሩት ማንኛውም — ይroute ያደርጋል፣ እና budgets፣ fallbacks፣ እና የእያንዳንዱ call አንድ log ይሰጥዎታል።

በVPS ላይ self-host ማድረግ provider keysዎ፣ prompts እና spend data እርስዎ በሚቆጣጠሩት box ላይ ይኖራሉ ማለት ነው፣ በcrypto ያለKYC የተከፈለ።

LiteLLM proxy ምን እንደሚፈልግ

Docker setup (Ubuntu 24.04)

# dedicated-IP plan, root shell
apt update && apt install -y docker.io docker-compose-v2
systemctl enable --now docker

mkdir -p /opt/litellm && cd /opt/litellm
cat > config.yaml <<'EOF'
model_list:
  - model_name: gpt-4o
    litellm_params:
      model: openai/gpt-4o
      api_key: os.environ/OPENAI_API_KEY
  - model_name: claude
    litellm_params:
      model: anthropic/claude-sonnet-4-5
      api_key: os.environ/ANTHROPIC_API_KEY
  - model_name: local-llama
    litellm_params:
      model: ollama/llama3.1
      api_base: http://host.docker.internal:11434
general_settings:
  master_key: sk-CHANGE-ME          # admin key; issue per-app virtual keys instead
EOF

cat > docker-compose.yml <<'EOF'
services:
  litellm:
    image: ghcr.io/berriai/litellm:main-latest
    restart: always
    ports: [ "127.0.0.1:4000:4000" ]
    environment:
      OPENAI_API_KEY: sk-...            # your provider keys
      ANTHROPIC_API_KEY: sk-ant-...
      DATABASE_URL: postgresql://litellm:change_me@postgres:5432/litellm
    volumes: [ ./config.yaml:/app/config.yaml ]
    command: [ "--config", "/app/config.yaml" ]
  postgres:
    image: postgres:16
    restart: always
    environment:
      POSTGRES_USER: litellm
      POSTGRES_PASSWORD: change_me
      POSTGRES_DB: litellm
    volumes: [ ./pgdata:/var/lib/postgresql/data ]
EOF

docker compose up -d

በdomainዎ ላይ automatic HTTPS ለማግኘት ከፊት Caddy ወይም Nginx ያስቀምጡ፣ ከዚያ ማንኛውም OpenAI SDK ብቻ ይሠራል:

curl https://llm.yourdomain.com/v1/chat/completions \
  -H "Authorization: Bearer sk-your-virtual-key" \
  -H "Content-Type: application/json" \
  -d '{"model":"claude","messages":[{"role":"user","content":"ping"}]}'

ይህ ለagents ለምን ግሩም እንደሆነ

AI agent ወይም multi-agent fleet አብዛኛውን ጊዜ ብዙ model calls ያደርጋል። ከLiteLLM proxy በስተጀርባ ማድረግ ይችላሉ: እያንዳንዱን agent በራሱ virtual key እና budget ይገድቡ፣ ከfrontier model ወደ ርካሽ በራስ-ሰር ይfall back ያድርጉ፣ local Ollamaን ከcloud APIs ጋር ያዋሃዱ፣ እና እያንዳንዱ agent በትክክል ምን እንዳወጣ አንድ log ያንብቡ። agent code ሳይነኩ models ይቀይሩ — configን ብቻ ይቀይሩ።

ለLiteLLM gateway ለምን EQVPS

VPS ለAI agents → · Ollama በVPS ላይ self-host ያድርጉ →

FAQ

LiteLLM proxy በእውነት ምን ይሰጠኛል?

ከብዙ providers ፊት አንድ OpenAI-compatible endpoint። appsዎ እና agents አንድ URL እና model name ይጠራሉ፤ LiteLLM ወደ OpenAI፣ Anthropic፣ Groq፣ Together፣ local Ollama፣ ወዘተ ይroute ያደርጋል። per-key budgets፣ rate limits፣ fallbacks እና ለlogs እና cost አንድ ቦታ ያገኛሉ — models ሲቀይሩ app code ሳይቀይሩ።

ምን plan ይፈልጋል?

LiteLLM ራሱ ቀላል ነው — Small ($8/ወር፣ 4 GB RAM) ለproxy ከkeys/spend Postgres ጋር ምቹ ነው። gateway ነው፣ inference box አይደለም: ከባዱ compute በproviders ላይ (ወይም በተለየ GPU/host) ይሮጣል። domain እና HTTPS ከፊት ማስቀመጥ እንዲችሉ dedicated-IP plan ይውሰዱ።

ከhosted gateway ይልቅ ለምን self-host?

provider keysዎ፣ prompts፣ spend data እና logs ከthird party ይልቅ በሚቆጣጠሩት machine ላይ ይቆያሉ። budgets ያዘጋጃሉ እና እያንዳንዱን request ያያሉ። ብዙ calls ለሚfan out agents፣ ያ visibility እና cost control ሙሉ ነጥቡ ነው።

ከlocal models ጋርም ይሠራል?

አዎ። ከLiteLLM model entries አንዱን ወደ local Ollama ይምሩ (ተመሳሳይ VPS ወይም ሌላ box) እና ልክ እንደcloud models በተመሳሳይ OpenAI-compatible API ይጋለጣል — ስለዚህ app ርካሽ local model እና frontier API ከአንድ endpoint በስተጀርባ ማዋሃድ ይችላል።

ID ወይም card ትጠይቃላችሁ?

አይ። በኢሜይል ይመዝገቡ፣ በUSDC ወይም USDT ይክፈሉ። documents የለም፣ card የለም፣ KYC የለም።

← ወደ ብሎግ ተመለስዕቅዶች & ዋጋዎች ይመልከቱ →

አስተያየቶች

እስካሁን አስተያየቶች የሉም። መጀመሪያ ይሁኑ።

አስተያየት ይተዉ

አስተያየቶች ከመታየታቸው በፊት ይጣራሉ።