EQVPS

یو LiteLLM proxy په یوه VPS ځان-کوربه کړئ: د هر مودل لپاره یو OpenAI-سره سمون endpoint

Sep 2, 2026 · 3 دقیقې لوستل · EQVPS Team

که تاسو له یوه اپلیکیشن څخه ډیر چلوئ — یا یو اجنټ چې څو مودلونو ته خپریږي — تاسو بالاخره په همدې دیوال ولګیږئ: هر چمتوکوونکی خپل SDK، خپل کیلي، خپل rate limitونه لري، او د لګښت لیدلو هیڅ واحد ځای نشته. LiteLLM دا سموي په دې چې د هر څه مخته یو OpenAI-سره سمون endpoint کیږدي. ستاسو کوډ یو URL د یوه د مودل نوم سره بولي؛ LiteLLM یې OpenAI، Anthropic، Groq، Together، Mistral، یو محلي Ollama — هر څه چې تاسو یې تنظیم کړی — ته لار کوي، او تاسو ته بودجې، fallbackونه، او د هرې کاله یو log درکوي.

په یوه VPS یې ځان-کوربه کول پدې معنی چې ستاسو د چمتوکوونکي کیلي، ستاسو پرامپټونه او ستاسو د لګښت ډیټا یوه box ته اوسیږي چې تاسو یې کنټرولوئ، په crypto بې KYC تادیه شوی.

یو LiteLLM proxy څه ته اړتیا لري

د Docker تنظیم (Ubuntu 24.04)

# dedicated-IP plan, root shell
apt update && apt install -y docker.io docker-compose-v2
systemctl enable --now docker

mkdir -p /opt/litellm && cd /opt/litellm
cat > config.yaml <<'EOF'
model_list:
  - model_name: gpt-4o
    litellm_params:
      model: openai/gpt-4o
      api_key: os.environ/OPENAI_API_KEY
  - model_name: claude
    litellm_params:
      model: anthropic/claude-sonnet-4-5
      api_key: os.environ/ANTHROPIC_API_KEY
  - model_name: local-llama
    litellm_params:
      model: ollama/llama3.1
      api_base: http://host.docker.internal:11434
general_settings:
  master_key: sk-CHANGE-ME          # admin key; issue per-app virtual keys instead
EOF

cat > docker-compose.yml <<'EOF'
services:
  litellm:
    image: ghcr.io/berriai/litellm:main-latest
    restart: always
    ports: [ "127.0.0.1:4000:4000" ]
    environment:
      OPENAI_API_KEY: sk-...            # your provider keys
      ANTHROPIC_API_KEY: sk-ant-...
      DATABASE_URL: postgresql://litellm:change_me@postgres:5432/litellm
    volumes: [ ./config.yaml:/app/config.yaml ]
    command: [ "--config", "/app/config.yaml" ]
  postgres:
    image: postgres:16
    restart: always
    environment:
      POSTGRES_USER: litellm
      POSTGRES_PASSWORD: change_me
      POSTGRES_DB: litellm
    volumes: [ ./pgdata:/var/lib/postgresql/data ]
EOF

docker compose up -d

مخته د خپل ډومین اتوماتیک HTTPS لپاره Caddy یا Nginx کیږدئ، بیا هر OpenAI SDK یوازې کار کوي:

curl https://llm.yourdomain.com/v1/chat/completions \
  -H "Authorization: Bearer sk-your-virtual-key" \
  -H "Content-Type: application/json" \
  -d '{"model":"claude","messages":[{"role":"user","content":"ping"}]}'

ولې دا د اجنټانو لپاره عالي دی

یو AI اجنټ یا یو څو-اجنټ فلیټ معمولاً ډیر د مودل کالونه کوي. د یوه LiteLLM proxy تر شا تاسو کولی شئ: هر اجنټ د خپل مجازي کیلي او بودجې سره محدود کړئ، له یوه frontier مودل څخه یوه ارزانه ته په اتوماتیک ډول fallback وکړئ، یو محلي Ollama د cloud APIونو سره وګډوئ، او د دې یو log ولولئ چې دقیقاً هر اجنټ څه ولګول. مودلونه د اجنټ کوډ لمس کولو پرته بدل کړئ — یوازې config بدل کړئ.

ولې EQVPS د یوه LiteLLM gateway لپاره

VPS د AI اجنټانو لپاره → · Ollama په یوه VPS ځان-کوربه کړئ →

پوښتنې

یو LiteLLM proxy واقعاً ما ته څه درکوي؟

د ډیرو چمتوکوونکو مخته یو OpenAI-سره سمون endpoint. ستاسو اپلیکیشنونه او اجنټان یو واحد URL او د مودل نوم بولي؛ LiteLLM OpenAI، Anthropic، Groq، Together، یو محلي Ollama، او نورو ته لار کوي. تاسو د-هرې-کیلي بودجې، rate limitونه، fallbackونه او د logونو او لګښت لپاره یو ځای ترلاسه کوئ — د اپلیکیشن کوډ بدلولو پرته کله چې مودلونه بدلوئ.

دا کوم پلان ته اړتیا لري؟

LiteLLM پخپله سپک دی — Small ($8/میاشت، 4 GB RAM) د proxy سربیره د کیلیو/لګښت لپاره Postgres لپاره آرام دی. دا یو gateway دی، نه یو inference box: درنه محاسبه د چمتوکوونکو کې (یا په یوه جلا GPU/کوربه) چلیږي. یو dedicated-IP پلان واخلئ نو تاسو کولی شئ یو ډومین او HTTPS مخته کیږدئ.

ولې د یوه کوربه شوي gateway کارولو پر ځای ځان-کوربه کول؟

ستاسو د چمتوکوونکي کیلي، پرامپټونه، د لګښت ډیټا او logونه د یوې دریمې ډلې پر ځای یوه ماشین ته پاتې کیږي چې تاسو یې کنټرولوئ. تاسو بودجې ټاکئ او هره غوښتنه ګورئ. د هغو اجنټانو لپاره چې ډیر کالونه خپروي، هغه لیدنه او د لګښت کنټرول ټوله موخه ده.

ایا دا د محلي مودلونو سره هم کار کوي؟

هو. د LiteLLM د مودل مدخلو څخه یو یوه محلي Ollama ته اشاره کړئ (همدا VPS یا بل box) او دا د همدې OpenAI-سره سمون API له لارې د cloud مودلونو په څیر څرګندیږي — نو یو اپلیکیشن کولی شي یو ارزانه محلي مودل او یو frontier API د یوه endpoint تر شا وګډوي.

ایا تاسو د ID یا کارت غواړئ؟

نه. د یوه بریښنالیک سره راجستر شئ، په USDC یا USDT تادیه وکړئ. بې اسنادو، بې کارت، بې KYC.

← بلاګ ته بیرتهپلانونه او بیې وګورئ →

تبصرې

لا تبصرې نشته. لومړی اوسئ.

یوه تبصره پریږدئ

تبصرې د ښکاره کیدو مخکې اعتدال کیږي.