EQVPS

LiteLLM proxy-ის თვით-ჰოსტინგი VPS-ზე: ერთი OpenAI-თავსებადი endpoint ყოველი მოდელისთვის

Sep 2, 2026 · 2 წთ კითხვა · EQVPS Team

თუ ერთზე მეტ აპლიკაციას უშვებთ — ან ერთ აგენტს, რომელიც რამდენიმე მოდელზე იშლება — ბოლოს იმავე კედელს ხვდებით: ყოველ პროვაიდერს აქვს საკუთარი SDK, საკუთარი გასაღებები, საკუთარი rate limit-ები და არავითარი ერთი ადგილი ხარჯის სანახავად. LiteLLM ამას ასწორებს ერთი OpenAI-თავსებადი endpoint-ის ყველაფრის წინ დაყენებით. თქვენი კოდი იძახებს ერთ URL-ს მოდელის სახელით; LiteLLM მარშრუტავს მას OpenAI-ზე, Anthropic-ზე, Groq-ზე, Together-ზე, Mistral-ზე, ლოკალურ Ollama-ზე — რაც დააკონფიგურირეთ — და გაძლევთ ბიუჯეტებს, fallback-ებსა და ერთ log-ს ყოველი ზარისა.

მისი VPS-ზე თვით-ჰოსტინგი ნიშნავს, რომ თქვენი პროვაიდერის გასაღებები, თქვენი prompt-ები და თქვენი ხარჯის მონაცემები ცხოვრობს box-ზე, რომელსაც თქვენ აკონტროლებთ, გადახდილი კრიპტოთი KYC-ის გარეშე.

რა სჭირდება LiteLLM proxy-ს

Docker დაყენება (Ubuntu 24.04)

# dedicated-IP plan, root shell
apt update && apt install -y docker.io docker-compose-v2
systemctl enable --now docker

mkdir -p /opt/litellm && cd /opt/litellm
cat > config.yaml <<'EOF'
model_list:
  - model_name: gpt-4o
    litellm_params:
      model: openai/gpt-4o
      api_key: os.environ/OPENAI_API_KEY
  - model_name: claude
    litellm_params:
      model: anthropic/claude-sonnet-4-5
      api_key: os.environ/ANTHROPIC_API_KEY
  - model_name: local-llama
    litellm_params:
      model: ollama/llama3.1
      api_base: http://host.docker.internal:11434
general_settings:
  master_key: sk-CHANGE-ME          # admin key; issue per-app virtual keys instead
EOF

cat > docker-compose.yml <<'EOF'
services:
  litellm:
    image: ghcr.io/berriai/litellm:main-latest
    restart: always
    ports: [ "127.0.0.1:4000:4000" ]
    environment:
      OPENAI_API_KEY: sk-...            # your provider keys
      ANTHROPIC_API_KEY: sk-ant-...
      DATABASE_URL: postgresql://litellm:change_me@postgres:5432/litellm
    volumes: [ ./config.yaml:/app/config.yaml ]
    command: [ "--config", "/app/config.yaml" ]
  postgres:
    image: postgres:16
    restart: always
    environment:
      POSTGRES_USER: litellm
      POSTGRES_PASSWORD: change_me
      POSTGRES_DB: litellm
    volumes: [ ./pgdata:/var/lib/postgresql/data ]
EOF

docker compose up -d

დააყენეთ Caddy ან Nginx წინ ავტომატური HTTPS-ისთვის თქვენს დომენზე, შემდეგ ნებისმიერი OpenAI SDK უბრალოდ მუშაობს:

curl https://llm.yourdomain.com/v1/chat/completions \
  -H "Authorization: Bearer sk-your-virtual-key" \
  -H "Content-Type: application/json" \
  -d '{"model":"claude","messages":[{"role":"user","content":"ping"}]}'

რატომ არის ეს შესანიშნავი აგენტებისთვის

AI აგენტი ან მრავალ-აგენტიანი ფლოტი ჩვეულებრივ ბევრ მოდელის ზარს აკეთებს. LiteLLM proxy-ის უკან შეგიძლიათ: შეზღუდოთ ყოველი აგენტი საკუთარი ვირტუალური გასაღებითა და ბიუჯეტით, ავტომატურად გადახვიდეთ frontier მოდელიდან უფრო იაფზე, შეურიოთ ლოკალური Ollama cloud API-ებს და წაიკითხოთ ერთი log ზუსტად იმისა, რა დახარჯა ყოველმა აგენტმა. შეცვალეთ მოდელები აგენტის კოდის შეხების გარეშე — უბრალოდ შეცვალეთ კონფიგი.

რატომ EQVPS LiteLLM gateway-ისთვის

VPS AI აგენტებისთვის → · თვით-ჰოსტინგი Ollama VPS-ზე →

ხდკ

რას მაძლევს რეალურად LiteLLM proxy?

ერთ OpenAI-თავსებად endpoint-ს ბევრი პროვაიდერის წინ. თქვენი აპლიკაციები და აგენტები იძახებენ ერთ URL-სა და მოდელის სახელს; LiteLLM მარშრუტავს OpenAI-ზე, Anthropic-ზე, Groq-ზე, Together-ზე, ლოკალურ Ollama-ზე და ა.შ. იღებთ per-key ბიუჯეტებს, rate limit-ებს, fallback-ებსა და ერთ ადგილს log-ებისა და ღირებულებისთვის — აპლიკაციის კოდის შეცვლის გარეშე, როცა მოდელებს ცვლით.

რომელი ტარიფი სჭირდება მას?

LiteLLM თავად მსუბუქია — Small ($8/თვე, 4 GB RAM) კომფორტულია proxy-ისთვის პლუს Postgres გასაღებებისთვის/ხარჯისთვის. ის gateway-ია, არა inference box: მძიმე compute მუშაობს პროვაიდერებთან (ან ცალკე GPU/ჰოსტზე). აიღეთ dedicated-IP ტარიფი, რომ დომენი და HTTPS დააყენოთ წინ.

რატომ თვით-ჰოსტინგი hosted gateway-ის ნაცვლად?

თქვენი პროვაიდერის გასაღებები, prompt-ები, ხარჯის მონაცემები და log-ები რჩება მანქანაზე, რომელსაც აკონტროლებთ, მესამე მხარის ნაცვლად. თქვენ აყენებთ ბიუჯეტებს და ხედავთ ყოველ მოთხოვნას. აგენტებისთვის, რომლებიც ბევრ ზარს ისვრიან, ის ხილვადობა და ღირებულების კონტროლი მთელი აზრია.

მუშაობს ის ლოკალურ მოდელებთანაც?

დიახ. მიმართეთ ერთი LiteLLM მოდელის ჩანაწერი ლოკალურ Ollama-ზე (იმავე VPS-ზე ან სხვა box-ზე) და ის გამოაშკარავებულია იმავე OpenAI-თავსებადი API-ით, რაც cloud მოდელები — ასე რომ აპლიკაციას შეუძლია იაფი ლოკალური მოდელისა და frontier API-ის შერევა ერთი endpoint-ის უკან.

ითხოვთ ID-ს ან ბარათს?

არა. დარეგისტრირდით ელფოსტით, გადაიხადეთ USDC-ით ან USDT-ით. არავითარი დოკუმენტი, ბარათი, KYC.

← ბლოგზე დაბრუნებატარიფებისა და ფასების ნახვა →

კომენტარები

ჯერ არ არის კომენტარები. იყავით პირველი.

დატოვეთ კომენტარი

კომენტარები მოდერირდება გამოჩენამდე.