EQVPS

VPS'te LiteLLM proxy'sini kendiniz barındırın: her model için tek bir OpenAI uyumlu uç nokta

2 Eyl 2026 · 2 dk okuma · EQVPS Team

Birden fazla uygulama çalıştırıyorsanız — veya birkaç modele dallanan bir ajan — eninde sonunda aynı duvara toslarsınız: her sağlayıcının kendi SDK'si, kendi anahtarları, kendi hız limitleri var ve harcamayı görecek tek bir yer yok. LiteLLM, her şeyin önüne OpenAI uyumlu bir uç nokta koyarak bunu çözer. Kodunuz bir model adıyla bir URL çağırır; LiteLLM bunu OpenAI, Anthropic, Groq, Together, Mistral, yerel Ollama'ya — yapılandırdığınız neyse ona — yönlendirir ve size bütçeler, yedekler ve her çağrının tek bir logunu verir.

Bunu bir VPS'te kendiniz barındırmak, sağlayıcı anahtarlarınızın, komutlarınızın ve harcama verilerinizin sizin kontrol ettiğiniz bir makinede yaşadığı, kripto ile KYC olmadan ödendiği anlamına gelir.

Bir LiteLLM proxy'si neye ihtiyaç duyar

Docker kurulumu (Ubuntu 24.04)

apt update && apt install -y docker.io docker-compose-v2
systemctl enable --now docker

mkdir -p /opt/litellm && cd /opt/litellm
cat > config.yaml <<'EOF'
model_list:
  - model_name: gpt-4o
    litellm_params:
      model: openai/gpt-4o
      api_key: os.environ/OPENAI_API_KEY
  - model_name: claude
    litellm_params:
      model: anthropic/claude-sonnet-4-5
      api_key: os.environ/ANTHROPIC_API_KEY
  - model_name: local-llama
    litellm_params:
      model: ollama/llama3.1
      api_base: http://host.docker.internal:11434
general_settings:
  master_key: sk-CHANGE-ME
EOF

cat > docker-compose.yml <<'EOF'
services:
  litellm:
    image: ghcr.io/berriai/litellm:main-latest
    restart: always
    ports: [ "127.0.0.1:4000:4000" ]
    environment:
      OPENAI_API_KEY: sk-...
      ANTHROPIC_API_KEY: sk-ant-...
      DATABASE_URL: postgresql://litellm:change_me@postgres:5432/litellm
    volumes: [ ./config.yaml:/app/config.yaml ]
    command: [ "--config", "/app/config.yaml" ]
  postgres:
    image: postgres:16
    restart: always
    environment:
      POSTGRES_USER: litellm
      POSTGRES_PASSWORD: change_me
      POSTGRES_DB: litellm
    volumes: [ ./pgdata:/var/lib/postgresql/data ]
EOF

docker compose up -d

Domain'inizde otomatik HTTPS için önüne Caddy veya Nginx koyun, ardından herhangi bir OpenAI SDK'si çalışır:

curl https://llm.yourdomain.com/v1/chat/completions \
  -H "Authorization: Bearer sk-your-virtual-key" \
  -H "Content-Type: application/json" \
  -d '{"model":"claude","messages":[{"role":"user","content":"ping"}]}'

Bu neden ajanlar için harika

Bir YZ ajanı veya bir çoklu ajan filosu genellikle çok sayıda model çağrısı yapar. Bir LiteLLM proxy'sinin ardında şunları yapabilirsiniz: her ajanı kendi sanal anahtarı ve bütçesiyle sınırlayın, bir sınır modelinden daha ucuz bir modele otomatik geri düşün, yerel bir Ollama'yı bulut API'leriyle karıştırın ve her ajanın tam olarak ne harcadığının tek bir logunu okuyun. Ajan kodunu değiştirmeden model değiştirin — sadece yapılandırmayı değiştirin.

Neden LiteLLM ağ geçidi için EQVPS

YZ ajanları için VPS → · VPS'te Ollama'yı kendiniz barındırın →

SSS

Bir LiteLLM proxy'si bana gerçekte ne kazandırır?

Birçok sağlayıcının önünde tek bir OpenAI uyumlu uç nokta. Uygulamalarınız ve ajanlarınız tek bir URL ve model adı çağırır; LiteLLM bunu OpenAI, Anthropic, Groq, Together, yerel Ollama vb.'ye yönlendirir. Anahtar başına bütçeler, hız limitleri, yedekler ve loglar ile maliyet için tek bir yer alırsınız — model değiştirdiğinizde uygulama kodunu değiştirmeden.

Hangi planı gerektirir?

LiteLLM'in kendisi hafiftir — Small ($8/ay, 4 GB RAM) proxy'yi artı anahtar/harcama için bir Postgres'i rahatça çalıştırır. Bu bir ağ geçidi, çıkarım makinesi değil: ağır hesaplama sağlayıcılarda (veya ayrı bir GPU/ana bilgisayarda) çalışır. Domain ve HTTPS için ayrılmış IP planı alın.

Neden barındırılan bir ağ geçidi yerine kendim barındırayım?

Sağlayıcı anahtarlarınız, komutlarınız, harcama verileriniz ve loglarınız üçüncü bir taraf yerine kontrol ettiğiniz bir makinede kalır. Bütçeleri siz belirler, her isteği görürsünüz. Çok sayıda çağrı dağıtan ajanlar için bu görünürlük ve maliyet kontrolü işin özüdür.

Yerel modellerle de çalışır mı?

Evet. LiteLLM model girişlerinden birini yerel bir Ollama'ya (aynı VPS veya başka bir makine) yönlendirin; bulut modelleriyle aynı OpenAI uyumlu API üzerinden sunulur — bir uygulama tek bir uç noktanın ardında ucuz bir yerel modeli ve bir sınır API'sini karıştırabilir.

Kimlik veya kart istiyor musunuz?

Hayır. E-posta ile kayıt, USDC veya USDT ile ödeme. Belge yok, kart yok, KYC yok.

← Blog'a dönPlanları ve fiyatları gör →

Yorumlar

Henüz yorum yok. İlk olun.

Bir yorum bırakın

Yorumlar görünmeden önce denetlenir.