EQVPS
Mulai

Hosting sendiri proxy LiteLLM di VPS: satu endpoint kompatibel OpenAI untuk semua model

2 Sep 2026 · 2 mnt baca · EQVPS Team

Jika Anda menjalankan lebih dari satu aplikasi — atau satu agen yang bercabang ke beberapa model — Anda akhirnya menabrak tembok yang sama: tiap penyedia punya SDK sendiri, kunci sendiri, batas laju sendiri, dan tak ada satu tempat untuk melihat pengeluaran. LiteLLM memperbaikinya dengan menempatkan satu endpoint kompatibel OpenAI di depan segalanya. Kode Anda memanggil satu URL dengan nama model; LiteLLM merutekannya ke OpenAI, Anthropic, Groq, Together, Mistral, Ollama lokal — apa pun yang Anda konfigurasi — dan memberi Anda anggaran, fallback, dan satu log setiap panggilan.

Hosting sendiri di VPS berarti kunci penyedia, prompt, dan data pengeluaran Anda tinggal di mesin yang Anda kendalikan, dibayar dengan kripto tanpa KYC.

Yang dibutuhkan proxy LiteLLM

Penyiapan Docker (Ubuntu 24.04)

apt update && apt install -y docker.io docker-compose-v2
systemctl enable --now docker

mkdir -p /opt/litellm && cd /opt/litellm
cat > config.yaml <<'EOF'
model_list:
  - model_name: gpt-4o
    litellm_params:
      model: openai/gpt-4o
      api_key: os.environ/OPENAI_API_KEY
  - model_name: claude
    litellm_params:
      model: anthropic/claude-sonnet-4-5
      api_key: os.environ/ANTHROPIC_API_KEY
  - model_name: local-llama
    litellm_params:
      model: ollama/llama3.1
      api_base: http://host.docker.internal:11434
general_settings:
  master_key: sk-CHANGE-ME
EOF

cat > docker-compose.yml <<'EOF'
services:
  litellm:
    image: ghcr.io/berriai/litellm:main-latest
    restart: always
    ports: [ "127.0.0.1:4000:4000" ]
    environment:
      OPENAI_API_KEY: sk-...
      ANTHROPIC_API_KEY: sk-ant-...
      DATABASE_URL: postgresql://litellm:change_me@postgres:5432/litellm
    volumes: [ ./config.yaml:/app/config.yaml ]
    command: [ "--config", "/app/config.yaml" ]
  postgres:
    image: postgres:16
    restart: always
    environment:
      POSTGRES_USER: litellm
      POSTGRES_PASSWORD: change_me
      POSTGRES_DB: litellm
    volumes: [ ./pgdata:/var/lib/postgresql/data ]
EOF

docker compose up -d

Letakkan Caddy atau Nginx di depan untuk HTTPS otomatis di domain Anda, lalu SDK OpenAI apa pun langsung bekerja:

curl https://llm.yourdomain.com/v1/chat/completions \
  -H "Authorization: Bearer sk-your-virtual-key" \
  -H "Content-Type: application/json" \
  -d '{"model":"claude","messages":[{"role":"user","content":"ping"}]}'

Mengapa ini bagus untuk agen

Sebuah agen AI atau armada multi-agen biasanya melakukan banyak panggilan model. Di balik proxy LiteLLM Anda bisa: membatasi tiap agen dengan kunci virtual dan anggarannya sendiri, jatuh otomatis dari model canggih ke yang lebih murah, mencampur Ollama lokal dengan API cloud, dan membaca satu log persis berapa yang dibelanjakan tiap agen. Ganti model tanpa menyentuh kode agen — cukup ubah konfigurasi.

Mengapa EQVPS untuk gateway LiteLLM

VPS untuk agen AI → · Hosting sendiri Ollama di VPS →

Pertanyaan umum

Apa sebenarnya yang diberikan proxy LiteLLM?

Satu endpoint kompatibel OpenAI di depan banyak penyedia. Aplikasi dan agen Anda memanggil satu URL dan nama model; LiteLLM merutekan ke OpenAI, Anthropic, Groq, Together, Ollama lokal, dll. Anda mendapat anggaran per kunci, batas laju, fallback, dan satu tempat untuk log dan biaya — tanpa mengubah kode aplikasi saat berganti model.

Paket apa yang dibutuhkan?

LiteLLM sendiri ringan — Small ($8/bln, 4 GB RAM) nyaman menjalankan proxy plus Postgres untuk kunci/pengeluaran. Ini gateway, bukan mesin inferensi: komputasi berat berjalan di penyedia (atau GPU/host terpisah). Ambil paket IP khusus untuk domain dan HTTPS.

Mengapa hosting sendiri daripada gateway terkelola?

Kunci penyedia, prompt, data pengeluaran, dan log Anda tetap di mesin yang Anda kendalikan, bukan pihak ketiga. Anda menetapkan anggaran dan melihat setiap permintaan. Untuk agen yang menyebar banyak panggilan, visibilitas dan kendali biaya itu adalah intinya.

Apakah bekerja dengan model lokal juga?

Ya. Arahkan salah satu entri model LiteLLM ke Ollama lokal (VPS yang sama atau mesin lain) dan ia terekspos melalui API kompatibel OpenAI yang sama seperti model cloud — sebuah aplikasi bisa mencampur model lokal murah dan API canggih di balik satu endpoint.

Apakah Anda meminta identitas atau kartu?

Tidak. Daftar dengan email, bayar dengan USDC atau USDT. Tanpa dokumen, tanpa kartu, tanpa KYC.

← Kembali ke blogLihat paket dan harga →

Komentar

Belum ada komentar. Jadilah yang pertama.

Tinggalkan komentar

Komentar dimoderasi sebelum muncul.