اگر بیش از یک اپ اجرا میکنید — یا یک ایجنت که به چند مدل شاخه میزند — دیر یا زود به همان دیوار میخورید: هر ارائهدهنده SDK خودش، کلیدهای خودش، محدودیتهای نرخ خودش را دارد و هیچ جای واحدی برای دیدن هزینه نیست. LiteLLM این را با گذاشتن یک نقطهٔ پایانی سازگار با OpenAI جلوی همهچیز حل میکند. کد شما یک URL را با نام مدل صدا میزند؛ LiteLLM آن را به OpenAI، Anthropic، Groq، Together، Mistral، Ollama محلی — هرچه پیکربندی کنید — مسیریابی میکند و بودجه، fallback و یک لاگ از هر فراخوان میدهد.
میزبانی خودیِ آن روی VPS یعنی کلیدهای ارائهدهنده، پرامپتها و دادهٔ هزینهٔ شما روی ماشینی زندگی میکنند که شما کنترلش میکنید، با پرداخت کریپتو بدون KYC.
پراکسی LiteLLM به چه چیزی نیاز دارد
- محاسبهٔ کم — این یک دروازه است. کار سنگین نزد ارائهدهندگان انجام میشود؛ LiteLLM فقط مسیریابی میکند. Small ($8/ماه — ۴ vCPU، ۴ گیگابایت RAM) پراکسی بههمراه یک Postgres برای کلیدهای مجازی و ردیابی هزینه را راحت اجرا میکند.
- یک IP اختصاصی، یک دامنه و HTTPS. اپها و ایجنتها ورودی وصل میشوند، پس یک پلن IPv4 اختصاصی، دامنه و TLS میخواهید. پلنهای NAT ترافیک وب ورودی را نمیپذیرند.
- خروجی به ارائهدهندگان. ماشین به HTTPS خروجی معمولی برای رسیدن به APIهای مدل نیاز دارد — هر پلن آن را دارد.
راهاندازی Docker (Ubuntu 24.04)
apt update && apt install -y docker.io docker-compose-v2
systemctl enable --now docker
mkdir -p /opt/litellm && cd /opt/litellm
cat > config.yaml <<'EOF'
model_list:
- model_name: gpt-4o
litellm_params:
model: openai/gpt-4o
api_key: os.environ/OPENAI_API_KEY
- model_name: claude
litellm_params:
model: anthropic/claude-sonnet-4-5
api_key: os.environ/ANTHROPIC_API_KEY
- model_name: local-llama
litellm_params:
model: ollama/llama3.1
api_base: http://host.docker.internal:11434
general_settings:
master_key: sk-CHANGE-ME
EOF
cat > docker-compose.yml <<'EOF'
services:
litellm:
image: ghcr.io/berriai/litellm:main-latest
restart: always
ports: [ "127.0.0.1:4000:4000" ]
environment:
OPENAI_API_KEY: sk-...
ANTHROPIC_API_KEY: sk-ant-...
DATABASE_URL: postgresql://litellm:change_me@postgres:5432/litellm
volumes: [ ./config.yaml:/app/config.yaml ]
command: [ "--config", "/app/config.yaml" ]
postgres:
image: postgres:16
restart: always
environment:
POSTGRES_USER: litellm
POSTGRES_PASSWORD: change_me
POSTGRES_DB: litellm
volumes: [ ./pgdata:/var/lib/postgresql/data ]
EOF
docker compose up -d
برای HTTPS خودکار روی دامنهتان Caddy یا Nginx را جلو بگذارید، سپس هر SDK از OpenAI کار میکند:
curl https://llm.yourdomain.com/v1/chat/completions \
-H "Authorization: Bearer sk-your-virtual-key" \
-H "Content-Type: application/json" \
-d '{"model":"claude","messages":[{"role":"user","content":"ping"}]}'
چرا این برای ایجنتها عالی است
یک ایجنت هوش مصنوعی یا یک ناوگان چند-ایجنتی معمولاً فراخوانهای مدل زیادی میزند. پشت پراکسی LiteLLM میتوانید: هر ایجنت را با کلید مجازی و بودجهٔ خودش محدود کنید، بهطور خودکار از یک مدل پیشرو به مدل ارزانتر عقبنشینی کنید، Ollama محلی را با APIهای ابری ترکیب کنید و یک لاگ از اینکه هر ایجنت دقیقاً چقدر خرج کرده بخوانید. مدلها را بدون دستزدن به کد ایجنت عوض کنید — فقط پیکربندی را تغییر دهید.
چرا EQVPS برای دروازهٔ LiteLLM
- IPv4 اختصاصی از $8/ماه، سازگار با دامنه + HTTPS، همهٔ پورتها، reverse DNS خودخدمت.
- مکانهای اتحادیهٔ اروپا (آلمان، فنلاند) — مسیرهای تمیز، قانون واقعی حفاظت از داده؛ کلیدها و لاگهای شما در اتحادیهٔ اروپا میمانند.
- بدون KYC، پرداخت با کریپتو. ایمیل برای ثبتنام، USDC/USDT برای پرداخت.
- root در ~۶۰ ثانیه. ایمیجهای تمیز Ubuntu/Debian؛
docker compose upو دروازهٔ شما فعال است.
VPS برای ایجنتهای هوش مصنوعی → · Ollama را روی VPS خودمیزبان کنید →
نظرات
هنوز نظری نیست. اولین نفر باشید.