إن كنت تشغّل أكثر من تطبيق — أو وكيلًا يتفرّع إلى عدّة نماذج — فستصطدم في النهاية بالجدار نفسه: لكل مزوّد SDK خاص، ومفاتيح خاصة، وحدود معدّل خاصة، ولا مكان واحد لرؤية الإنفاق. يحلّ LiteLLM ذلك بوضع نقطة نهاية متوافقة مع OpenAI أمام كل شيء. ينادي كودك رابطًا واحدًا باسم نموذج؛ فيوجّهه LiteLLM إلى OpenAI وAnthropic وGroq وTogether وMistral وOllama محلي — ما تُعدّه — ويمنحك ميزانيات وبدائل وسجلًا واحدًا لكل نداء.
استضافته ذاتيًا على VPS تعني أن مفاتيح المزوّدين وموجّهاتك وبيانات إنفاقك تعيش على جهاز تتحكم به أنت، مدفوعًا بالعملات المشفّرة بلا KYC.
ماذا يحتاج بروكسي LiteLLM
- حساب قليل — إنه بوابة. العمل الثقيل يجري لدى المزوّدين؛ وLiteLLM يوجّه فقط. Small ($8/شهريًا — 4 vCPU، 4 GB RAM) يشغّل البروكسي بارتياح إضافةً إلى Postgres للمفاتيح الافتراضية وتتبّع الإنفاق.
- IP مخصّص ونطاق وHTTPS. التطبيقات والوكلاء يتّصلون وارِدًا، لذا تريد خطة IPv4 مخصّص ونطاقًا وTLS. خطط NAT لا تقبل حركة ويب واردة.
- صادر إلى المزوّدين. يحتاج الجهاز إلى HTTPS صادر عادي للوصول إلى واجهات النماذج — متوفّر في كل خطة.
إعداد Docker (Ubuntu 24.04)
apt update && apt install -y docker.io docker-compose-v2
systemctl enable --now docker
mkdir -p /opt/litellm && cd /opt/litellm
cat > config.yaml <<'EOF'
model_list:
- model_name: gpt-4o
litellm_params:
model: openai/gpt-4o
api_key: os.environ/OPENAI_API_KEY
- model_name: claude
litellm_params:
model: anthropic/claude-sonnet-4-5
api_key: os.environ/ANTHROPIC_API_KEY
- model_name: local-llama
litellm_params:
model: ollama/llama3.1
api_base: http://host.docker.internal:11434
general_settings:
master_key: sk-CHANGE-ME
EOF
cat > docker-compose.yml <<'EOF'
services:
litellm:
image: ghcr.io/berriai/litellm:main-latest
restart: always
ports: [ "127.0.0.1:4000:4000" ]
environment:
OPENAI_API_KEY: sk-...
ANTHROPIC_API_KEY: sk-ant-...
DATABASE_URL: postgresql://litellm:change_me@postgres:5432/litellm
volumes: [ ./config.yaml:/app/config.yaml ]
command: [ "--config", "/app/config.yaml" ]
postgres:
image: postgres:16
restart: always
environment:
POSTGRES_USER: litellm
POSTGRES_PASSWORD: change_me
POSTGRES_DB: litellm
volumes: [ ./pgdata:/var/lib/postgresql/data ]
EOF
docker compose up -d
ضع Caddy أو Nginx في المقدّمة لـ HTTPS تلقائي على نطاقك، ثم يعمل أي SDK من OpenAI مباشرةً:
curl https://llm.yourdomain.com/v1/chat/completions \
-H "Authorization: Bearer sk-your-virtual-key" \
-H "Content-Type: application/json" \
-d '{"model":"claude","messages":[{"role":"user","content":"ping"}]}'
لماذا هذا رائع للوكلاء
عادةً ما يجري وكيل ذكاء اصطناعي أو أسطول وكلاء متعدد كثيرًا من نداءات النماذج. خلف بروكسي LiteLLM يمكنك: تقييد كل وكيل بمفتاحه الافتراضي وميزانيته، والتراجع تلقائيًا من نموذج متقدّم إلى أرخص، ومزج Ollama محلي مع واجهات سحابية، وقراءة سجل واحد لِما أنفقه كل وكيل بالضبط. بدّل النماذج دون لمس كود الوكيل — فقط غيّر الإعداد.
لماذا EQVPS لبوابة LiteLLM
- IPv4 مخصّص من $8/شهريًا، ملائم للنطاق + HTTPS، كل المنافذ، DNS عكسي ذاتي الخدمة.
- مواقع في الاتحاد الأوروبي (ألمانيا، فنلندا) — مسارات نظيفة، قانون حماية بيانات حقيقي؛ مفاتيحك وسجلاتك تبقى في الاتحاد الأوروبي.
- بلا KYC، دفع بالعملات المشفّرة. بريد للتسجيل، وUSDC/USDT للدفع.
- root خلال ~60 ثانية. صور Ubuntu/Debian نظيفة؛
docker compose upوبوابتك تعمل.
التعليقات
لا تعليقات بعد. كن الأول.