EQVPS

אחסנו-בעצמכם proxy של LiteLLM על VPS: נקודת קצה אחת תואמת-OpenAI לכל מודל

2 בספט׳ 2026 · 2 דק' קריאה · EQVPS Team

אם אתם מריצים יותר מאפליקציה אחת — או סוכן אחד שמפזר לכמה מודלים — אתם בסוף פוגעים באותו קיר: לכל ספק יש SDK משלו, מפתחות משלו, מגבלות קצב משלו, ואין מקום אחד לראות הוצאה. LiteLLM מתקן את זה על ידי שימת נקודת קצה אחת תואמת-OpenAI מלפני הכל. הקוד שלכם קורא ל-URL אחד עם שם מודל; LiteLLM מנתב אותו ל-OpenAI, Anthropic, Groq, Together, Mistral, Ollama מקומי — מה שהגדרתם — ונותן לכם תקציבים, fallbacks, ולוג אחד של כל קריאה.

אחסון-עצמי שלו על VPS אומר שמפתחות הספק, ה-prompts ונתוני ההוצאה שלכם חיים על ארגז שאתם שולטים בו, משולם בקריפטו ללא KYC.

מה proxy של LiteLLM צריך

הגדרת Docker (Ubuntu 24.04)

# dedicated-IP plan, root shell
apt update && apt install -y docker.io docker-compose-v2
systemctl enable --now docker

mkdir -p /opt/litellm && cd /opt/litellm
cat > config.yaml <<'EOF'
model_list:
  - model_name: gpt-4o
    litellm_params:
      model: openai/gpt-4o
      api_key: os.environ/OPENAI_API_KEY
  - model_name: claude
    litellm_params:
      model: anthropic/claude-sonnet-4-5
      api_key: os.environ/ANTHROPIC_API_KEY
  - model_name: local-llama
    litellm_params:
      model: ollama/llama3.1
      api_base: http://host.docker.internal:11434
general_settings:
  master_key: sk-CHANGE-ME          # admin key; issue per-app virtual keys instead
EOF

cat > docker-compose.yml <<'EOF'
services:
  litellm:
    image: ghcr.io/berriai/litellm:main-latest
    restart: always
    ports: [ "127.0.0.1:4000:4000" ]
    environment:
      OPENAI_API_KEY: sk-...            # your provider keys
      ANTHROPIC_API_KEY: sk-ant-...
      DATABASE_URL: postgresql://litellm:change_me@postgres:5432/litellm
    volumes: [ ./config.yaml:/app/config.yaml ]
    command: [ "--config", "/app/config.yaml" ]
  postgres:
    image: postgres:16
    restart: always
    environment:
      POSTGRES_USER: litellm
      POSTGRES_PASSWORD: change_me
      POSTGRES_DB: litellm
    volumes: [ ./pgdata:/var/lib/postgresql/data ]
EOF

docker compose up -d

שימו Caddy או Nginx מלפנים ל-HTTPS אוטומטי על הדומיין שלכם, ואז כל SDK של OpenAI פשוט עובד:

curl https://llm.yourdomain.com/v1/chat/completions \
  -H "Authorization: Bearer sk-your-virtual-key" \
  -H "Content-Type: application/json" \
  -d '{"model":"claude","messages":[{"role":"user","content":"ping"}]}'

למה זה נהדר לסוכנים

סוכן AI או צי רב-סוכני בדרך כלל מבצע הרבה קריאות מודל. מאחורי proxy של LiteLLM אתם יכולים: לתחום כל סוכן עם מפתח וירטואלי ותקציב משלו, לחזור אוטומטית ממודל חזיתי לזול יותר, לערבב Ollama מקומי עם APIs של ענן, ולקרוא לוג אחד של בדיוק מה שכל סוכן הוציא. החליפו מודלים בלי לגעת בקוד הסוכן — פשוט שנו את ההגדרה.

למה EQVPS ל-gateway של LiteLLM

VPS לסוכני AI → · אחסנו-בעצמכם את Ollama על VPS →

שאלות נפוצות

מה proxy של LiteLLM בעצם נותן לי?

נקודת קצה אחת תואמת-OpenAI מלפני ספקים רבים. האפליקציות והסוכנים שלכם קוראים ל-URL ושם מודל בודדים; LiteLLM מנתב ל-OpenAI, Anthropic, Groq, Together, Ollama מקומי וכו'. אתם מקבלים תקציבים לכל-מפתח, מגבלות קצב, fallbacks ומקום אחד ללוגים ועלות — בלי לשנות קוד אפליקציה כשאתם מחליפים מודלים.

איזו תוכנית זה צריך?

LiteLLM עצמו קל — Small ($8/חודש, 4 GB RAM) נוח ל-proxy בתוספת Postgres למפתחות/הוצאה. זה gateway, לא ארגז inference: ה-compute הכבד רץ אצל הספקים (או על GPU/מארח נפרד). קחו תוכנית עם IP ייעודי כך שתוכלו לשים דומיין ו-HTTPS מלפנים.

למה לאחסן-בעצמי במקום להשתמש ב-gateway מאוחסן?

מפתחות הספק, ה-prompts, נתוני ההוצאה והלוגים שלכם נשארים על מכונה שאתם שולטים בה במקום צד שלישי. אתם קובעים את התקציבים ורואים כל בקשה. לסוכנים שמפזרים הרבה קריאות, הנראות ובקרת העלות הזו הן כל הנקודה.

האם זה עובד גם עם מודלים מקומיים?

כן. כוונו אחת מרשומות המודל של LiteLLM ל-Ollama מקומי (אותו VPS או ארגז אחר) והוא חשוף דרך אותו API תואם-OpenAI כמו מודלי הענן — אז אפליקציה יכולה לערבב מודל מקומי זול ו-API חזיתי מאחורי נקודת קצה אחת.

האם אתם מבקשים תעודה או כרטיס?

לא. הירשמו עם אימייל, שלמו ב-USDC או USDT. ללא מסמכים, ללא כרטיס, ללא KYC.

← חזרה לבלוגראו תוכניות ומחירים →

תגובות

אין עדיין תגובות. היו הראשונים.

השאירו תגובה

התגובות עוברות מודרציה לפני שהן מופיעות.