Ако пускаш повече от едно приложение — или един агент, който диама към няколко модела — в крайна сметка удряш същата стена: всеки доставчик има собствен SDK, собствени ключове, собствени rate limits и нито едно място да видиш разхода. LiteLLM поправя това, като слага един OpenAI-съвместим endpoint пред всичко. Кодът ти извиква един URL с име на модел; LiteLLM го маршрутизира към OpenAI, Anthropic, Groq, Together, Mistral, локален Ollama — каквото си конфигурирал — и ти дава бюджети, fallbacks и един лог на всяко извикване.
Хостването му на VPS значи, че ключовете на доставчиците ти, промптовете ти и данните ти за разход живеят на машина, която контролираш ти, платена в crypto без KYC.
Какво се нуждае LiteLLM proxy
- Не много изчисление — той е gateway. Тежката работа се случва при доставчиците; LiteLLM просто маршрутизира. Small ($8/месец — 4 vCPU, 4 GB RAM) пуска комфортно proxy-то плюс Postgres за виртуални ключове и проследяване на разход.
- Dedicated IP, домейн и HTTPS. Приложенията и агентите ти се свързват входящо, така че искаш план с dedicated IPv4, домейн и TLS. NAT плановете не приемат входящ web трафик.
- Изходящо към доставчиците. Машината се нуждае от нормален изходящ HTTPS, за да достигне model API-тата — всеки план го има.
Docker настройка (Ubuntu 24.04)
# dedicated-IP plan, root shell
apt update && apt install -y docker.io docker-compose-v2
systemctl enable --now docker
mkdir -p /opt/litellm && cd /opt/litellm
cat > config.yaml <<'EOF'
model_list:
- model_name: gpt-4o
litellm_params:
model: openai/gpt-4o
api_key: os.environ/OPENAI_API_KEY
- model_name: claude
litellm_params:
model: anthropic/claude-sonnet-4-5
api_key: os.environ/ANTHROPIC_API_KEY
- model_name: local-llama
litellm_params:
model: ollama/llama3.1
api_base: http://host.docker.internal:11434
general_settings:
master_key: sk-CHANGE-ME # admin key; issue per-app virtual keys instead
EOF
cat > docker-compose.yml <<'EOF'
services:
litellm:
image: ghcr.io/berriai/litellm:main-latest
restart: always
ports: [ "127.0.0.1:4000:4000" ]
environment:
OPENAI_API_KEY: sk-... # your provider keys
ANTHROPIC_API_KEY: sk-ant-...
DATABASE_URL: postgresql://litellm:change_me@postgres:5432/litellm
volumes: [ ./config.yaml:/app/config.yaml ]
command: [ "--config", "/app/config.yaml" ]
postgres:
image: postgres:16
restart: always
environment:
POSTGRES_USER: litellm
POSTGRES_PASSWORD: change_me
POSTGRES_DB: litellm
volumes: [ ./pgdata:/var/lib/postgresql/data ]
EOF
docker compose up -d
Сложи Caddy или Nginx отпред за автоматичен HTTPS на домейна ти, после всеки OpenAI SDK просто работи:
curl https://llm.yourdomain.com/v1/chat/completions \
-H "Authorization: Bearer sk-your-virtual-key" \
-H "Content-Type: application/json" \
-d '{"model":"claude","messages":[{"role":"user","content":"ping"}]}'
Защо това е чудесно за агенти
AI агент или multi-agent флот обикновено прави много извиквания на модел. Зад LiteLLM proxy можеш: да ограничиш всеки агент със собствен виртуален ключ и бюджет, да ripиеш от frontier модел към по-евтин автоматично, да смесиш локален Ollama с облачни API-та, и да четеш един лог на точно колко е похарчил всеки агент. Сменяй модели, без да докосваш кода на агента — просто смени конфигурацията.
Защо EQVPS за LiteLLM gateway
- Dedicated IPv4 от $8/месец, приятелски с домейн + HTTPS, всички портове, rDNS self-service.
- ЕС локации (Германия, Финландия) — чисти маршрути, реален закон за защита на данните; ключовете и логовете ти остават в ЕС.
- Без KYC, плащане в crypto. Имейл за регистрация, USDC/USDT за плащане.
- Root за ~60 секунди. Чисти Ubuntu/Debian образи;
docker compose upи gateway-ят ти е live.
Коментари
Още няма коментари. Бъди първият.