EQVPS

Autoaloja un proxy LiteLLM en un VPS: un endpoint compatible con OpenAI para todos los modelos

2 sept 2026 · 3 min de lectura · EQVPS Team

Si corres más de una app — o un agente que se ramifica a varios modelos — acabas chocando con el mismo muro: cada proveedor tiene su SDK, sus claves, sus límites, y ningún lugar único para ver el gasto. LiteLLM lo arregla poniendo un endpoint compatible con OpenAI delante de todo. Tu código llama a una URL con un nombre de modelo; LiteLLM lo enruta a OpenAI, Anthropic, Groq, Together, Mistral, un Ollama local — lo que configures — y te da presupuestos, fallbacks y un log de cada llamada.

Autoalojarlo en un VPS significa que tus claves de proveedores, tus prompts y tus datos de gasto viven en una máquina que controlas, pagada en cripto sin KYC.

Qué necesita un proxy LiteLLM

Configuración con Docker (Ubuntu 24.04)

apt update && apt install -y docker.io docker-compose-v2
systemctl enable --now docker

mkdir -p /opt/litellm && cd /opt/litellm
cat > config.yaml <<'EOF'
model_list:
  - model_name: gpt-4o
    litellm_params:
      model: openai/gpt-4o
      api_key: os.environ/OPENAI_API_KEY
  - model_name: claude
    litellm_params:
      model: anthropic/claude-sonnet-4-5
      api_key: os.environ/ANTHROPIC_API_KEY
  - model_name: local-llama
    litellm_params:
      model: ollama/llama3.1
      api_base: http://host.docker.internal:11434
general_settings:
  master_key: sk-CHANGE-ME
EOF

cat > docker-compose.yml <<'EOF'
services:
  litellm:
    image: ghcr.io/berriai/litellm:main-latest
    restart: always
    ports: [ "127.0.0.1:4000:4000" ]
    environment:
      OPENAI_API_KEY: sk-...
      ANTHROPIC_API_KEY: sk-ant-...
      DATABASE_URL: postgresql://litellm:change_me@postgres:5432/litellm
    volumes: [ ./config.yaml:/app/config.yaml ]
    command: [ "--config", "/app/config.yaml" ]
  postgres:
    image: postgres:16
    restart: always
    environment:
      POSTGRES_USER: litellm
      POSTGRES_PASSWORD: change_me
      POSTGRES_DB: litellm
    volumes: [ ./pgdata:/var/lib/postgresql/data ]
EOF

docker compose up -d

Pon Caddy o Nginx delante para HTTPS automático en tu dominio, y cualquier SDK de OpenAI funciona:

curl https://llm.yourdomain.com/v1/chat/completions \
  -H "Authorization: Bearer sk-your-virtual-key" \
  -H "Content-Type: application/json" \
  -d '{"model":"claude","messages":[{"role":"user","content":"ping"}]}'

Por qué esto es genial para agentes

Un agente de IA o una flota multiagente suele hacer muchas llamadas a modelos. Tras un proxy LiteLLM puedes: limitar cada agente con su propia clave virtual y presupuesto, caer automáticamente de un modelo de frontera a uno más barato, mezclar un Ollama local con API en la nube, y leer un solo log de cuánto gastó cada agente. Cambia de modelo sin tocar el código del agente — solo cambia la config.

Por qué EQVPS para una pasarela LiteLLM

VPS para agentes de IA → · Autoaloja Ollama en un VPS →

Preguntas frecuentes

¿Qué me da realmente un proxy LiteLLM?

Un endpoint compatible con OpenAI delante de muchos proveedores. Tus apps y agentes llaman a una única URL y nombre de modelo; LiteLLM enruta a OpenAI, Anthropic, Groq, Together, un Ollama local, etc. Obtienes presupuestos por clave, límites, fallbacks y un solo lugar para logs y coste — sin cambiar el código al cambiar de modelo.

¿Qué plan necesita?

LiteLLM en sí es ligero — Small ($8/mes, 4 GB RAM) corre cómodo el proxy más un Postgres para claves/gasto. Es una pasarela, no una máquina de inferencia: el cómputo pesado corre en los proveedores (o en un GPU/host aparte). Toma un plan de IP dedicada para dominio y HTTPS.

¿Por qué autoalojar en vez de una pasarela alojada?

Tus claves de proveedores, prompts, datos de gasto y logs quedan en una máquina que tú controlas, no en un tercero. Tú fijas los presupuestos y ves cada petición. Para agentes que hacen muchas llamadas, esa visibilidad y control de coste es todo el sentido.

¿Funciona también con modelos locales?

Sí. Apunta una entrada de modelo de LiteLLM a un Ollama local (mismo VPS u otra máquina) y queda expuesto por la misma API compatible con OpenAI que los modelos en la nube — una app puede mezclar un modelo local barato y una API de frontera tras un endpoint.

¿Piden identificación o tarjeta?

No. Registro por correo, pago con USDC o USDT. Sin documentos, sin tarjeta, sin KYC.

← Volver al blogVer planes y precios →

Comentarios

Aún no hay comentarios. Sé el primero.

Deja un comentario

Los comentarios se moderan antes de aparecer.