EQVPS

VPS에서 LiteLLM 프록시 셀프호스팅: 모든 모델을 위한 하나의 OpenAI 호환 엔드포인트

2026년 9월 2일 · 2 분 읽기 · EQVPS Team

앱을 하나 이상 — 또는 여러 모델로 분기하는 하나의 에이전트를 — 운영하면 결국 같은 벽에 부딪힙니다: 제공자마다 자체 SDK, 자체 키, 자체 속도 제한이 있고 지출을 한눈에 볼 단일 장소가 없습니다. LiteLLM은 모든 것 앞에 OpenAI 호환 엔드포인트를 두어 이를 해결합니다. 코드는 모델 이름으로 하나의 URL을 호출하고, LiteLLM이 이를 OpenAI, Anthropic, Groq, Together, Mistral, 로컬 Ollama — 당신이 구성한 무엇이든 — 로 라우팅하며, 예산·폴백·모든 호출의 단일 로그를 제공합니다.

VPS에 셀프호스팅한다는 것은 제공자 키, 프롬프트, 지출 데이터가 당신이 제어하는 머신에 있으며 암호화폐로 KYC 없이 결제된다는 뜻입니다.

LiteLLM 프록시에 필요한 것

Docker 설정 (Ubuntu 24.04)

apt update && apt install -y docker.io docker-compose-v2
systemctl enable --now docker

mkdir -p /opt/litellm && cd /opt/litellm
cat > config.yaml <<'EOF'
model_list:
  - model_name: gpt-4o
    litellm_params:
      model: openai/gpt-4o
      api_key: os.environ/OPENAI_API_KEY
  - model_name: claude
    litellm_params:
      model: anthropic/claude-sonnet-4-5
      api_key: os.environ/ANTHROPIC_API_KEY
  - model_name: local-llama
    litellm_params:
      model: ollama/llama3.1
      api_base: http://host.docker.internal:11434
general_settings:
  master_key: sk-CHANGE-ME
EOF

cat > docker-compose.yml <<'EOF'
services:
  litellm:
    image: ghcr.io/berriai/litellm:main-latest
    restart: always
    ports: [ "127.0.0.1:4000:4000" ]
    environment:
      OPENAI_API_KEY: sk-...
      ANTHROPIC_API_KEY: sk-ant-...
      DATABASE_URL: postgresql://litellm:change_me@postgres:5432/litellm
    volumes: [ ./config.yaml:/app/config.yaml ]
    command: [ "--config", "/app/config.yaml" ]
  postgres:
    image: postgres:16
    restart: always
    environment:
      POSTGRES_USER: litellm
      POSTGRES_PASSWORD: change_me
      POSTGRES_DB: litellm
    volumes: [ ./pgdata:/var/lib/postgresql/data ]
EOF

docker compose up -d

도메인의 자동 HTTPS를 위해 앞에 Caddy 또는 Nginx를 두면 어떤 OpenAI SDK도 그대로 작동합니다:

curl https://llm.yourdomain.com/v1/chat/completions \
  -H "Authorization: Bearer sk-your-virtual-key" \
  -H "Content-Type: application/json" \
  -d '{"model":"claude","messages":[{"role":"user","content":"ping"}]}'

왜 이것이 에이전트에게 훌륭한가

AI 에이전트멀티에이전트 함대는 보통 많은 모델 호출을 합니다. LiteLLM 프록시 뒤에서 다음을 할 수 있습니다: 각 에이전트를 자체 가상 키와 예산으로 제한하고, 프런티어 모델에서 더 저렴한 모델로 자동 폴백하고, 로컬 Ollama를 클라우드 API와 섞고, 각 에이전트가 정확히 얼마를 썼는지 단일 로그로 읽습니다. 에이전트 코드를 건드리지 않고 모델을 바꾸세요 — 구성만 바꾸면 됩니다.

왜 LiteLLM 게이트웨이에 EQVPS인가

AI 에이전트용 VPS → · VPS에서 Ollama 셀프호스팅 →

FAQ

LiteLLM 프록시가 실제로 무엇을 주나요?

여러 제공자 앞에 놓이는 하나의 OpenAI 호환 엔드포인트입니다. 앱과 에이전트가 단일 URL과 모델 이름을 호출하면 LiteLLM이 OpenAI, Anthropic, Groq, Together, 로컬 Ollama 등으로 라우팅합니다. 키별 예산, 속도 제한, 폴백, 로그와 비용을 위한 단일 장소를 얻습니다 — 모델을 바꿔도 앱 코드를 바꾸지 않고.

어떤 요금제가 필요한가요?

LiteLLM 자체는 가볍습니다 — Small(월 $8, 4 GB RAM)이 프록시와 키/지출용 Postgres를 편안히 돌립니다. 추론 머신이 아니라 게이트웨이입니다: 무거운 연산은 제공자 쪽(또는 별도 GPU/호스트)에서 돌아갑니다. 도메인과 HTTPS를 위해 전용 IP 요금제를 선택하세요.

호스팅형 게이트웨이 대신 왜 셀프호스팅인가요?

제공자 키, 프롬프트, 지출 데이터, 로그가 제3자가 아니라 당신이 제어하는 머신에 남습니다. 예산은 당신이 정하고 모든 요청을 봅니다. 많은 호출을 분산하는 에이전트에게 그 가시성과 비용 통제가 바로 핵심입니다.

로컬 모델과도 작동하나요?

예. LiteLLM 모델 항목 중 하나를 로컬 Ollama(같은 VPS 또는 다른 머신)로 향하게 하면 클라우드 모델과 동일한 OpenAI 호환 API로 노출됩니다 — 앱은 하나의 엔드포인트 뒤에서 저렴한 로컬 모델과 프런티어 API를 섞을 수 있습니다.

신분증이나 카드를 요구하나요?

아니요. 이메일로 가입, USDC 또는 USDT로 결제. 서류 없음, 카드 없음, KYC 없음.

← 블로그로 돌아가기요금제와 가격 보기 →

댓글

아직 댓글이 없습니다. 첫 번째가 되세요.

댓글 남기기

댓글은 표시되기 전에 검토됩니다.