Nếu bạn chạy nhiều hơn một ứng dụng — hoặc một agent bung ra nhiều mô hình — bạn cuối cùng đâm vào cùng bức tường: mỗi nhà cung cấp có SDK riêng, các khóa riêng, các giới hạn tần suất riêng, và không nơi duy nhất để thấy chi tiêu. LiteLLM sửa điều đó bằng cách đặt một endpoint tương thích OpenAI ở phía trước mọi thứ. Mã của bạn gọi một URL với một tên mô hình; LiteLLM định tuyến nó tới OpenAI, Anthropic, Groq, Together, Mistral, một Ollama cục bộ — bất cứ gì bạn cấu hình — và cho bạn các ngân sách, dự phòng, và một log của mọi cuộc gọi.
Tự host nó trên một VPS nghĩa là các khóa nhà cung cấp, prompt và dữ liệu chi tiêu của bạn sống trên một cỗ máy bạn kiểm soát, thanh toán bằng crypto không KYC.
Một proxy LiteLLM cần gì
- Không nhiều tính toán — nó là một gateway. Việc nặng diễn ra ở các nhà cung cấp; LiteLLM chỉ định tuyến. Small ($8/tháng — 4 vCPU, 4 GB RAM) chạy thoải mái proxy cộng một Postgres cho các khóa ảo và theo dõi chi tiêu.
- Một IP riêng, một tên miền và HTTPS. Các ứng dụng và agent của bạn kết nối đến, nên bạn muốn một gói IPv4 riêng, một tên miền và TLS. Các gói NAT không nhận lưu lượng web đến.
- Đi ra tới các nhà cung cấp. Cỗ máy cần HTTPS đi ra bình thường để tới các API mô hình — mọi gói đều có điều đó.
Thiết lập Docker (Ubuntu 24.04)
# gói IP riêng, root shell
apt update && apt install -y docker.io docker-compose-v2
systemctl enable --now docker
mkdir -p /opt/litellm && cd /opt/litellm
cat > config.yaml <<'EOF'
model_list:
- model_name: gpt-4o
litellm_params:
model: openai/gpt-4o
api_key: os.environ/OPENAI_API_KEY
- model_name: claude
litellm_params:
model: anthropic/claude-sonnet-4-5
api_key: os.environ/ANTHROPIC_API_KEY
- model_name: local-llama
litellm_params:
model: ollama/llama3.1
api_base: http://host.docker.internal:11434
general_settings:
master_key: sk-CHANGE-ME # khóa admin; phát các khóa ảo theo-ứng-dụng thay vào đó
EOF
cat > docker-compose.yml <<'EOF'
services:
litellm:
image: ghcr.io/berriai/litellm:main-latest
restart: always
ports: [ "127.0.0.1:4000:4000" ]
environment:
OPENAI_API_KEY: sk-... # các khóa nhà cung cấp của bạn
ANTHROPIC_API_KEY: sk-ant-...
DATABASE_URL: postgresql://litellm:change_me@postgres:5432/litellm
volumes: [ ./config.yaml:/app/config.yaml ]
command: [ "--config", "/app/config.yaml" ]
postgres:
image: postgres:16
restart: always
environment:
POSTGRES_USER: litellm
POSTGRES_PASSWORD: change_me
POSTGRES_DB: litellm
volumes: [ ./pgdata:/var/lib/postgresql/data ]
EOF
docker compose up -d
Đặt Caddy hoặc Nginx ở phía trước cho HTTPS tự động trên tên miền của bạn, rồi bất kỳ OpenAI SDK nào cứ hoạt động:
curl https://llm.yourdomain.com/v1/chat/completions \
-H "Authorization: Bearer sk-your-virtual-key" \
-H "Content-Type: application/json" \
-d '{"model":"claude","messages":[{"role":"user","content":"ping"}]}'
Vì sao điều này tuyệt cho agent
Một AI agent hoặc một đội đa agent thường tạo nhiều cuộc gọi mô hình. Sau một proxy LiteLLM bạn có thể: giới hạn mỗi agent với khóa ảo và ngân sách riêng của nó, dự phòng từ một mô hình tiền tuyến sang một cái rẻ hơn tự động, trộn một Ollama cục bộ với các API cloud, và đọc một log của chính xác cái mỗi agent chi. Đổi mô hình mà không chạm mã agent — chỉ đổi cấu hình.
Vì sao EQVPS cho một gateway LiteLLM
- IPv4 riêng từ $8/tháng, thân thiện tên miền + HTTPS, mọi cổng, rDNS tự phục vụ.
- Các vị trí EU (Đức, Phần Lan) — các tuyến sạch, luật bảo vệ dữ liệu thực; các khóa và log của bạn ở lại trong EU.
- Không KYC, thanh toán crypto. Email để đăng ký, USDC/USDT để thanh toán.
- Root trong ~60 giây. Các image Ubuntu/Debian sạch;
docker compose upvà gateway của bạn hoạt động.
Bình luận
Chưa có bình luận nào. Hãy là người đầu tiên.