EQVPS

在 VPS 上自托管 LiteLLM 代理:一个 OpenAI 兼容端点接入所有模型

2026年9月2日 · 1 分钟阅读 · EQVPS Team

如果你运行不止一个应用——或一个分发到多个模型的 agent——你迟早会撞上同一堵墙:每个提供商都有自己的 SDK、密钥、限速,且没有统一的地方查看花费。LiteLLM 通过在一切之前放置一个 OpenAI 兼容 端点解决了这个问题。你的代码用一个模型名调用一个 URL;LiteLLM 将其路由到 OpenAI、Anthropic、Groq、Together、Mistral、本地 Ollama——你所配置的任何一个——并提供预算、回退,以及每次调用的统一日志。

在 VPS 上自托管意味着你的提供商密钥、提示词和花费数据都存在掌控的机器上,用加密货币付款、无需 KYC。

LiteLLM 代理需要什么

Docker 设置(Ubuntu 24.04)

# 专用 IP 套餐,root shell
apt update && apt install -y docker.io docker-compose-v2
systemctl enable --now docker

mkdir -p /opt/litellm && cd /opt/litellm
cat > config.yaml <<'EOF'
model_list:
  - model_name: gpt-4o
    litellm_params:
      model: openai/gpt-4o
      api_key: os.environ/OPENAI_API_KEY
  - model_name: claude
    litellm_params:
      model: anthropic/claude-sonnet-4-5
      api_key: os.environ/ANTHROPIC_API_KEY
  - model_name: local-llama
    litellm_params:
      model: ollama/llama3.1
      api_base: http://host.docker.internal:11434
general_settings:
  master_key: sk-CHANGE-ME          # 管理密钥;请改为按应用签发虚拟密钥
EOF

cat > docker-compose.yml <<'EOF'
services:
  litellm:
    image: ghcr.io/berriai/litellm:main-latest
    restart: always
    ports: [ "127.0.0.1:4000:4000" ]
    environment:
      OPENAI_API_KEY: sk-...            # 你的提供商密钥
      ANTHROPIC_API_KEY: sk-ant-...
      DATABASE_URL: postgresql://litellm:change_me@postgres:5432/litellm
    volumes: [ ./config.yaml:/app/config.yaml ]
    command: [ "--config", "/app/config.yaml" ]
  postgres:
    image: postgres:16
    restart: always
    environment:
      POSTGRES_USER: litellm
      POSTGRES_PASSWORD: change_me
      POSTGRES_DB: litellm
    volumes: [ ./pgdata:/var/lib/postgresql/data ]
EOF

docker compose up -d

在前面放上 Caddy 或 Nginx 为你的域名提供自动 HTTPS,然后任何 OpenAI SDK 都能直接工作:

curl https://llm.yourdomain.com/v1/chat/completions \
  -H "Authorization: Bearer sk-your-virtual-key" \
  -H "Content-Type: application/json" \
  -d '{"model":"claude","messages":[{"role":"user","content":"ping"}]}'

为什么这对 agent 很棒

一个 AI agent多 agent 舰队通常会做大量模型调用。在 LiteLLM 代理之后,你可以:用各自的虚拟密钥和预算限制每个 agent,自动从前沿模型回退到更便宜的模型,把本地 Ollama 与云端 API 混用,并阅读每个 agent 确切花费的统一日志。切换模型无需触碰 agent 代码——只改配置。

为什么选择 EQVPS 做 LiteLLM 网关

面向 AI agent 的 VPS → · 在 VPS 上自托管 Ollama →

常见问题

LiteLLM 代理到底给我什么?

一个位于众多提供商之前的 OpenAI 兼容端点。你的应用和 agent 调用单一 URL 和模型名;LiteLLM 路由到 OpenAI、Anthropic、Groq、Together、本地 Ollama 等。你获得按密钥的预算、限速、回退,以及日志与成本的统一位置——切换模型无需改动应用代码。

需要哪个套餐?

LiteLLM 本身很轻——Small(每月 $8,4 GB RAM)足以运行代理外加用于密钥/花费的 Postgres。它是网关而非推理机:繁重计算在提供商那边(或独立 GPU/主机)。选专用 IP 套餐,以便在前面加域名和 HTTPS。

为什么自托管而不用托管网关?

你的提供商密钥、提示词、花费数据和日志留在你掌控的机器上,而非第三方。预算由你设定,每个请求你都能看到。对于大量分发调用的 agent,这种可见性和成本控制正是关键。

也能用本地模型吗?

能。把一个 LiteLLM 模型条目指向本地 Ollama(同一 VPS 或另一台机器),它便通过与云端模型相同的 OpenAI 兼容 API 暴露出来——应用可在一个端点后面混用便宜的本地模型和前沿 API。

你们会索要身份证明或银行卡吗?

不会。用邮箱注册,用 USDC 或 USDT 付款。无需文件、无需卡片、无需 KYC。

← 返回博客查看套餐与价格 →

评论

暂无评论。来做第一个吧。

发表评论

评论在显示前会经过审核。