在代理托管上我最常见到的错误,是照错东西来配置。有人跑一个代理,它用了 400 MB,于是他断定代理托管很便宜。然后他扩到一支真正的机队,机器在凌晨三点开始 swap。
一个代理确实便宜。那不是有意思的情况。
内存到底去哪儿了
一个只往模型发 API 调用的代理很轻——它大多在等网络。你能在一个小套餐上跑十来个而毫无察觉。
RAM 消失在代理开始持有状态的时候。每一轮都在增长的对话历史。几个代理读写的一份工作集。一个坐在同一进程里、用作长期记忆的向量库。当你的架构从“调 API、忘掉”变成“记住、协调、交接”的那一刻,内存就成了约束,而不是 CPU。
CrewAI、LangGraph、AutoGPT 式的循环——它们一认真起来都朝这个方向走。吃掉 RAM 的不是框架;是状态。
大致配置,说实话
我不会假装有个公式,因为没有——它完全取决于每个代理留多少东西在身边。但从跑这些得来的实用感觉:
- 轻量、绑 API 的代理 —— 这里你根本不需要 Pro;一个 NAT 或独立IP套餐($3–20)就能应付。等共享状态把你推过约 32 GB 时,Pro 才配得上它的位置。
- 32 GB —— 一个真正多代理系统的甜点:5–10 个带共享记忆的代理,加一个真正有用的向量数据库。大多数人落在这里。
- 64 GB —— 更大的机队、更长的历史、一个数以百万计向量的记忆索引,或几个服务同机共处。这是一台机器替下你本来要来回折腾的那三台小的地方。
- 80 GB —— 重的、绑内存的活:大的内存内数据集、许多并发代理,或代理加同机上的本地模型推理。
从你以为需要的水平往下起步。盯 htop 看一天。看到 swap 再往上扩,别提前——往高了猜只是浪费钱。
难买的那部分
让这事变尴尬的是:租 64 GB 的 RAM 很容易。用加密货币、不做身份核验地租 64 GB,就不容易了。大多数便宜卖大内存的主机,都把它放在一张卡和一张 KYC 表单后面。
如果你的代理自己开通服务器,或负载碰到你不太想跟名字挂钩的数据,那么那个组合——大内存、加密货币、无需 KYC、且能被代理自己通过 MCP 下单——才是真正的产品。它不是每 GB 更便宜,我另外写过为什么那种对比会误导人。它是以几乎没人提供的条件卖的。
那你该怎么办
如果你的代理很轻、绑着 API,别想太多——一个小的 NAT 或独立IP套餐就够了,整个大内存问题跳过。如果你在跑一支持有状态的真机队,按内存里实际有多少来配置,从 32 GB 起步,等曲线让你升时再升。
到那时,Pro 系列覆盖 32 到 80 GB,带独立IP 和每夜备份。挑跟你工作集匹配的那一档,而不是跟你雄心匹配的那一档。
评论
暂无评论。来做第一个吧。