−25%

Windows 按年付费,截至 10 月 31 日。 查看套餐

EQVPS

VPS 需要多少内存?按用途给出的真实数字

2026年9月26日 · 2 分钟阅读 · EQVPS Team

大多数人选内存靠猜。要么“以防万一”买得太多,要么凌晨 3 点才认识 OOM killer。其实内存是最容易选型的资源之一,因为只要知道大致数字,各种负载都是可预测的。下面就是这些数字,从跑机器人的 1 GB 小机,一直到想在本地跑大模型的人会去找的 64 GB 服务器。

按用途的大致数字

这些是典型配置在稳定状态下的实测值,不是厂商给出的最低要求。

用途实际占用内存合适的套餐
Telegram/Discord 机器人(Python、Node.js)100–300 MBNano 1 GB
静态网站 + Caddy/Nginx50–150 MBNano 1 GB
WordPress + MariaDB,正常流量0.8–1.5 GBMicro-IP 2 GB
小型应用的 PostgreSQL0.5–2 GB(由你通过 shared_buffers 决定)Micro / Small
带几个工作流的 n8n0.5–1.5 GBMicro 2 GB
运行 5–10 个小服务的 Docker 主机2–4 GBSmall 4 GB
Coolify + 构建 + 一个数据库3–4 GBSmall-IP 4 GB
7–8B 大模型,4 位,CPU 推理5–6 GBMedium 6 GB
14B 大模型,4 位约 10 GBPro-32
32B 大模型,4 位约 20 GBPro-32
70B 大模型,4 位约 40–45 GBPro-48 / Pro-64

有两点值得注意。第一,“普通”负载和大模型之间的差距巨大:一个机器人和一个 70B 模型相差两百倍。第二,大多数服务在 1–4 GB 上就能跑得很好;人们之所以买多,是因为按一个很少到来的未来去选配置。

大模型的估算公式

语言模型有个简单的估算方法:参数量 × 每个权重的位数 ÷ 8,再加上额外开销。一个约 4.5 位(典型的 Q4 量化)的 8B 模型,权重为 8 × 4.5 ÷ 8 ≈ 4.5 GB。再加 1–2 GB 给上下文窗口(KV 缓存会随上下文长度增长)和运行时,就是 5–6 GB。

说句实话:在只有 CPU 的服务器上,内存只是问题的一半。几个 vCPU 跑 7–8B 模型大约每秒几个 token,70B 大约每秒一个 token。这对批处理任务、后台智能体和私人实验来说够用;但不是能供很多人同时聊天的体验。如果你主要调用托管的模型 API,智能体需要的资源会少得多:参见为 AI 智能体选择 VPS 配置。

别猜,去测

如果你已经有服务器,数字就摆在那里:

free -h                              # look at "available", not "free"
ps aux --sort=-rss | head -n 8       # the biggest processes, by resident memory
docker stats --no-stream             # per-container usage

Linux 会把空闲内存用作磁盘缓存,所以 “free” 总是很小,这很正常。真正重要的是 available:内核此刻能分给程序的内存。如果在最忙的时段 available 仍保持在约 25% 以上,说明配置合适。如果它经常降到零、swap 不断增长,就该升级了。

也检查一下过去是否发生过 OOM 杀进程:

journalctl -k | grep -i "out of memory"

swap 是安全带,不是发动机

在小服务器上配一个 1–2 GB 的 swap 文件 是一份便宜的保险:一次短暂需要更多内存的包更新或 Docker 构建能活下来,而不是被杀掉。但如果某个服务住在 swap 里,每个请求都要等磁盘。swap 是给峰值用的。持续使用 swap 说明你需要更高一档的套餐。

那么到底该买多少?

先选比直觉小一档的配置,观察 free -h 一周,数字说需要再升级。在 EQVPS 升级套餐会保留你的数据,只按比例收取差价(套餐变更如何运作)。

常见问题

一台基础 VPS 需要多少内存?

单个机器人、小型 API 或静态网站,1 GB 就够了,往往还有富余。一旦加上数据库或用 Docker 运行服务,2 GB 是比较舒适的默认值。低于 1 GB 时,现代包管理器和语言运行时就开始吃力了。

在 VPS 上跑大语言模型需要多少内存?

大致等于模型在该量化精度下的大小,再加一两 GB 用于上下文。4 位量化的 7–8B 模型约需 5–6 GB,14B 约 10 GB,32B 约 20 GB,70B 约 40–45 GB。这就是 64 GB 服务器存在的原因:放得下 70B 模型,还能给其他服务留出空间。

swap 能代替内存吗?

不能。swap 是应对短暂峰值的安全网:它能让一次构建或备份不被杀掉。如果某个服务整天都跑在 swap 上,一切都会变慢;那就是该升级套餐的信号。

怎么查看服务器实际用了多少内存?

运行 'free -h',看 'available' 这一列,而不是 'free':Linux 会把空闲内存用作磁盘缓存,需要时再归还。'ps aux --sort=-rss | head' 显示占用最多的进程,'docker stats --no-stream' 显示每个容器的用量。

什么时候 64 GB 的 VPS 才有意义?

当某个东西必须常驻内存时:32–70B 的本地模型、用于 RAG 的大型向量索引,或者一批各自带运行时的智能体。对网站、机器人和大多数 API 来说,这纯属浪费钱。

← 返回博客查看套餐与价格 →

评论

暂无评论。来做第一个吧。

发表评论

评论在显示前会经过审核。