−25%

за Windows при годишно плащане, до 31.10. Към плановете

EQVPS

Колко RAM трябва на един VPS? Реални числа по натоварване

26.09.2026 г. · 3 мин четене · EQVPS Team

Повечето хора гадаят RAM-а. Или купуват много повече «за всеки случай», или се запознават с OOM killer в 3 през нощта. Паметта всъщност е от най-лесните неща за оразмеряване, защото натоварванията са предвидими, щом знаеш грубите числа. Ето ги, от сървър с 1 GB за бот до сървърите с 64 GB, които хората търсят, когато искат да пуснат голям модел локално.

Груби числа по натоварване

Това са реални стойности в стабилно състояние за типична настройка, не минимумите на производителите.

НатоварванеРеално ползвана RAMПодходящ план
Бот за Telegram/Discord (Python, Node.js)100–300 MBNano 1 GB
Статичен сайт + Caddy/Nginx50–150 MBNano 1 GB
WordPress + MariaDB, нормален трафик0.8–1.5 GBMicro-IP 2 GB
PostgreSQL за малко приложение0.5–2 GB (решаваш чрез shared_buffers)Micro / Small
n8n с няколко workflow-а0.5–1.5 GBMicro 2 GB
Docker хост с 5–10 малки услуги2–4 GBSmall 4 GB
Coolify + билдове + база данни3–4 GBSmall-IP 4 GB
LLM 7–8B, 4-bit, inference на CPU5–6 GBMedium 6 GB
LLM 14B, 4-bit~10 GBPro-32
LLM 32B, 4-bit~20 GBPro-32
LLM 70B, 4-bit~40–45 GBPro-48 / Pro-64

Две неща да забележиш. Първо, скокът между «нормалните» натоварвания и LLM е огромен: бот и модел 70B се различават двеста пъти. Второ, повечето услуги се чувстват добре на 1–4 GB; хората купуват повече, защото оразмеряват за бъдеще, което рядко идва.

Формулата за LLM

За езиковите модели има проста оценка: параметри × битове на тегло ÷ 8, плюс допълнителни разходи. Модел 8B при около 4.5 бита (типична Q4 квантизация) е 8 × 4.5 ÷ 8 ≈ 4.5 GB тегла. Добави 1–2 GB за прозореца на контекста (KV cache расте с дължината на контекста) и runtime-а и стигаш до 5–6 GB.

Честната част: на сървъри само с CPU паметта е само половината история. Очаквай едноцифрен брой токени в секунда за модели 7–8B на няколко vCPU и около токен в секунда за 70B. Това е добре за пакетни задачи, фонови агенти и лични експерименти; не е чат изживяване за много едновременни потребители. Ако основно викаш APIs на хоствани модели, агентът ти иска много по-малко; виж размер на VPS за AI агенти.

Измервай вместо да гадаеш

Ако вече имаш сървър, числата са там:

free -h                              # look at "available", not "free"
ps aux --sort=-rss | head -n 8       # the biggest processes, by resident memory
docker stats --no-stream             # per-container usage

Linux ползва неизползваната RAM като кеш за диска, така че «free» винаги е малко и това е здравословно. Available е числото, което има значение: паметта, която ядрото може да даде на програмите в момента. Ако available остава над ~25% в най-натоварения ти час, размерът е правилен. Ако редовно стига нула и swap-ът расте, мини по-нагоре.

Провери и за минали OOM убийства:

journalctl -k | grep -i "out of memory"

Swap: предпазен колан, не двигател

Swap файл от 1–2 GB на малък сървър е евтина застраховка: обновяване на пакет или Docker билд, на който за миг трябва повече памет, оцелява вместо да бъде убит. Но ако услуга живее в swap, всяка заявка чака диска. Swap-ът е за пикове. Постоянното swap-ване значи, че ти трябва следващият план.

Та колко да купиш?

Започни с един размер по-малко, отколкото ти казва инстинктът, гледай free -h една седмица и надгради, ако числата го кажат. В EQVPS надграждането на плана пази данните ти и таксува само пропорционалната разлика (как работят смените на план).

Въпроси

Колко RAM трябва на базов VPS?

За един бот, малко API или статичен сайт 1 GB стига, често с резерв. 2 GB са удобният стандарт, щом добавиш база данни или пуснеш неща в Docker. Под 1 GB съвременните мениджъри на пакети и runtime-ите на езиците започват да страдат.

Колко RAM ми трябва, за да пусна LLM на VPS?

Грубо размерът на модела при неговата квантизация плюс гигабайт-два за контекста. Модел 7–8B на 4-bit иска около 5–6 GB, 14B около 10 GB, 32B около 20 GB, а 70B около 40–45 GB. Затова съществуват сървъри с 64 GB: побират модел 70B с място за останалия ти стек.

Заместител ли е swap-ът на RAM?

Не. Swap-ът е предпазна мрежа за кратки пикове: пази билд или бекъп да не бъдат убити. Ако натоварване живее в swap цял ден, всичко става бавно; това е сигналът да минеш на по-голям план.

Как да видя колко RAM реално ползва сървърът ми?

Пусни 'free -h' и гледай колоната 'available', не 'free': Linux ползва свободната памет като кеш за диска и я връща при нужда. 'ps aux --sort=-rss | head' показва най-големите процеси, а 'docker stats --no-stream' потреблението по контейнери.

Кога има смисъл VPS с 64 GB?

Когато едно-единствено нещо трябва да стои в паметта: локален модел 32–70B, голям векторен индекс за RAG или флот от агенти със собствени runtime-и. За сайтове, ботове и повечето APIs това са хвърлени пари.

← Обратно към блогаВиж планове и цени →

Коментари

Още няма коментари. Бъди първият.

Остави коментар

Коментарите се модерират преди да се появят.