−25%

kwa Windows ya mwaka, hadi 31 Okt. Tazama mipango

EQVPS
Anza

VPS inahitaji RAM kiasi gani? Takwimu halisi kwa kila kazi

Sep 26, 2026 · 4 dakika za kusoma · EQVPS Team

Watu wengi wanakisia RAM. Aidha wananunua nyingi mno «ikiwa tu» au wanakutana na OOM killer saa 9 usiku. Kumbukumbu kwa kweli ni moja ya vitu rahisi zaidi kupima ukubwa, kwa sababu kazi zinatabirika mara unapojua takwimu za makadirio. Hizi hapa, kutoka seva ya bot ya 1 GB hadi seva za 64 GB ambazo watu wanazitafuta wanapotaka kuendesha modeli kubwa ndani.

Takwimu za makadirio kwa kila kazi

Hizi ni takwimu halisi za hali thabiti kwa usanidi wa kawaida, si viwango vya chini vya watengenezaji.

KaziRAM inayotumika kweliMpango unaofaa
Bot ya Telegram/Discord (Python, Node.js)100–300 MBNano 1 GB
Tovuti tuli + Caddy/Nginx50–150 MBNano 1 GB
WordPress + MariaDB, trafiki ya kawaida0.8–1.5 GBMicro-IP 2 GB
PostgreSQL kwa programu ndogo0.5–2 GB (unaamua kupitia shared_buffers)Micro / Small
n8n yenye workflows chache0.5–1.5 GBMicro 2 GB
Host ya Docker yenye huduma ndogo 5–102–4 GBSmall 4 GB
Coolify + builds + hifadhidata3–4 GBSmall-IP 4 GB
LLM ya 7–8B, 4-bit, inference kwenye CPU5–6 GBMedium 6 GB
LLM ya 14B, 4-bit~10 GBPro-32
LLM ya 32B, 4-bit~20 GBPro-32
LLM ya 70B, 4-bit~40–45 GBPro-48 / Pro-64

Mambo mawili ya kuzingatia. Kwanza, pengo kati ya kazi «za kawaida» na LLMs ni kubwa: bot na modeli ya 70B zinatofautiana mara mia mbili. Pili, huduma nyingi ziko sawa kwenye 1–4 GB; watu wananunua zaidi kwa sababu wanapima kwa ajili ya siku zijazo ambazo mara chache zinafika.

Fomula ya LLM

Kwa modeli za lugha kuna makadirio rahisi: vigezo × biti kwa kila uzito ÷ 8, pamoja na mzigo wa ziada. Modeli ya 8B kwa takriban biti 4.5 (quantization ya kawaida ya Q4) ni 8 × 4.5 ÷ 8 ≈ 4.5 GB za uzito. Ongeza 1–2 GB kwa dirisha la context (KV cache inakua kulingana na urefu wa context) na runtime, na unafika 5–6 GB.

Sehemu ya uwazi: kwenye seva za CPU pekee, kumbukumbu ni nusu tu ya hadithi. Tarajia tokens za tarakimu moja kwa sekunde kwa modeli za 7–8B kwenye vCPU chache na takriban token moja kwa sekunde kwa 70B. Hilo ni sawa kwa kazi za kundi, agents wa nyuma na majaribio binafsi; si uzoefu wa chat kwa watumiaji wengi kwa wakati mmoja. Ikiwa mara nyingi unaita APIs za modeli zinazopangishwa, agent wako anahitaji kidogo sana; angalia ukubwa wa VPS kwa AI agents.

Pima badala ya kukisia

Ikiwa tayari una seva, takwimu ziko hapo:

free -h                              # look at "available", not "free"
ps aux --sort=-rss | head -n 8       # the biggest processes, by resident memory
docker stats --no-stream             # per-container usage

Linux inatumia RAM isiyotumika kama cache ya disk, kwa hivyo «free» daima ni ndogo na hiyo ni afya. Available ndiyo takwimu muhimu: kumbukumbu ambayo kernel inaweza kuwapa programu sasa hivi. Ikiwa available inabaki juu ya ~25% wakati wa saa yako yenye shughuli nyingi zaidi, ukubwa ni sahihi. Ikifika sifuri mara kwa mara na swap ikikua, panda mpango.

Angalia pia mauaji ya OOM ya zamani:

journalctl -k | grep -i "out of memory"

Swap: mkanda wa usalama, si injini

Faili ya swap ya 1–2 GB kwenye seva ndogo ni bima ya bei nafuu: sasisho la kifurushi au build ya Docker inayohitaji kumbukumbu zaidi kwa muda mfupi inasalimika badala ya kuuawa. Lakini huduma ikiishi kwenye swap, kila ombi linasubiri disk. Swap ni kwa ongezeko la ghafla. Swapping ya kudumu inamaanisha unahitaji mpango unaofuata.

Kwa hivyo ununue kiasi gani?

Anza na ukubwa mmoja chini ya unaohisi, tazama free -h kwa wiki moja, na panda ikiwa takwimu zinasema hivyo. Kwenye EQVPS kupandisha mpango kunahifadhi data yako na kunatoza tofauti ya uwiano tu (jinsi mabadiliko ya mpango yanavyofanya kazi).

Maswali

VPS ya msingi inahitaji RAM kiasi gani?

Kwa bot moja, API ndogo au tovuti tuli, 1 GB inatosha, mara nyingi ikiwa na nafasi ya ziada. 2 GB ndio chaguo-msingi la starehe mara tu unapoongeza hifadhidata au kuendesha vitu kwenye Docker. Chini ya 1 GB, wasimamizi wa vifurushi na runtimes za lugha za kisasa zinaanza kuteseka.

Nahitaji RAM kiasi gani kuendesha LLM kwenye VPS?

Takriban ukubwa wa modeli katika quantization yake, pamoja na gigabaiti moja au mbili kwa context. Modeli ya 7–8B kwa 4-bit inahitaji takriban 5–6 GB, 14B takriban 10 GB, 32B takriban 20 GB na 70B takriban 40–45 GB. Ndiyo sababu seva za 64 GB zipo: zinatosheleza modeli ya 70B pamoja na nafasi kwa stack yako iliyobaki.

Je swap ni mbadala wa RAM?

Hapana. Swap ni wavu wa usalama kwa ongezeko fupi: inazuia build au nakala ya akiba isiuawe. Kazi ikiishi kwenye swap siku nzima, kila kitu kinakuwa polepole; hiyo ndiyo ishara ya kupanda mpango.

Naonaje seva yangu inatumia RAM kiasi gani kweli?

Endesha 'free -h' na uangalie safu ya 'available', si 'free': Linux inatumia kumbukumbu ya ziada kama cache ya disk na kuirudisha inapohitajika. 'ps aux --sort=-rss | head' inaonyesha michakato mikubwa zaidi, na 'docker stats --no-stream' inaonyesha matumizi ya kila container.

VPS ya 64 GB inaleta maana lini?

Wakati kitu kimoja kinahitaji kukaa kwenye kumbukumbu: modeli ya ndani ya 32–70B, faharasa kubwa ya vekta kwa RAG, au kundi la agents wenye runtimes zao. Kwa tovuti, bots na APIs nyingi ni upotevu wa pesa.

← Rudi kwenye bloguAngalia mipango na bei →

Maoni

Bado hakuna maoni. Kuwa wa kwanza.

Acha maoni

Maoni yanakaguliwa kabla ya kuonekana.