አብዛኞቹ ሰዎች RAMን ይገምታሉ። ወይ «ለማንኛውም» በጣም ብዙ ይገዛሉ ወይም ከሌሊቱ 9 ሰዓት ከOOM killer ጋር ይተዋወቃሉ። ማህደረ ትውስታ በእውነቱ መጠኑን ለመወሰን በጣም ቀላል ከሆኑ ነገሮች አንዱ ነው፣ ምክንያቱም ግምታዊ ቁጥሮችን ካወቁ ስራዎች ሊተነበዩ ይችላሉ። እነሆ፣ ከ1 GB የbot server እስከ ሰዎች ትልቅ ሞዴልን በአካባቢያቸው ለማሄድ ሲፈልጉ የሚፈልጓቸው 64 GB servers ድረስ።
በስራ ዓይነት ግምታዊ ቁጥሮች
እነዚህ የአምራቾች ዝቅተኛዎች ሳይሆኑ የተለመደ ማዋቀር እውነተኛ የተረጋጋ አሃዞች ናቸው።
| ስራ | በእውነት የሚጠቀመው RAM | የሚስማማው ዕቅድ |
|---|---|---|
| Telegram/Discord bot (Python፣ Node.js) | 100–300 MB | Nano 1 GB |
| Static site + Caddy/Nginx | 50–150 MB | Nano 1 GB |
| WordPress + MariaDB፣ መደበኛ ትራፊክ | 0.8–1.5 GB | Micro-IP 2 GB |
| ለትንሽ app PostgreSQL | 0.5–2 GB (በshared_buffers እርስዎ ይወስናሉ) | Micro / Small |
| n8n ከጥቂት workflows ጋር | 0.5–1.5 GB | Micro 2 GB |
| Docker host ከ5–10 ትናንሽ አገልግሎቶች ጋር | 2–4 GB | Small 4 GB |
| Coolify + builds + database | 3–4 GB | Small-IP 4 GB |
| 7–8B LLM፣ 4-bit፣ በCPU inference | 5–6 GB | Medium 6 GB |
| 14B LLM፣ 4-bit | ~10 GB | Pro-32 |
| 32B LLM፣ 4-bit | ~20 GB | Pro-32 |
| 70B LLM፣ 4-bit | ~40–45 GB | Pro-48 / Pro-64 |
ሁለት ነገሮችን ልብ ይበሉ። በመጀመሪያ፣ በ«መደበኛ» ስራዎች እና በLLMs መካከል ያለው ዝላይ ግዙፍ ነው፦ bot እና 70B ሞዴል በሁለት መቶ እጥፍ ይለያያሉ። ሁለተኛ፣ አብዛኞቹ አገልግሎቶች በ1–4 GB ጥሩ ናቸው፤ ሰዎች ከመጠን በላይ የሚገዙት እምብዛም ለማይመጣ የወደፊት ጊዜ መጠን ስለሚወስኑ ነው።
የLLM ቀመር
ለቋንቋ ሞዴሎች ቀላል ግምት አለ፦ parameters × bits per weight ÷ 8፣ ሲደመር ተጨማሪ ጭነት። በግምት 4.5 bits (የተለመደ Q4 quantization) ያለ 8B ሞዴል 8 × 4.5 ÷ 8 ≈ 4.5 GB weights ነው። ለcontext መስኮቱ (KV cache ከcontext ርዝመት ጋር ያድጋል) እና ለruntime 1–2 GB ያክሉ፣ ወደ 5–6 GB ይደርሳሉ።
ሐቀኛው ክፍል፦ CPU ብቻ ባላቸው servers ላይ ማህደረ ትውስታ የታሪኩ ግማሽ ብቻ ነው። በጥቂት vCPUs ላይ ለ7–8B ሞዴሎች በሰከንድ ባለአንድ አሃዝ tokens፣ ለ70B ደግሞ በሰከንድ አንድ token ያህል ይጠብቁ። ይህ ለbatch ስራዎች፣ ለጀርባ agents እና ለግል ሙከራዎች ጥሩ ነው፤ ለብዙ በአንድ ጊዜ ተጠቃሚዎች የchat ተሞክሮ አይደለም። በአብዛኛው የሚስተናገዱ የሞዴል APIsን የሚጠሩ ከሆነ agentዎ በጣም ያነሰ ያስፈልገዋል፤ ለAI agents የVPS መጠንን ይመልከቱ።
ከመገመት ይልቅ ይለኩ
አስቀድመው server ካለዎት ቁጥሮቹ እዚያው አሉ፦
free -h # look at "available", not "free"
ps aux --sort=-rss | head -n 8 # the biggest processes, by resident memory
docker stats --no-stream # per-container usage
Linux ስራ ፈት RAMን እንደ disk cache ይጠቀማል፣ ስለዚህ «free» ሁልጊዜ ትንሽ ነው፣ ይህም ጤናማ ነው። Available አስፈላጊው ቁጥር ነው፦ kernelኡ አሁን ለፕሮግራሞች መስጠት የሚችለው ማህደረ ትውስታ። በጣም በሚበዛበት ሰዓትዎ available ከ~25% በላይ ከቆየ መጠኑ ትክክል ነው። በመደበኛነት ዜሮ ከደረሰ እና swap ካደገ ያሳድጉ።
ያለፉ የOOM ግድያዎችንም ይፈትሹ፦
journalctl -k | grep -i "out of memory"
Swap፦ የደህንነት ቀበቶ እንጂ ሞተር አይደለም
በትንሽ server ላይ 1–2 GB swap ፋይል ርካሽ ዋስትና ነው፦ ለቅጽበት ተጨማሪ ማህደረ ትውስታ የሚፈልግ የpackage ማሻሻያ ወይም Docker build ከመገደል ይልቅ ይተርፋል። ነገር ግን አንድ አገልግሎት በswap ውስጥ ከኖረ እያንዳንዱ ጥያቄ diskን ይጠብቃል። Swap ለመጨመሮች ነው። የማያቋርጥ swapping ማለት ቀጣዩ ዕቅድ ያስፈልግዎታል ማለት ነው።
ታዲያ ምን ያህል ይግዙ?
- 1 GB፦ አንድ bot፣ አንድ ትንሽ API፣ static site።
- 2 GB፦ database ወይም Docker ላለው ለማንኛውም ነገር ምክንያታዊ ነባሪ።
- 4–6 GB፦ በአንድ ማሽን ላይ በርካታ አገልግሎቶች፣ በserverሩ ላይ builds፣ ትንሽ አካባቢያዊ ሞዴል።
- 32–64 GB፦ አንድ ትልቅ ነገር በማህደረ ትውስታ ውስጥ መኖር ሲኖርበት ብቻ፦ ከ14B በላይ አካባቢያዊ ሞዴል፣ ትልቅ የRAG index፣ የagents ስብስብ። ከፍተኛ ማህደረ ትውስታ ያላቸው ዕቅዶች ለዚህ ናቸው።
ስሜትዎ ከሚለው አንድ መጠን ያነሰ ይጀምሩ፣ ለአንድ ሳምንት free -hን ይከታተሉ፣ ቁጥሮቹ ካሉ ያሳድጉ። በEQVPS የዕቅድ ማሻሻያ ውሂብዎን ይጠብቃል እና የሚያስከፍለው ተመጣጣኝ ልዩነቱን ብቻ ነው (የዕቅድ ለውጥ እንዴት እንደሚሰራ)።
አስተያየቶች
እስካሁን አስተያየቶች የሉም። መጀመሪያ ይሁኑ።