ډیری خلک RAM اټکل کوي. یا «د احتیاط لپاره» ډیر زیات اخلي یا د شپې په ۳ بجو له OOM killer سره آشنا کیږي. حافظه په حقیقت کې د اندازه کولو تر ټولو اسانه شیانو څخه ده، ځکه کله چې تقریبي شمیرې پیژنئ، کارونه د وړاندوینې وړ دي. دا دي شمیرې، د بوټ لپاره له ۱ GB سرور څخه تر ۶۴ GB سرورونو پورې چې خلک یې د لوی ماډل د محلي چلولو لپاره لټوي.
د کار له مخې تقریبي شمیرې
دا د یوه عادي تنظیم ریښتیني ثابتې شمیرې دي، نه د جوړونکو لږ تر لږه.
| کار | اصلي RAM مصرف | مناسب پلان |
|---|---|---|
| Telegram/Discord بوټ (Python، Node.js) | ۱۰۰ تر ۳۰۰ MB | Nano ۱ GB |
| ثابت سایټ + Caddy/Nginx | ۵۰ تر ۱۵۰ MB | Nano ۱ GB |
| WordPress + MariaDB، عادي ترافیک | ۰.۸ تر ۱.۵ GB | Micro-IP ۲ GB |
| د کوچني اپ لپاره PostgreSQL | ۰.۵ تر ۲ GB (تاسو یې د shared_buffers له لارې ټاکئ) | Micro / Small |
| n8n د څو کاري بهیرونو سره | ۰.۵ تر ۱.۵ GB | Micro ۲ GB |
| Docker کوربه د ۵ تر ۱۰ کوچنیو خدمتونو سره | ۲ تر ۴ GB | Small ۴ GB |
| Coolify + بلډونه + ډیټابیس | ۳ تر ۴ GB | Small-IP ۴ GB |
| 7–8B LLM، 4-bit، په CPU استنتاج | ۵ تر ۶ GB | Medium ۶ GB |
| 14B LLM، 4-bit | ~۱۰ GB | Pro-32 |
| 32B LLM، 4-bit | ~۲۰ GB | Pro-32 |
| 70B LLM، 4-bit | ~۴۰ تر ۴۵ GB | Pro-48 / Pro-64 |
دوو شیانو ته پام وکړئ. لومړی، د «عادي» کارونو او LLMونو ترمنځ ټوپ ډیر لوی دی: یو بوټ او 70B ماډل دوه سوه ځله توپیر لري. دوهم، ډیری خدمتونه په ۱ تر ۴ GB ښه چلیږي؛ خلک ډیر اخلي ځکه د داسې راتلونکي لپاره اندازه کوي چې لږ راځي.
د LLM فورمول
د ژبې ماډلونو لپاره یو ساده اټکل شته: پیرامیټرونه × د هر وزن بټونه ÷ ۸، جمع اضافي بار. یو 8B ماډل په شاوخوا ۴.۵ بټ (یو عادي Q4 کوانټیزیشن) کیږي ۸ × ۴.۵ ÷ ۸ ≈ ۴.۵ GB وزنونه. د context کړکۍ (KV cache د context له اوږدوالي سره لویږي) او رنټایم لپاره ۱ تر ۲ GB زیات کړئ، ۵ تر ۶ GB ته رسیږئ.
صادقانه برخه: یوازې په CPU سرورونو کې حافظه نیمه کیسه ده. په څو vCPU د 7–8B ماډلونو لپاره په ثانیه کې یو عددي شمیر ټوکنونه، او د 70B لپاره شاوخوا یو ټوکن په ثانیه کې تمه ولرئ. دا د بیچ کارونو، د شالید agents او شخصي تجربو لپاره ښه دی؛ د ډیرو همزمانو کاروونکو لپاره د چټ تجربه نه ده. که تاسو اکثراً د کوربه شوو ماډلونو APIs بلئ، ستاسو agent ډیر لږ ته اړتیا لري؛ د AI agents لپاره د VPS اندازه وګورئ.
د اټکل پر ځای اندازه کړئ
که دمخه سرور لرئ، شمیرې همدلته دي:
free -h # look at "available", not "free"
ps aux --sort=-rss | head -n 8 # the biggest processes, by resident memory
docker stats --no-stream # per-container usage
Linux بیکاره RAM د ډیسک کیش په توګه کاروي، نو «free» تل کوچنی وي او دا روغ دی. Available هغه شمیره ده چې مهمه ده: هغه حافظه چې کرنل یې همدا اوس پروګرامونو ته ورکولی شي. که ستاسو په تر ټولو بوخت ساعت کې available له ~۲۵٪ پورته پاتې شي، اندازه سمه ده. که په منظم ډول صفر ته ورسیږي او swap لوی شي، پلان لوړ کړئ.
پخوانۍ OOM وژنې هم وګورئ:
journalctl -k | grep -i "out of memory"
Swap: د خوندیتوب کمربند، نه انجن
په کوچني سرور کې د ۱ تر ۲ GB swap فایل ارزانه بیمه ده: د بستې ارتقا یا Docker بلډ چې د یوې شیبې لپاره ډیرې حافظې ته اړتیا لري د وژل کیدو پر ځای ژوندی پاتې کیږي. خو که یو خدمت په swap کې ژوند وکړي، هره غوښتنه ډیسک ته انتظار باسي. Swap د ناڅاپي لوړوالیو لپاره دی. دوامداره swap پدې معنی ده چې بل پلان ته اړتیا لرئ.
نو څومره واخلئ؟
- ۱ GB: یو بوټ، یو کوچنی API، یو ثابت سایټ.
- ۲ GB: د هر هغه شي لپاره معقول ډیفالټ چې ډیټابیس یا Docker لري.
- ۴ تر ۶ GB: په یوه ماشین کې څو خدمتونه، په سرور بلډونه، یو کوچنی محلي ماډل.
- ۳۲ تر ۶۴ GB: یوازې کله چې یو لوی شی باید په حافظه کې ژوند وکړي: له 14B لوی محلي ماډل، لوی RAG انډیکس، د agents ډله. د لوړې حافظې پلانونه د همدې لپاره دي.
له هغه څه چې احساس مو وایي یوه اندازه کوچنی پیل کړئ، یوه اونۍ free -h وڅارئ، او که شمیرې ووایي ارتقا ورکړئ. په EQVPS کې د پلان ارتقا ستاسو ډیټا ساتي او یوازې متناسب توپیر اخلي (د پلان بدلون څنګه کار کوي).
تبصرې
لا تبصرې نشته. لومړی اوسئ.