−25%

Windows کی سالانہ ادائیگی پر، 31 اکتوبر تک۔ پلانز دیکھیں

EQVPS

VPS کو کتنی RAM چاہیے؟ کام کے لحاظ سے اصل اعداد

Sep 26, 2026 · 4 منٹ پڑھنا · EQVPS Team

زیادہ تر لوگ RAM کا اندازہ لگاتے ہیں۔ یا تو «احتیاطاً» بہت زیادہ خرید لیتے ہیں یا رات 3 بجے OOM killer سے واقف ہوتے ہیں۔ میموری درحقیقت سائز کرنے کی سب سے آسان چیزوں میں سے ہے، کیونکہ تقریبی اعداد جان لینے کے بعد کام کا بوجھ قابلِ پیش گوئی ہوتا ہے۔ یہ رہے وہ اعداد، 1 GB بوٹ سرور سے 64 GB سرورز تک جنہیں لوگ کوئی بڑا ماڈل مقامی طور پر چلانے کے لیے ڈھونڈتے ہیں۔

کام کے لحاظ سے تقریبی اعداد

یہ ایک عام سیٹ اپ کے حقیقی مستحکم اعداد ہیں، بنانے والوں کی کم از کم ضروریات نہیں۔

کاماصل RAM استعمالمناسب پلان
Telegram/Discord بوٹ (Python، Node.js)100–300 MBNano 1 GB
اسٹیٹک سائٹ + Caddy/Nginx50–150 MBNano 1 GB
WordPress + MariaDB، عام ٹریفک0.8–1.5 GBMicro-IP 2 GB
چھوٹی ایپ کے لیے PostgreSQL0.5–2 GB (آپ shared_buffers سے طے کرتے ہیں)Micro / Small
چند ورک فلوز کے ساتھ n8n0.5–1.5 GBMicro 2 GB
5–10 چھوٹی سروسز والا Docker ہوسٹ2–4 GBSmall 4 GB
Coolify + بلڈز + ڈیٹا بیس3–4 GBSmall-IP 4 GB
7–8B LLM، 4-bit، CPU پر انفرنس5–6 GBMedium 6 GB
14B LLM، 4-bit~10 GBPro-32
32B LLM، 4-bit~20 GBPro-32
70B LLM، 4-bit~40–45 GBPro-48 / Pro-64

دو باتوں پر غور کریں۔ پہلی، «عام» کاموں اور LLMs کے درمیان چھلانگ بہت بڑی ہے: ایک بوٹ اور 70B ماڈل میں دو سو گنا کا فرق ہے۔ دوسری، زیادہ تر سروسز 1–4 GB پر ٹھیک چلتی ہیں؛ لوگ زیادہ خریدتے ہیں کیونکہ وہ ایسے مستقبل کے لیے سائز کرتے ہیں جو کم ہی آتا ہے۔

LLM کا فارمولا

لینگویج ماڈلز کے لیے ایک سادہ تخمینہ ہے: پیرامیٹرز × فی وزن بٹس ÷ 8، جمع اضافی بوجھ۔ تقریباً 4.5 بٹ (ایک عام Q4 کوانٹائزیشن) پر 8B ماڈل کا مطلب ہے 8 × 4.5 ÷ 8 ≈ 4.5 GB وزن۔ context ونڈو (KV cache، context کی لمبائی کے ساتھ بڑھتا ہے) اور رن ٹائم کے لیے 1–2 GB جوڑیں تو آپ 5–6 GB پر پہنچتے ہیں۔

ایماندارانہ حصہ: صرف CPU والے سرورز پر میموری آدھی کہانی ہے۔ چند vCPU پر 7–8B ماڈلز کے لیے فی سیکنڈ اکائی ہندسوں میں ٹوکنز اور 70B کے لیے تقریباً ایک ٹوکن فی سیکنڈ کی توقع رکھیں۔ یہ بیچ جابز، پس منظر کے agents اور نجی تجربات کے لیے ٹھیک ہے؛ یہ بہت سے ایک ساتھ صارفین کے لیے چیٹ کا تجربہ نہیں۔ اگر آپ زیادہ تر ہوسٹ شدہ ماڈل APIs کال کرتے ہیں تو آپ کے agent کو بہت کم چاہیے؛ دیکھیں AI agents کے لیے VPS سائزنگ۔

اندازے کے بجائے ناپیں

اگر آپ کے پاس پہلے سے سرور ہے تو اعداد سامنے ہیں:

free -h                              # look at "available", not "free"
ps aux --sort=-rss | head -n 8       # the biggest processes, by resident memory
docker stats --no-stream             # per-container usage

Linux خالی RAM کو ڈسک کیش کے طور پر استعمال کرتا ہے، اس لیے «free» ہمیشہ کم ہوتا ہے اور یہ صحت مند ہے۔ Available وہ عدد ہے جو اہم ہے: وہ میموری جو کرنل ابھی پروگراموں کو دے سکتا ہے۔ اگر آپ کے مصروف ترین گھنٹے میں available تقریباً 25% سے اوپر رہے تو سائز درست ہے۔ اگر یہ باقاعدگی سے صفر تک پہنچے اور swap بڑھے تو اپ گریڈ کریں۔

پچھلے OOM کِلز بھی چیک کریں:

journalctl -k | grep -i "out of memory"

Swap: سیٹ بیلٹ، انجن نہیں

چھوٹے سرور پر 1–2 GB کی swap فائل سستی انشورنس ہے: کوئی پیکیج اپ گریڈ یا Docker بلڈ جسے لمحے بھر کو زیادہ میموری چاہیے، مارے جانے کے بجائے بچ جاتا ہے۔ لیکن اگر کوئی سروس swap میں رہے تو ہر درخواست ڈسک کا انتظار کرتی ہے۔ swap اچانک اضافوں کے لیے ہے۔ مسلسل swapping کا مطلب ہے کہ آپ کو اگلا پلان چاہیے۔

تو کتنی خریدیں؟

اپنے اندازے سے ایک سائز چھوٹا شروع کریں، ایک ہفتہ free -h دیکھیں، اور اعداد کہیں تو اپ گریڈ کریں۔ EQVPS پر پلان اپ گریڈ آپ کا ڈیٹا برقرار رکھتا ہے اور صرف متناسب فرق لیتا ہے (پلان کی تبدیلی کیسے کام کرتی ہے)۔

عمومی سوالات

ایک بنیادی VPS کو کتنی RAM چاہیے؟

ایک بوٹ، ایک چھوٹے API یا اسٹیٹک سائٹ کے لیے 1 GB کافی ہے، اکثر گنجائش کے ساتھ۔ ڈیٹا بیس شامل کرتے ہی یا Docker میں چیزیں چلاتے ہی 2 GB آرام دہ ڈیفالٹ ہے۔ 1 GB سے کم پر جدید پیکیج مینیجرز اور لینگویج رن ٹائمز تکلیف دینے لگتے ہیں۔

VPS پر LLM چلانے کے لیے کتنی RAM چاہیے؟

تقریباً ماڈل کا سائز اس کی کوانٹائزیشن پر، ساتھ میں context کے لیے ایک دو گیگابائٹ۔ 4-bit پر 7–8B ماڈل کو تقریباً 5–6 GB، 14B کو تقریباً 10 GB، 32B کو تقریباً 20 GB اور 70B کو تقریباً 40–45 GB چاہیے۔ اسی لیے 64 GB سرورز موجود ہیں: ان میں 70B ماڈل آپ کے باقی اسٹیک کی گنجائش کے ساتھ سما جاتا ہے۔

کیا swap، RAM کا متبادل ہے؟

نہیں۔ swap مختصر اچانک اضافوں کے لیے حفاظتی جال ہے: یہ کسی بلڈ یا بیک اپ کو مارے جانے سے بچاتا ہے۔ اگر کوئی کام سارا دن swap میں رہے تو سب کچھ سست ہو جاتا ہے؛ یہ بڑے پلان پر جانے کا اشارہ ہے۔

میں کیسے دیکھوں کہ میرا سرور واقعی کتنی RAM استعمال کرتا ہے؟

'free -h' چلائیں اور 'free' کے بجائے 'available' کالم دیکھیں: Linux فالتو میموری ڈسک کیش کے لیے استعمال کرتا ہے اور ضرورت پر واپس دے دیتا ہے۔ 'ps aux --sort=-rss | head' سب سے بڑے پراسیسز دکھاتا ہے، اور 'docker stats --no-stream' ہر کنٹینر کی کھپت۔

64 GB کا VPS کب معقول ہے؟

جب ایک ہی چیز کو میموری میں رہنا ہو: 32–70B کا مقامی ماڈل، RAG کے لیے بڑا ویکٹر انڈیکس، یا اپنے اپنے رن ٹائمز والے agents کا بیڑا۔ ویب سائٹس، بوٹس اور زیادہ تر APIs کے لیے یہ پیسے کا ضیاع ہے۔

← بلاگ پر واپسپلانز اور قیمتیں دیکھیں →

تبصرے

ابھی کوئی تبصرہ نہیں۔ پہلے بنیں۔

ایک تبصرہ چھوڑیں

تبصرے ظاہر ہونے سے پہلے moderate کیے جاتے ہیں۔