معظم الناس يخمّنون حجم الذاكرة. إما يشترون أكثر بكثير من اللازم «احتياطًا» أو يكتشفون OOM killer في الثالثة فجرًا. والذاكرة في الواقع من أسهل الأشياء في تحديد الحجم، لأن الأعمال متوقعة بمجرد أن تعرف الأرقام التقريبية. ها هي، من خادم بوت بـ 1 GB حتى خوادم 64 GB التي يبحث عنها الناس حين يريدون تشغيل نموذج كبير محليًا.
أرقام تقريبية حسب نوع العمل
هذه أرقام واقعية للحالة المستقرة في إعداد نموذجي، لا الحدود الدنيا التي تذكرها الجهات المطوّرة.
| نوع العمل | الـ RAM الذي يستهلكه فعلًا | الخطة المناسبة |
|---|---|---|
| بوت Telegram/Discord (Python، Node.js) | 100–300 MB | Nano 1 GB |
| موقع ثابت + Caddy/Nginx | 50–150 MB | Nano 1 GB |
| WordPress + MariaDB، حركة عادية | 0.8–1.5 GB | Micro-IP 2 GB |
| PostgreSQL لتطبيق صغير | 0.5–2 GB (تقرّر عبر shared_buffers) | Micro / Small |
| n8n مع بضع مسارات عمل | 0.5–1.5 GB | Micro 2 GB |
| مضيف Docker مع 5–10 خدمات صغيرة | 2–4 GB | Small 4 GB |
| Coolify + عمليات بناء + قاعدة بيانات | 3–4 GB | Small-IP 4 GB |
| LLM بحجم 7–8B، 4 بت، استدلال على المعالج | 5–6 GB | Medium 6 GB |
| LLM بحجم 14B، 4 بت | ~10 GB | Pro-32 |
| LLM بحجم 32B، 4 بت | ~20 GB | Pro-32 |
| LLM بحجم 70B، 4 بت | ~40–45 GB | Pro-48 / Pro-64 |
لاحظ أمرين. أولًا، القفزة بين الأعمال «العادية» ونماذج LLM هائلة: بوت ونموذج 70B يختلفان بمعامل مئتين. ثانيًا، معظم الخدمات تعمل جيدًا على 1–4 GB؛ الناس يشترون أكثر لأنهم يحسبون الحجم لمستقبل نادرًا ما يأتي.
معادلة نماذج LLM
للنماذج اللغوية تقدير بسيط: عدد المعاملات × البتات لكل وزن ÷ 8، زائد الحمل الإضافي. نموذج 8B بنحو 4.5 بت (تكميم Q4 نموذجي) يعني 8 × 4.5 ÷ 8 ≈ 4.5 GB من الأوزان. أضف 1–2 GB لنافذة السياق (ذاكرة KV cache تكبر مع طول السياق) ولبيئة التشغيل، فتصل إلى 5–6 GB.
الجزء الصريح: على خوادم تعمل بالمعالج فقط، الذاكرة نصف القصة. توقّع عددًا من رقم واحد من الرموز في الثانية لنماذج 7–8B على بضعة vCPU، ونحو رمز واحد في الثانية لـ 70B. هذا مناسب للمهام الدفعية والوكلاء في الخلفية والتجارب الخاصة؛ لكنه ليس تجربة دردشة لكثير من المستخدمين في وقت واحد. إن كنت تستدعي غالبًا واجهات API لنماذج مستضافة، فوكيلك يحتاج أقل بكثير؛ راجع تحديد حجم VPS لوكلاء الذكاء الاصطناعي.
قِس بدل أن تخمّن
إن كان لديك خادم بالفعل، فالأرقام أمامك:
free -h # look at "available", not "free"
ps aux --sort=-rss | head -n 8 # the biggest processes, by resident memory
docker stats --no-stream # per-container usage
يستخدم Linux الذاكرة الخاملة كذاكرة تخزين مؤقت للقرص، لذا يكون «free» صغيرًا دائمًا، وهذا صحي. Available هو الرقم المهم: الذاكرة التي يستطيع النواة منحها للبرامج الآن. إن بقي available فوق ~25% خلال أكثر ساعاتك انشغالًا، فالحجم مناسب. إن وصل إلى الصفر بانتظام وكبر الـ swap، فانتقل إلى خطة أكبر.
تحقق أيضًا من حالات OOM السابقة:
journalctl -k | grep -i "out of memory"
الـ swap: حزام أمان لا محرّك
ملف swap بحجم 1–2 GB على خادم صغير تأمين رخيص: ترقية حزمة أو بناء Docker يحتاج ذاكرة أكثر للحظات ينجو بدل أن يُقتل. لكن إن كانت خدمة تعيش في الـ swap، فكل طلب ينتظر القرص. الـ swap للذروات. والتبديل المستمر يعني أنك تحتاج الخطة التالية.
إذن كم يجب أن تشتري؟
- 1 GB: بوت واحد، واجهة API صغيرة واحدة، موقع ثابت.
- 2 GB: القيمة الافتراضية المعقولة لأي شيء فيه قاعدة بيانات أو Docker.
- 4–6 GB: عدة خدمات على جهاز واحد، عمليات بناء على الخادم، نموذج محلي صغير.
- 32–64 GB: فقط حين يجب أن يعيش شيء كبير واحد في الذاكرة: نموذج محلي أكبر من 14B، أو فهرس RAG كبير، أو أسطول وكلاء. لهذا وُجدت الخطط عالية الذاكرة.
ابدأ بحجم أصغر بدرجة مما يقوله حدسك، وراقب free -h لمدة أسبوع، ثم رقِّ إن قالت الأرقام ذلك. على EQVPS تحافظ ترقية الخطة على بياناتك ولا تحتسب إلا الفرق النسبي (كيف يعمل تغيير الخطة).
التعليقات
لا تعليقات بعد. كن الأول.