الجواب الصادق على «كم خادمًا يحتاج وكيل الذكاء الاصطناعي لديّ؟» هو: أقلّ مما تظنّ — حتى فجأة لا يكون كذلك. الحيلة هي معرفة على أي جانب من ذلك الخطّ يقع حملك. فبدل التخمين، إليك ما يستخدمه كل نوع من الوكلاء فعلًا.
السؤال الوحيد الذي يقرّر كل شيء
هل يعمل النموذج على خادمك، أم يستدعي وكيلك نموذجًا عبر API؟
إن كان وكيلك يتحدّث مع LLM مُستضاف (الحالة الشائعة)، فالجزء الذكي المكلف يحدث على عتاد شخص آخر. خادمك يشغّل حلقة تنسيق فقط: خذ المدخل، استدعِ الـ API، حلّل النتيجة، ربما اطرق قاعدة بيانات، كرّر. ذلك خفيف. خفيف فعلًا — خادم بـ 1 GB يفعله دون عناء.
إن شغّلت النموذج محليًا، يتغيّر كل شيء: الآن تهيمن أوزان النموذج على الذاكرة، وستريد كل نواة يمكنك الحصول عليها. معظم الناس لا يحتاجون هذا. من يحتاجونه عادةً يعرفون السبب بالضبط (خصوصية، لا حدود معدّل، دون اتصال). إن كان ذلك أنت، كتبنا دليلًا منفصلًا عن استضافة LLM محلي ذاتيًا.
التحجيم حسب الحمل
أرقام حقيقية، من النوع الذي يمكنك التصرّف بناءً عليه:
| الحمل | الذاكرة | vCPU | القرص | ملاحظات |
|---|---|---|---|---|
| وكيل دردشة / مساعد (مدعوم بـ API) | 1 GB | 2 | 15 GB | الحلقة ضئيلة؛ النموذج بعيد |
| مكشطة / وكيل بيانات | 2 GB | 2 | 25 GB | مساحة للتحليل + البيانات المكشوطة |
| روبوت تداول | 1–2 GB | 2 | 15–25 GB | زمن الاستجابة يهمّ أكثر من الحجم — راجع دليل روبوت التداول |
| عدة وكلاء بالتوازي | 4 GB | 4 | 35 GB | كل وكيل رخيص؛ التزامن يتراكم |
| LLM محلي، 3B–7B (مكمّم) | 4–6 GB | 4–6 | 25–45 GB | بمعالج فقط، يعمل بوتيرة مقروءة، لا بكميات |
النمط: الوكلاء المدعومون بـ API ضئيلون؛ النماذج المحلية هي الشيء الثقيل الوحيد.
أين يتوقّف خادم CPU
بصراحة عن السقف: خططنا تصل إلى 6 GB ذاكرة و6 نوى، بمعالج فقط — دون GPU. يغطّي ذلك كل شيء في الجدول أعلاه، بما فيه نموذج 7B محلي للاستخدام الشخصي. ما لا يغطّيه: نماذج 13B+، استدلال محلي عالي الإنتاجية، أو أي شيء يحتاج GPU فعلًا. إن كان ذلك حملك، فـ VPS بمعالج — لدينا أو لدى أي أحد — أداة خاطئة، ومن الأفضل معرفة ذلك الآن لا بعد النشر.
لـ 95% من الوكلاء الذين يستدعون API، لا شيء من هذا مشكلة. إنهم سعداء على أصغر خادم.
قاعدة عملية
- مجرد وكيل يستدعي API؟ ابدأ عند 1 GB / نواتين. يمكنك التكبير لاحقًا.
- كشط أو تخزين بيانات؟ 2 GB وقرص أكبر.
- تشغيل عدة وكلاء، أو نموذج محلي صغير؟ 4–6 GB و4+ نوى.
- يحتاج GPU؟ فئة مختلفة — لا تفرضه على المعالج.
لا تفرط في التخصيص من التوتّر. الوكلاء خفيفون بطبيعتهم؛ تكلفة خادم صغير جدًا إعادة تحجيم واحدة، بينما تكلفة خادم كبير جدًا دفع ثمن ذاكرة خاملة كل شهر.
حين تختار حجمًا، يمكن لوكيل استئجار الخادم بنفسه عبر MCP، أو يمكنك طلبه في دقيقة على الموقع. في الحالتين، ابدأ صغيرًا — ستحتاج على الأرجح أقلّ مما توقّعت.
التعليقات
لا تعليقات بعد. كن الأول.