گرمای تابستان — همه‌چیز آب می‌شود، حتی قیمت‌های ما.−25%−۲۵٪ روی هر پلن سالانه، تا ۳۱ اوتدیدن پلن‌ها
EQVPS

یک عامل هوش مصنوعی واقعاً به چه مقدار VPS نیاز دارد؟ یک راهنمای انتخاب اندازه

25 خرداد 1405 · 3 دقیقه مطالعه · EQVPS Team

پاسخ صادقانه به «عامل هوش مصنوعی من به چه مقدار سرور نیاز دارد؟» این است: کمتر از آنچه فکر می‌کنید — درست تا لحظه‌ای که ناگهان این‌طور نیست. ترفند این است که بدانید بار کاری شما کدام طرف آن خط قرار دارد. پس به جای حدس زدن، اینجا می‌بینید هر نوع عامل واقعاً چه مقدار مصرف می‌کند.

آن یک سؤالی که همه‌چیز را تعیین می‌کند

آیا مدل روی سرور شما اجرا می‌شود، یا عامل شما یک مدل را از طریق API فراخوانی می‌کند؟

اگر عامل شما با یک LLM میزبانی‌شده صحبت می‌کند (مورد رایج)، بخش هوشمند و گران‌قیمت روی سخت‌افزار شخص دیگری اتفاق می‌افتد. باکس شما فقط یک حلقه‌ی هماهنگی را اجرا می‌کند: ورودی را بگیر، API را فراخوانی کن، نتیجه را تجزیه کن، شاید به یک پایگاه‌داده بزن، تکرار کن. این سبک است. واقعاً سبک — یک باکس ۱ گیگابایتی بدون ذره‌ای عرق‌ریختن انجامش می‌دهد.

اگر مدل را محلی اجرا کنید، همه‌چیز عوض می‌شود: حالا RAM را وزن‌های مدل تسخیر می‌کنند، و هر هسته‌ای که بتوانید گیر بیاورید می‌خواهید. بیشتر مردم به این نیاز ندارند. آن‌هایی که نیاز دارند معمولاً دقیقاً می‌دانند چرا (حریم خصوصی، بدون محدودیت نرخ، آفلاین). اگر این شمایید، ما یک راهنمای جداگانه درباره‌ی خودمیزبانی یک LLM محلی نوشته‌ایم.

انتخاب اندازه بر اساس بار کاری

اعداد واقعی، از آن نوعی که می‌توانید بر اساسش عمل کنید:

بار کاریRAMvCPUدیسکیادداشت‌ها
عامل چت / دستیار (متکی به API)۱ گیگابایت۲۱۵ گیگابایتحلقه ریز است؛ مدل از راه دور است
اسکرپر / عامل داده۲ گیگابایت۲۲۵ گیگابایتفضای اضافی برای تجزیه + داده‌ی اسکرپ‌شده
ربات معاملاتی۱ تا ۲ گیگابایت۲۱۵ تا ۲۵ گیگابایتتأخیر بیش از اندازه اهمیت دارد — راهنمای ربات معاملاتی را ببینید
چند عامل به‌موازات۴ گیگابایت۴۳۵ گیگابایتهر عامل ارزان است؛ هم‌زمانی جمع می‌شود
LLM محلی، ۳B تا ۷B (کوانتیزه)۴ تا ۶ گیگابایت۴ تا ۶۲۵ تا ۴۵ گیگابایتفقط-CPU، با سرعتی خواندنی اجرا می‌شود، نه انبوه

الگو: عامل‌های متکی به API ریز هستند؛ مدل‌های محلی تنها چیز سنگین‌اند.

کجا یک باکس CPU تمام می‌شود

رک درباره‌ی سقف: پلن‌های ما در ۶ گیگابایت RAM و ۶ هسته، فقط-CPU — بدون GPU به بالاترین حد می‌رسند. این همه‌چیز در جدول بالا را پوشش می‌دهد، از جمله یک مدل محلی ۷B برای استفاده‌ی شخصی. آنچه پوشش نمی‌دهد: مدل‌های ۱۳B به بالا، استنتاج محلی با توان عملیاتی بالا، یا هر چیزی که واقعاً به یک GPU نیاز دارد. اگر بار کاری شما این است، یک VPS از نوع CPU — چه مال ما چه مال هر کسی — ابزار اشتباه است، و بهتر است همین حالا این را بدانید تا بعد از اینکه مستقرش کردید.

برای آن ۹۵٪ عامل‌ها که یک API را فراخوانی می‌کنند، هیچ‌کدام از این‌ها مشکلی نیست. آن‌ها روی کوچک‌ترین باکس خوشحال‌اند.

یک قاعده‌ی سرانگشتیِ عملی

از سرِ نگرانی بیش از حد ظرفیت‌بندی نکنید. عامل‌ها ذاتاً سبک‌وزن‌اند؛ هزینه‌ی یک باکس خیلی-کوچک یک بار تغییر اندازه است، در حالی که هزینه‌ی یک باکس خیلی-بزرگ پرداختِ ماهانه برای RAM بیکار است.

وقتی یک اندازه انتخاب کردید، یک عامل می‌تواند خودش باکس را از طریق MCP اجاره کند، یا شما می‌توانید ظرف یک دقیقه در سایت سفارشش دهید. در هر صورت، کوچک شروع کنید — تقریباً به‌یقین به کمتر از آنچه انتظار داشتید نیاز خواهید داشت.

سؤالات متداول

یک عامل هوش مصنوعی به چه مقدار RAM نیاز دارد؟

بیشتر عامل‌هایی که یک LLM بیرونی را از طریق API فراخوانی می‌کنند به‌طور شگفت‌آوری کم نیاز دارند — ۱ تا ۲ گیگابایت برای حلقه‌ی هماهنگی، یک صف، و یک پایگاه‌داده‌ی کوچک کاملاً کافی است. کار سنگین (مدل) روی GPU شخص دیگری اجرا می‌شود. فقط زمانی به RAM بیشتری نیاز دارید که مدل را محلی اجرا کنید یا داده‌ی حجیمی را در حافظه نگه دارید.

آیا برای اجرای یک عامل هوش مصنوعی به GPU نیاز دارم؟

نه، اگر عامل یک مدل میزبانی‌شده را از طریق API فراخوانی کند — این کار فقط-CPU است. فقط زمانی به GPU نیاز دارید که خودتان یک مدل بزرگ را اجرا کنید، و حتی آن‌وقت مدل‌های کوچک کوانتیزه‌شده (۳B تا ۷B) روی CPU اجرا می‌شوند، فقط کند. برای بیشتر بارهای کاری عامل، یک VPS از نوع CPU انتخاب درست و ارزان‌تر است.

چه مقدار فضای دیسک برای یک عامل هوش مصنوعی؟

برای بیشتر عامل‌ها، ۱۵ تا ۲۵ گیگابایت سیستم‌عامل، کد شما، لاگ‌ها و یک پایگاه‌داده‌ی متوسط را پوشش می‌دهد. فقط زمانی بیشتر بودجه بگذارید که داده‌ی اسکرپ‌شده، امبدینگ‌ها، یا فایل‌های مدل را ذخیره می‌کنید (یک مدل ۷B به‌تنهایی حدود ۴ گیگابایت است).

یک ربات به چند هسته‌ی CPU نیاز دارد؟

یک تا دو هسته از پس یک ربات یا عاملِ همیشه‌روشنِ تکی به‌راحتی برمی‌آید. زمانی به ۴+ هسته بروید که چند عامل را به‌موازات اجرا می‌کنید، کار محدود به CPU انجام می‌دهید (تجزیه، استنتاج محلی سبک)، یا درخواست‌های هم‌زمان را سرو می‌کنید.

کوچک‌ترین VPS که می‌تواند یک عامل هوش مصنوعی را ۲۴/۷ اجرا کند چیست؟

یک باکس NAT با ۱ گیگابایت / ۲ هسته یک عامل یا ربات معمولیِ همیشه‌روشن را خوب اجرا می‌کند. فقط زمانی ارتقا دهید که یک مدل محلی، هم‌زمانی سنگین، یا نیازهای IP خودتان را اضافه کنید.

← بازگشت به وبلاگ← پلن‌ها و قیمت‌ها

نظرات

هنوز نظری نیست. اولین نفر باشید.

یک نظر بگذارید

نظرات پیش از نمایش بررسی می‌شوند.