گرمای تابستان — همه‌چیز آب می‌شود، حتی قیمت‌های ما.−25%−۲۵٪ روی هر پلن سالانه، تا ۳۱ اوتدیدن پلن‌ها
EQVPS

VPS برای RAG سلف‌هاست‌شده در مقیاس بزرگ

تولید تقویت‌شده با بازیابی وقتی پیکره واقعی شود دیگر یک دموی لپ‌تاپی نیست. یک شاخص برداری RAM می‌خواهد، و embeddingهای شما داده خصوصی شما هستند. اینجا حساب ابعاد و اینکه چرا میزبانی با حافظه بالا و بدون KYC مناسب است. از ۵۵ دلار در ماه.

یک دموی RAG روی لپ‌تاپ با دویست سند بی‌زحمت به‌نظر می‌رسد. سپس آن را به یک پیکره واقعی اشاره می‌دهید — اسناد یک شرکت، سال‌ها تیکت، یک پایگاه دانش واقعی — و کل ماجرا به یک مسئله حافظه تبدیل می‌شود. نه یک مسئله CPU. یک مسئله حافظه.

این بخشی است که بیشتر صفحه‌های میزبانی رد می‌کنند: بازیابی سریع شاخص را در RAM می‌خواهد. هر تکه متن به یک embedding تبدیل می‌شود — برداری با پهنای چند صد تا چند هزار عدد — و جستجو یعنی مقایسه سریع کوئری شما با همه آن‌ها. روی دیسک کار می‌کند، اما هر کوئری یک مالیات تأخیر می‌پردازد، و بازیابی کم‌تأخیر در وهله اول دلیلی بود که سلف‌هاست کردید.

حساب ابعاد، صادقانه

پیکره خودتان را اندازه بگیرید — بُعد و نوع شاخص این را خیلی تغییر می‌دهند — اما به‌عنوان یک حس اولیه:

اگر جزئیات را می‌خواهید، ما منحنی کامل RAM را اینجا نوشتیم.

چرا حافظه بالا و بدون KYC با هم

اجاره ۴۸ گیگابایت RAM آسان است. اجاره‌اش با رمزارز و بدون بررسی هویت نه — بیشتر میزبان‌هایی که حافظه جدی را ارزان می‌فروشند، این کار را پشت یک کارت و یک فرم KYC می‌کنند. embeddingهای شما اعداد انتزاعی نیستند؛ متنی را که از آن آمده‌اند کدگذاری می‌کنند. اسناد شما، محتوای مشتریان شما، تبدیل‌شده به بردار. اگر آن داده به‌قدری حساس است که خصوصی پرداخت می‌کنید، یک ابر برداری مدیریت‌شده کل نکته را از بین می‌برد — و همین‌طور میزبانی که سرور را به هویت شما گره می‌زند.

آن ترکیب — حافظه بالا، IP اختصاصی، رمزارز، بدون KYC، پشتیبان‌گیری شبانه — چیزی است که خط Pro برایش هست. این ارزان‌ترین به‌ازای هر گیگابایت نیست، و اگر به حریم خصوصی نیاز ندارید می‌توانید RAM را جای دیگری ارزان‌تر پیدا کنید. اما اگر شاخص همان محصول شماست و نمی‌تواند خارج شود، این شکلی است که مناسب است.

از کجا شروع کنیم

پلنی با فضای خالی برای شاخص به‌علاوه هر چیز کنارش انتخاب کنید — اپلیکیشن، کلاینت مدل، فضا برای رشد. برای بیشتر پیکره‌های واقعی این Pro-48 (۴۸ گیگابایت) است؛ یک پیکره بزرگ به Pro-64 یا Pro-80 می‌رود. اول یک نمونه را بارگذاری کنید، حافظه را تماشا کنید، و از روی عددی که اندازه گرفتید ابعاد را تعیین کنید — نه عددی که از آن می‌ترسیدید.

اگر بازیابی شما بخشی از یک سیستم عامل بزرگ‌تر است، همان سرور اغلب ناوگان عامل را هم نگه می‌دارد — این‌طور است که یک پلن ۴۸ گیگابایتی بی‌سروصدا به یک پلن ۶۴ گیگابایتی تبدیل می‌شود.

Ready to deploy? Pay with crypto, no KYC — live in about a minute.

Deploy now →

FAQ

راه‌اندازی RAG من واقعاً چقدر RAM نیاز دارد؟

با تعداد embedding و پهنای بردار مقیاس می‌گیرد. چند صدهزار تکه در ۲ تا ۴ گیگابایت جا می‌شوند؛ چند میلیون، با اپلیکیشن و سیستم‌عامل کنارشان، به ۱۶ تا ۳۲ گیگابایت می‌رسند؛ ده‌ها میلیون به ۴۸ گیگابایت و فراتر می‌رسند. یک نمونه را اندازه بگیرید، حافظه مقیم را تماشا کنید، برون‌یابی کنید — بالا حدس نزنید، فقط اضافه پرداخت می‌کنید.

چرا از یک سرویس برداری مدیریت‌شده استفاده نکنم؟

دو دلیلی که مردم واقعاً سلف‌هاست می‌کنند: embeddingهای شما داده خصوصی را کدگذاری می‌کنند (اسناد، یادداشت‌ها، محتوای مشتری)، پس نگه‌داشتنشان روی ماشینی که کنترلش می‌کنید مهم است؛ و هزینه ثابت است — یک سرویس مدیریت‌شده به‌ازای بردار و کوئری شمارش می‌کند، یک VPS یک عدد ماهانه است که هر اندازه بخواهید می‌توانید بکوبید.

pgvector یا یک موتور اختصاصی؟

اگر همین حالا Postgres اجرا می‌کنید، pgvector کم‌زحمت‌ترین مسیر است — یک افزونه. برای میلیون‌ها بردار با فیلترینگ سنگین، یک موتور ساخته‌شده برای همین کار مثل Qdrant ارزش سرویس جدا را دارد. با آنچه اداره می‌کنید شروع کنید؛ وقتی جستجو کند شد جدایش کنید، نه پیش از آن.

آیا برای RAG به GPU نیاز دارم؟

نه. بازیابی کار CPU + RAM است — مقایسه بردارها، نه تولید متن. مرحله تولید مدل زبانی شما را فرا می‌خواند (یک API، یا یک میزبان مدل جدا). یک سرور CPU با حافظه بالا دقیقاً شکل درست برای نیمه بازیابی است.

نظرات

هنوز نظری نیست. اولین نفر باشید.

یک نظر بگذارید

نظرات پیش از نمایش بررسی می‌شوند.