agent hosting کے ساتھ جو غلطی میں سب سے زیادہ دیکھتا ہوں وہ غلط چیز کے لیے sizing ہے۔ کوئی ایک agent چلاتا ہے، یہ 400 MB استعمال کرتا ہے، اور وہ نتیجہ نکالتے ہیں کہ agents host کرنا سستا ہے۔ پھر وہ ایک حقیقی crew تک بڑھتے ہیں اور باکس رات 3 بجے swap کرنے لگتا ہے۔
ایک agent ہے سستا۔ یہ دلچسپ صورت نہیں۔
memory دراصل کہاں جاتی ہے
ایک agent جو صرف ایک ماڈل کو API کالز داغتا ہے وہ ہلکا ہے — یہ زیادہ تر network پر انتظار کر رہا ہے۔ آپ ایسے ایک درجن ایک چھوٹے پلان پر چلا سکتے اور کبھی محسوس نہ کریں۔
RAM تب غائب ہوتی ہے جب agents state رکھنے لگتے ہیں۔ گفتگو-تاریخ جو ہر turn بڑھتی ہے۔ ایک working set جسے کئی agents پڑھتے اور لکھتے۔ اسی process میں بیٹھا طویل-مدتی memory کے لیے ایک vector store۔ جس لمحے آپ کا architecture "call API, بھول جاؤ" رہنا چھوڑ کر "یاد رکھو، coordinate کرو، ہینڈ آف کرو" بنتا ہے، memory رکاوٹ بنتی ہے، CPU نہیں۔
CrewAI، LangGraph، AutoGPT-طرز loops — سنجیدہ ہوتے وہ سب اسی طرف رجحان کرتے ہیں۔ framework RAM نہیں کھاتا؛ state کھاتا ہے۔
کچا sizing، ایمانداری سے
میں یہ ظاہر نہیں کروں گا کہ کوئی فارمولا ہے، کیونکہ نہیں ہے — یہ مکمل طور پر اس پر منحصر کہ ہر agent کتنا رکھتا ہے۔ لیکن انہیں چلانے سے ایک عملی احساس:
- ہلکے، API-bound agents — یہاں آپ کو Pro کی سرے سے ضرورت نہیں؛ ایک NAT یا dedicated-IP پلان ($3–20) اسے سنبھالتا ہے۔ Pro اپنی جگہ تب کماتا ہے جب shared state آپ کو ~32 GB سے آگے دھکیل دے۔
- 32 GB — ایک حقیقی multi-agent سسٹم کے لیے sweet spot: shared memory والے 5–10 agents plus ایک vector database جو دراصل مفید ہو۔ زیادہ تر لوگ یہاں اترتے ہیں۔
- 64 GB — بڑے fleets، لمبی تاریخیں، لاکھوں vectors میں ایک memory index، یا کئی سروسز co-located۔ یہیں ایک باکس ان تین چھوٹوں کی جگہ لیتا ہے جنہیں آپ ورنہ juggle کرتے۔
- 80 GB — بھاری، memory-bound کام: بڑے in-memory ڈیٹا سیٹ، بہت سے concurrent agents، یا agents plus اسی host پر local model inference۔
جہاں آپ سمجھتے ہیں ضرورت ہے اس سے نیچے شروع کریں۔ ایک دن htop دیکھیں۔ جب swap دیکھیں تب اوپر resize کریں، پہلے نہیں — اونچا اندازہ لگانا بس پیسہ ضائع کرتا ہے۔
وہ حصہ جو خریدنا مشکل ہے
یہ رہی وہ بات جو اسے عجیب بناتی ہے: 64 GB RAM کرائے پر لینا آسان ہے۔ 64 GB کرپٹو سے اور بغیر شناختی جانچ کرائے پر لینا نہیں۔ زیادہ تر ہوسٹس جو سنجیدہ memory سستے میں بیچتے ہیں وہ ایک کارڈ اور ایک KYC فارم کے پیچھے کرتے ہیں۔
اگر آپ کا agent اپنا سرور خود فراہم کرے، یا ورک لوڈ ایسا ڈیٹا چھوئے جسے آپ ایک نام سے باندھنا نہ چاہیں، تو وہ امتزاج — high memory، کرپٹو، no KYC، اور agent کے خود MCP کے ذریعے آرڈر کرنے کے قابل — دراصل product ہے۔ یہ فی گیگابائٹ سستا نہیں، اور میں نے الگ لکھا ہے کہ وہ موازنہ کیوں گمراہ کرتا ہے۔ یہ ایسی شرائط پر دستیاب ہے جو تقریباً کوئی پیش نہیں کرتا۔
تو آپ کیا کریں
اگر آپ کے agents ہلکے اور API-bound ہیں، تو زیادہ نہ سوچیں — ایک چھوٹا NAT یا dedicated-IP پلان کافی ہے، پورا high-memory سوال چھوڑ دیں۔ اگر آپ ایک حقیقی fleet چلا رہے ہیں جو state رکھتا ہے، تو memory میں دراصل جو ہے اس سے size کریں، 32 GB سے شروع کریں، اور جب گراف کہے تب اوپر جائیں۔
جب آپ وہاں ہوں، تو Pro لائن ایک dedicated IP اور nightly backups کے ساتھ 32 سے 80 GB کور کرتی ہے۔ وہ tier چنیں جو آپ کے working set سے میل کھائے، آپ کے عزائم سے نہیں۔
تبصرے
ابھی کوئی تبصرہ نہیں۔ پہلے بنیں۔