د «زما AI پراکسي څومره سرور ته اړتیا لري؟» ریښتینی ځواب دا دی: د ستاسو له فکر څخه لږ — دقیقاً تر هغه چې ناڅاپه نه وي. چل دا دی چې پوه شئ ستاسو workload د هغې کرښې کوم اړخ کیني. نو د اټکل پر ځای، دلته دی چې هر ډول پراکسي واقعاً څه کاروي.
هغه یوه پوښتنه چې هر څه پریکړه کوي
ایا مودل ستاسو په سرور چلیږي، یا ستاسو پراکسي یو مودل د یوه API له لارې بولي؟
که ستاسو پراکسي یو کوربه شوي LLM سره خبرې کوي (عادي قضیه)، هوښیار، ګران برخه د بل چا په هارډویر پیښیږي. ستاسو box یوازې یو orchestration حلقه چلوي: input واخله، API وبله، پایله تجزیه کړه، شاید یو ډیټابیس ووهه، تکرار یې کړه. دا سپک دی. په رښتیا سپک — یو 1 GB box یې بې خولې کوي.
که تاسو مودل په محلي توګه چلوئ، هر څه بدلیږي: اوس RAM د مودل وزنونو لخوا واکمن کیږي، او تاسو به هره هسته چې ترلاسه کولی شئ وغواړئ. ډیری خلک دې ته اړتیا نلري. هغه چې ورته اړتیا لري معمولاً دقیقاً پوهیږي چې ولې (محرمیت، هیڅ rate limitونه، آفلاین). که دا تاسو یاست، موږ د یوه محلي LLM ځان-کوربه کولو په اړه یو جلا لارښود ولیکه.
د workload له مخې اندازهکول
ریښتیني شمیرې، هغه ډول چې تاسو یې پرې عمل کولی شئ:
| Workload | RAM | vCPU | ديسک | یادونې |
|---|---|---|---|---|
| چټ / مرستندوی پراکسي (API-بنسټ) | 1 GB | 2 | 15 GB | حلقه کوچنۍ ده؛ مودل لرې دی |
| Scraper / د ډیټا پراکسي | 2 GB | 2 | 25 GB | د parsing + scraped ډیټا لپاره ځای |
| Trading bot | 1–2 GB | 2 | 15–25 GB | Latency د اندازې څخه ډیر مهم دی — د trading bot لارښود وګورئ |
| څو پراکسیان موازي | 4 GB | 4 | 35 GB | هر پراکسي ارزانه دی؛ concurrency زیاتیږي |
| محلي LLM، 3B–7B (quantized) | 4–6 GB | 4–6 | 25–45 GB | یوازې-CPU، په یوه د لوستلو وړ سرعت چلیږي، نه په حجم |
نمونه: API-بنسټ پراکسیان کوچني دي؛ محلي مودلونه یوازینی شی دی چې درنه دی.
چیرته یو CPU box درولوي
د سقف په اړه ریښتینی: زموږ پلانونه په 6 GB RAM او 6 هستو، یوازې-CPU — هیڅ GPU کې اعظمي کیږي. دا د پورته جدول هر څه پوښي، پشمول د شخصي کارونې لپاره یو 7B محلي مودل. هغه څه چې دا نه پوښي: 13B+ مودلونه، لوړ-throughput محلي inference، یا هر څه چې واقعاً یو GPU ته اړتیا لري. که دا ستاسو workload وي، یو CPU VPS — زموږ یا د هرچا — ناسمه وسیله ده، او دا اوس پوهیدل غوره دي د دې وروسته چې تاسو یې ځای پرځای کړی.
د هغو پراکسیانو ۹۵٪ لپاره چې یو API بولي، دا هیڅ یو یوه ستونزه نه ده. دوی په ترټولو کوچني box خوښ دي.
یو عملي د ګوتې قاعده
- یوازې یو پراکسي چې یو API بولي؟ په 1 GB / 2 هستو پیل وکړئ. تاسو کولی شئ وروسته اندازه بدله کړئ.
- Scraping یا د ډیټا زیرمه کول؟ 2 GB او یو لوی ديسک.
- څو پراکسیان چلوئ، یا یو کوچنی محلي مودل؟ 4–6 GB او 4+ هستې.
- یو GPU ته اړتیا لري؟ مختلفه کټګورۍ — دا CPU ته مه زوروئ.
د اعصاب له امله over-provision مه کوئ. پراکسیان په طبیعت سپک دي؛ د یوه ډیر-کوچني box لګښت یو resize دی، پداسې حال کې چې د یوه ډیر-لوی box لګښت هره میاشت د بېکاره RAM لپاره تادیه ده.
کله چې تاسو یوه اندازه وټاکه، یو پراکسي کولی شي box پخپله د MCP له لارې کرایه کړي، یا تاسو کولی شئ یې په یوه دقیقه کې په سایټ امر کړئ. په هر ډول، کوچنی پیل وکړئ — تاسو به نږدې ډاډه د ستاسو له تمې څخه لږ ته اړتیا ولرئ.
تبصرې
لا تبصرې نشته. لومړی اوسئ.