Det ärliga svaret på "hur mycket server behöver min AI-agent?" är: mindre än du tror — ända tills det plötsligt inte är det. Tricket är att veta vilken sida av den linjen din arbetslast sitter på. Så istället för att gissa, här är vad varje sorts agent faktiskt använder.
Den enda frågan som avgör allt
Körs modellen på din server, eller anropar din agent en modell över ett API?
Om din agent pratar med en hostad LLM (det vanliga fallet) sker den smarta, dyra delen på någon annans hårdvara. Din box kör bara en orkestrerings-loop: ta indata, anropa API:et, parsa resultatet, kanske träffa en databas, upprepa. Det är lätt. Genuint lätt — en 1 GB-box gör det utan att svettas.
Om du kör modellen lokalt ändras allt: nu domineras RAM av modellvikterna, och du vill ha varje kärna du kan få. De flesta behöver inte detta. De som gör det vet vanligtvis exakt varför (integritet, inga rate limits, offline). Om det är du skrev vi en separat guide om att självhosta en lokal LLM.
Dimensionering per arbetslast
Riktiga siffror, den sort du kan agera på:
| Arbetslast | RAM | vCPU | Disk | Noteringar |
|---|---|---|---|---|
| Chat / assistent-agent (API-backad) | 1 GB | 2 | 15 GB | Loopen är liten; modellen är remote |
| Scraper / data-agent | 2 GB | 2 | 25 GB | Utrymme för parsning + scrapad data |
| Trading bot | 1–2 GB | 2 | 15–25 GB | Latens spelar större roll än storlek — se trading bot-guiden |
| Flera agenter parallellt | 4 GB | 4 | 35 GB | Varje agent är billig; concurrency summeras |
| Lokal LLM, 3B–7B (kvantiserad) | 4–6 GB | 4–6 | 25–45 GB | CPU-only, körs i läsbar takt, inte bulk |
Mönstret: API-backade agenter är små; lokala modeller är det enda som är tungt.
Var en CPU-box slutar
Rakt på sak om taket: våra planer toppar på 6 GB RAM och 6 kärnor, CPU-only — ingen GPU. Det täcker allt i tabellen ovan, inklusive en 7B lokal modell för personligt bruk. Vad det inte täcker: 13B+ modeller, high-throughput lokal inferens, eller något som genuint behöver en GPU. Om det är din arbetslast är en CPU-VPS — vår eller någons — fel verktyg, och det är bättre att veta det nu än efter att du deployat.
För de 95% av agenterna som anropar ett API är inget av detta ett problem. De är nöjda på den minsta boxen.
En praktisk tumregel
- Bara en agent som anropar ett API? Börja på 1 GB / 2 kärnor. Du kan resiza senare.
- Scrapar eller lagrar data? 2 GB och en större disk.
- Kör flera agenter, eller en liten lokal modell? 4–6 GB och 4+ kärnor.
- Behöver en GPU? Annan kategori — tvinga inte in det på CPU.
Överdimensionera inte av nervositet. Agenter är lättviktiga av naturen; kostnaden för en för-liten box är en resize, medan kostnaden för en för-stor box är att betala för inaktivt RAM varje månad.
När du har valt en storlek kan en agent hyra boxen själv över MCP, eller så kan du beställa den på en minut på sajten. Hur som helst, börja litet — du kommer nästan säkert behöva mindre än du förväntade dig.
Kommentarer
Inga kommentarer än. Bli först.