"Hoeveel kost het om een AI-agent 24/7 te draaien?" krijgt één eerlijk antwoord en één irritant antwoord. Het eerlijke antwoord: de server is goedkoop en voorspelbaar — een paar dollar per maand. Het irritante: het totaal hangt bijna volledig af van iets dat niet de server is. Laten we het opsplitsen in de twee delen zodat je echt kunt budgetteren.
Deel 1: de server (klein, vast, makkelijk)
Een always-on agent heeft een box nodig die 24/7 aan is. Dat is een VPS, en voor een typische agent is die echt goedkoop omdat de agent zelf licht is — het denken gebeurt op de hardware van de model-provider, niet die van jou.
Echte maandelijkse cijfers:
| Plan | Goed voor | ~Prijs |
|---|---|---|
| Nano (1 GB) | Een enkele always-on agent of bot die een API aanroept | ~$3/mnd |
| Micro (2 GB) | Agent + een kleine database of scraper | ~$5/mnd |
| Small (4 GB) | Meerdere agents, of één met een lokale toolchain | ~$8/mnd |
| Medium (6 GB) | Zware workload of een klein lokaal model | ~$12/mnd |
Dus $3–12/maand dekt de hosting voor bijna elke agent. Vast, voorspelbaar, klaar. Dit is het makkelijke deel — en het deel dat mensen overschatten.
Deel 2: het model (de rekening die echt varieert)
Hier is het ding dat domineert: API-tokens. Elke keer dat je agent een model aanroept, betaal je per token — input en output. En dit schaalt met gedrag, niet met een prijslijst:
- Een rustige agent (een paar aanroepen per uur, kleine prompts) geeft misschien centen per dag uit — totale kost nauwelijks boven de server.
- Een spraakzame agent (constante aanroepen, grote context-vensters, een model-in-een-lus) kan op een dag meer aan inferentie uitgeven dan de VPS in een maand kost.
Dat is geen hostingkost en geen VPS-plan verandert het — het is tussen jou en je model-provider. Maar het is het getal dat bepaalt of "een agent draaien" $4 per maand of $400 kost.
De eerlijke rekensom
- Hosting: $3–12/maand, vast.
- Tokens: $0-ish tot $honderden, volledig afhankelijk van hoe hard je agent op het model leunt.
- Totaal: server + tokens. Voor veel echte agents — periodieke taken, bescheiden prompts — is de tokenkant klein en landt het geheel dicht bij de serverprijs. Voor altijd-denkende agents met grote context overschaduwen tokens alles.
Dus wanneer iemand zegt "ik draai mijn agent voor $5 per maand", vertellen ze je meestal hun serverkost en hun tokengebruik is toevallig laag. Beide kunnen waar zijn; weet gewoon naar welk getal je kijkt.
Het laag houden
- Dimensioneer de server juist — begin bij Nano, schaal alleen op als je een behoefte meet. Betaal niet vooruit voor idle RAM.
- Beheer tokens — gebruik een kleiner model waar het goed genoeg is, trim context- en prompt-grootte, cache, en loop het model niet wanneer een enkele aanroep volstaat. Dit is waar de echte besparingen zijn, want dit is waar de echte kost is.
- Vast verslaat gemeten voor uptime — een 24/7-agent draait de hele maand, dus een vaste VPS is de goedkopere thuis dan alles wat per uur wordt gefactureerd.
En de betaling zelf
De serverkost is ook goedkoop om te betalen: voor $3–12/maand kun je afrekenen in crypto zonder kaart en zonder KYC, en op het juiste netwerk is de kost centen. Een agent kan zelfs de box zelf huren en betalen via MCP. De hosting was nooit het dure deel — dus maak het het simpele deel, en richt je aandacht op het tokenbudget, dat is waar het geld echt heen gaat.
Reacties
Nog geen reacties. Wees de eerste.