EQVPS
Inizia

Quanto VPS serve davvero a un agente IA? Una guida al dimensionamento

15 giu 2026 · 3 min di lettura · EQVPS Team

La risposta onesta a "quanto server serve al mio agente IA?" è: meno di quanto pensi — fino a quando all'improvviso non è così. Il trucco è sapere su quale lato di quella linea si trova il tuo carico. Quindi invece di indovinare, ecco cosa usa davvero ogni tipo di agente.

L'unica domanda che decide tutto

Il modello gira sul tuo server, o il tuo agente chiama un modello tramite un'API?

Se il tuo agente parla con un LLM ospitato (il caso comune), la parte intelligente e costosa avviene sull'hardware di qualcun altro. La tua macchina esegue solo un ciclo di orchestrazione: prendi l'input, chiama l'API, analizza il risultato, magari colpisci un database, ripeti. È leggero. Davvero leggero — una macchina da 1 GB lo fa senza battere ciglio.

Se esegui il modello localmente, tutto cambia: ora la RAM è dominata dai pesi del modello, e vorrai tutti i core che puoi avere. La maggior parte delle persone non ne ha bisogno. Chi ne ha bisogno di solito sa esattamente perché (privacy, nessun rate limit, offline). Se sei tu, abbiamo scritto una guida separata sul self-hosting di un LLM locale.

Dimensionamento per carico

Numeri reali, del tipo su cui puoi agire:

CaricoRAMvCPUDiscoNote
Agente di chat / assistente (basato su API)1 GB215 GBIl ciclo è minuscolo; il modello è remoto
Scraper / agente dati2 GB225 GBMargine per parsing + dati scrapati
Bot di trading1–2 GB215–25 GBLa latenza conta più della dimensione — vedi la guida ai bot di trading
Diversi agenti in parallelo4 GB435 GBOgni agente è economico; la concorrenza si somma
LLM locale, 3B–7B (quantizzato)4–6 GB4–625–45 GBSolo-CPU, gira a un ritmo leggibile, non in massa

Lo schema: gli agenti basati su API sono minuscoli; i modelli locali sono l'unica cosa pesante.

Dove una macchina CPU si ferma

Essendo chiari sul tetto: i nostri piani arrivano al massimo a 6 GB RAM e 6 core, solo-CPU — senza GPU. Questo copre tutto nella tabella sopra, incluso un modello locale 7B per uso personale. Ciò che non copre: modelli da 13B+, inferenza locale ad alto throughput, o qualsiasi cosa che abbia davvero bisogno di una GPU. Se è il tuo carico, un VPS CPU — il nostro o di chiunque — è lo strumento sbagliato, ed è meglio saperlo ora che dopo aver fatto il deploy.

Per il 95% degli agenti che chiamano un'API, niente di tutto ciò è un problema. Sono felici sulla macchina più piccola.

Una regola pratica

Non sovradimensionare per nervosismo. Gli agenti sono leggeri per natura; il costo di una macchina troppo piccola è un ridimensionamento, mentre il costo di una troppo grande è pagare per RAM inutilizzata ogni mese.

Quando hai scelto una dimensione, un agente può noleggiare la macchina da solo tramite MCP, o puoi ordinarla in un minuto sul sito. In entrambi i casi, parti in piccolo — ti servirà quasi certamente meno di quanto ti aspettassi.

FAQ

Quanta RAM serve a un agente IA?

La maggior parte degli agenti che chiamano un'API LLM esterna ha bisogno di sorprendentemente poco — 1–2 GB bastano per il ciclo di orchestrazione, una coda e un piccolo database. Il lavoro pesante (il modello) gira sulla GPU di qualcun altro. Ti serve più RAM solo se esegui il modello localmente o tieni grandi dati in memoria.

Mi serve una GPU per far girare un agente IA?

No, se l'agente chiama un modello ospitato tramite un'API — quello è lavoro solo-CPU. Ti serve una GPU solo per eseguire tu stesso un modello grande, e anche allora i piccoli modelli quantizzati (3B–7B) girano su CPU, solo lentamente. Per la maggior parte dei carichi di agenti un VPS CPU è la scelta giusta e più economica.

Quanto spazio su disco per un agente IA?

15–25 GB coprono l'OS, il tuo codice, i log e un database modesto per la maggior parte degli agenti. Budgetizza di più solo se conservi dati scrapati, embedding o file di modello (un modello 7B da solo è ~4 GB).

Quanti core CPU servono a un bot?

Uno o due core gestiscono comodamente un singolo bot o agente sempre attivo. Sali a 4+ core quando esegui diversi agenti in parallelo, fai lavoro CPU-bound (parsing, inferenza locale leggera) o servi richieste concorrenti.

Qual è il VPS più piccolo che può far girare un agente IA 24/7?

Una macchina NAT da 1 GB / 2 core fa girare bene un tipico agente o bot sempre attivo. Sali solo quando aggiungi un modello locale, concorrenza pesante o esigenze di IP proprio.

← Torna al blogVedi piani e prezzi →

Commenti

Ancora nessun commento. Sii il primo.

Lascia un commento

I commenti sono moderati prima di comparire.