EQVPS
Inizia

VPS per sistemi multi-agente e flotte di agenti

Un agente è economico da ospitare. Un equipaggio di dieci che tiene stato condiviso è un problema di memoria. Dimensionare una flotta CrewAI/LangGraph, perché lo stato divora RAM, e dove si adatta l'alta memoria no-KYC. Da $40/mese.

L'errore più comune con l'hosting di agenti è dimensionare per un agente. Qualcuno fa girare un singolo agente, lo guarda usare 400 MB, e conclude che gli agenti sono economici da ospitare. Poi scala a un equipaggio reale e la macchina inizia a fare swap alle 3 di notte.

Un agente è economico. Non è quello il caso interessante.

Dove va davvero la memoria

Un agente che spara solo chiamate API a un modello è leggero — sta per lo più aspettando la rete. Fanne girare una dozzina su un piano piccolo e non lo noteresti mai.

La RAM sparisce quando gli agenti tengono stato. Cronologia che cresce a ogni turno. Un working set che diversi agenti leggono e scrivono. Un vector store per la memoria a lungo termine nello stesso processo. Nel momento in cui l'architettura smette di essere "chiama API, dimentica" e diventa "ricorda, coordina, passa la mano", la memoria è il vincolo — non la CPU. CrewAI, LangGraph, i cicli in stile AutoGPT tendono tutti in questa direzione man mano che diventano seri. Il framework non divora la RAM; lo stato lo fa. Abbiamo approfondito i numeri qui.

Dimensionamento approssimativo

Inizia sotto dove pensi di dover essere, guarda htop per un giorno, ridimensiona su quando vedi lo swap. Tirare a indovinare alto spreca solo denaro.

Perché questa forma di host

Una flotta che fa il provisioning o gestisce i propri server vuole un'API che possa guidare senza un umano — e sempre più, pagare senza uno. Alta memoria, un IP dedicato, pagamento in crypto, niente KYC, e il tutto ordinabile da un agente tramite MCP: quella combinazione è rara, ed è ciò per cui è costruita la linea Pro. Non è la più economica per gigabyte, e se i tuoi agenti sono leggeri genuinamente non ti serve. Ma per un sistema serio che tiene stato e valorizza la privacy, è l'abbinamento giusto.

Quando ci sei, Pro-32 copre un equipaggio reale; sali a 64 o 80 GB man mano che la flotta cresce.

Pronto a fare il deploy? Paga in crypto, niente KYC — online in circa un minuto.

Fai il deploy ora →

FAQ

Quanti agenti stanno su Pro-32 vs Pro-64?

Nessun numero netto — dipende da quanto ciascun agente tiene in memoria. Sensazione approssimativa: un equipaggio di 5–10 con memoria condivisa più un modesto vector store è comodo su 32 GB; un paio di dozzine di agenti, cronologie più grandi, o un grande indice di memoria ti sposta a 64 GB. Inizia più in basso, ridimensiona quando incontri lo swap.

I miei agenti chiamano solo un'API LLM — mi serve questo?

Probabilmente no. Agenti leggeri, legati all'API, toccano a malapena la memoria locale; un piano NAT o con IP dedicato da $3–20 li gestisce bene. Pro si guadagna il posto una volta che gli agenti tengono stato condiviso — cronologia, un working set che si passano, un vector store per la memoria.

Mi serve una GPU per una flotta di agenti?

No. Gli agenti orchestrano e chiamano un LLM; il modello gira sulle GPU del tuo provider. In locale ti servono CPU e RAM per coordinamento, memoria e qualsiasi ricerca vettoriale. È esattamente ciò che è un piano Pro.

Perché no-KYC per un sistema di agenti?

Se un agente fa il provisioning della propria infrastruttura, o il carico tocca dati che preferiresti non legare alla tua identità, pagare in crypto senza documento tiene privato l'intero ciclo — e un agente può ordinare il server da solo tramite MCP, nessun passo umano.

Commenti

Ancora nessun commento. Sii il primo.

Lascia un commento

I commenti sono moderati prima di comparire.