Calor de verão — tudo derrete, até nossos preços.−25%−25% em todo plano anual, até 31 de agostoVer planos
EQVPS
Começar

VPS para sistemas multiagente e frotas de agentes

Um agente é barato de hospedar. Uma equipe de dez mantendo estado compartilhado é um problema de memória. Dimensionar uma frota CrewAI/LangGraph, por que o estado come RAM, e onde entra a muita memória sem KYC. A partir de US$40/mês.

O erro mais comum com hospedagem de agentes é dimensionar para um agente. Alguém roda um único agente, vê ele usar 400 MB, e conclui que agentes são baratos de hospedar. Então escala para uma equipe de verdade e a máquina começa a fazer swap às 3 da manhã.

Um agente é barato. Esse não é o caso interessante.

Para onde a memória de fato vai

Um agente que só dispara chamadas de API para um modelo é leve — na maior parte está esperando na rede. Rode uma dúzia deles num plano pequeno e você nunca notaria.

A RAM some quando os agentes mantêm estado. Histórico que cresce a cada turno. Um conjunto de trabalho que vários agentes leem e escrevem. Um armazenamento vetorial para memória de longo prazo no mesmo processo. No momento em que a arquitetura deixa de ser "chamar API, esquecer" e vira "lembrar, coordenar, repassar", a memória é a restrição — não a CPU. CrewAI, LangGraph, loops estilo AutoGPT todos tendem a isso à medida que ficam sérios. O framework não come a RAM; o estado come. Nós investigamos os números aqui.

Dimensionamento aproximado

Comece abaixo de onde acha que precisa estar, observe o htop por um dia, redimensione para cima quando vir swap. Chutar alto só desperdiça dinheiro.

Por que este formato de host

Uma frota que provisiona ou gerencia os próprios servidores quer uma API que consegue dirigir sem um humano — e cada vez mais, pagar sem um também. Muita memória, um IP dedicado, pagamento em cripto, sem KYC, e tudo pedível por um agente por MCP: essa combinação é rara, e é para isso que a linha Pro foi construída. Ela não é a mais barata por gigabyte, e se seus agentes são leves você genuinamente não precisa dela. Mas para um sistema sério que mantém estado e valoriza privacidade, é o encaixe certo.

Quando você chegar lá, o Pro-32 cobre uma equipe de verdade; suba para 64 ou 80 GB à medida que a frota cresce.

Pronto para implantar? Pague com cripto, sem KYC — online em cerca de um minuto.

Implantar agora →

FAQ

Quantos agentes cabem no Pro-32 vs Pro-64?

Sem número limpo — depende de quanto cada agente mantém em memória. Sensação aproximada: uma equipe de 5–10 com memória compartilhada mais um armazenamento vetorial modesto é confortável em 32 GB; algumas dúzias de agentes, históricos maiores ou um índice de memória grande te levam a 64 GB. Comece menor, redimensione quando bater no swap.

Meus agentes só chamam uma API de LLM — preciso disto?

Provavelmente não. Agentes leves, limitados por API, mal tocam a memória local; um plano NAT ou com IP dedicado de US$3–20 dá conta deles. O Pro ganha seu lugar quando os agentes mantêm estado compartilhado — histórico, um conjunto de trabalho que passam entre si, um armazenamento vetorial para memória.

Preciso de uma GPU para uma frota de agentes?

Não. Agentes orquestram e chamam um LLM; o modelo roda nas GPUs do seu provedor. Localmente você precisa de CPU e RAM para coordenação, memória e qualquer busca vetorial. É exatamente o que um plano Pro é.

Por que sem KYC para um sistema de agentes?

Se um agente provisiona a própria infraestrutura, ou a carga toca dados que você prefere não atrelar à sua identidade, pagar em cripto sem documento mantém o loop inteiro privado — e um agente pode pedir o servidor sozinho por MCP, sem etapa humana.

Comentários

Nenhum comentário ainda. Seja o primeiro.

Deixe um comentário

Os comentários são moderados antes de aparecerem.