Calor de verão — tudo derrete, até nossos preços.−25%−25% em todo plano anual, até 31 de agostoVer planos
EQVPS
Começar

VPS de alta memória para agentes de IA: quando sua frota de fato precisa da RAM

9 de ago. de 2026 · 3 min de leitura · Equipe EQVPS

O erro que vejo com mais frequência na hospedagem de agentes é dimensionar para a coisa errada. Alguém roda um agente, ele usa 400 MB, e conclui que agentes são baratos de hospedar. Depois escala para uma equipe de verdade e a máquina começa a fazer swap às 3 da manhã.

Um agente é barato. Não é esse o caso interessante.

Para onde a memória de fato vai

Um agente que só dispara chamadas de API para um modelo é leve — ele fica na maior parte esperando pela rede. Você poderia rodar uma dúzia desses num plano pequeno e nunca notar.

A RAM some quando os agentes começam a segurar estado. Histórico de conversa que cresce a cada turno. Um conjunto de trabalho que vários agentes leem e escrevem. Um vector store para memória de longo prazo dentro do mesmo processo. No momento em que sua arquitetura deixa de ser "chame a API, esqueça" e vira "lembre, coordene, repasse", a memória vira a restrição, não a CPU.

CrewAI, LangGraph, loops no estilo AutoGPT — todos tendem para esse lado à medida que ficam sérios. O framework não come a RAM; o estado come.

Dimensionamento aproximado, honestamente

Não vou fingir que há uma fórmula, porque não há — depende inteiramente de quanto cada agente mantém por perto. Mas uma sensação prática de quem roda isto:

Comece abaixo de onde você acha que precisa estar. Observe o htop por um dia. Redimensione para cima quando ver swap, não antes — chutar alto só desperdiça dinheiro.

A parte que é difícil de comprar

Eis a coisa que torna isto estranho: alugar 64 GB de RAM é fácil. Alugar 64 GB com cripto e sem verificação de identidade não é. A maioria dos hosts que vende memória séria barato o faz por trás de um cartão e um formulário de KYC.

Se o seu agente provisiona o próprio servidor, ou a carga toca dados que você preferiria não atrelar a um nome, essa combinação — alta memória, cripto, sem KYC e pedível pelo próprio agente via MCP — é o produto de verdade. Não é mais barato por gigabyte, e eu escrevi separadamente sobre por que essa comparação engana. Está disponível em termos que quase ninguém oferece.

Então o que você faz

Se seus agentes são leves e ligados à API, não pense demais — um plano NAT ou com IP dedicado pequeno é bastante, pule toda a questão de alta memória. Se você está rodando uma frota de verdade que segura estado, dimensione pelo que está de fato em memória, comece em 32 GB e suba quando o gráfico te disser.

Quando você estiver lá, a linha Pro cobre de 32 a 80 GB com um IP dedicado e backups noturnos. Escolha o tier que combina com o seu conjunto de trabalho, não com suas ambições.

FAQ

Quanta RAM um único agente de IA precisa?

Quase nenhuma se ele só chama uma API de LLM — um plano de US$3–10 o roda bem. O problema de RAM começa quando os agentes seguram estado localmente: histórico de conversa, um conjunto de trabalho que passam entre si, um vector store para memória. Um agente, pequeno. Uma frota com memória compartilhada, não pequena.

Quantos agentes cabem em 32 GB vs 64 GB?

Não há um número limpo porque depende de quanto cada agente mantém em memória. Sensação aproximada: uma equipe de 5–10 agentes leves mais um vector store modesto é confortável em 32 GB; empurre para algumas dezenas de agentes, históricos maiores ou um índice de memória grande e 64 GB te tira de ficar olhando o gráfico de RAM. Comece mais baixo, redimensione quando bater no swap.

Preciso de uma GPU para rodar agentes?

Não. Os agentes orquestram e chamam um LLM — o modelo roda nas GPUs do seu provedor. O que você precisa localmente é CPU e RAM para a orquestração, memória e qualquer busca vetorial. Os planos Pro são exatamente isso.

Por que sem KYC importa para uma frota de agentes?

Se o agente provisiona a própria infraestrutura, ou lida com dados que você preferiria não atrelar à sua identidade, pagar em cripto sem documento mantém o ciclo inteiro privado — e um agente pode pedir o servidor sozinho via MCP sem uma etapa humana.

← Voltar ao blogVer planos e preços →

Comentários

Nenhum comentário ainda. Seja o primeiro.

Deixe um comentário

Os comentários são moderados antes de aparecerem.