Calor de verano — todo se derrite, hasta nuestros precios.−25%−25 % en cada plan anual, hasta el 31 de agostoVer planes
EQVPS
Empezar

VPS para sistemas multiagente y flotas de agentes

Un agente es barato de alojar. Un equipo de diez que mantiene estado compartido es un problema de memoria. Dimensionar una flota CrewAI/LangGraph, por qué el estado se come la RAM, y dónde encaja la alta memoria sin KYC. Desde 40 $/mes.

El error más común con el hosting de agentes es dimensionar para un agente. Alguien ejecuta un solo agente, lo ve usar 400 MB, y concluye que los agentes son baratos de alojar. Luego escala a un equipo real y la máquina empieza a hacer swap a las 3 de la madrugada.

Un agente es barato. Ese no es el caso interesante.

A dónde va realmente la memoria

Un agente que solo dispara llamadas de API a un modelo es ligero — sobre todo está esperando en la red. Ejecuta una docena de esos en un plan pequeño y ni lo notarías.

La RAM desaparece cuando los agentes mantienen estado. Historial que crece cada turno. Un conjunto de trabajo que varios agentes leen y escriben. Un almacén vectorial para memoria a largo plazo en el mismo proceso. En el momento en que la arquitectura deja de ser "llama a la API, olvida" y se vuelve "recuerda, coordina, traspasa", la memoria es la restricción — no la CPU. Los bucles al estilo CrewAI, LangGraph, AutoGPT tienden todos hacia aquí a medida que se ponen serios. El framework no se come la RAM; el estado sí. Profundizamos en los números aquí.

Dimensionado aproximado

Empieza por debajo de donde crees que necesitas estar, mira htop durante un día, redimensiona hacia arriba cuando veas swap. Adivinar alto solo malgasta dinero.

Por qué esta forma de host

Una flota que aprovisiona o gestiona sus propios servidores quiere una API que pueda manejar sin un humano — y cada vez más, pagar sin uno también. Alta memoria, una IP dedicada, pago en cripto, sin KYC, y todo el conjunto pedible por un agente vía MCP: esa combinación es rara, y es para lo que está construida la línea Pro. No es la más barata por gigabyte, y si tus agentes son ligeros genuinamente no la necesitas. Pero para un sistema serio que mantiene estado y valora la privacidad, es el encaje adecuado.

Cuando estés ahí, Pro-32 cubre un equipo real; sube a 64 u 80 GB a medida que la flota crece.

¿Listo para desplegar? Paga en cripto, sin KYC — en línea en aproximadamente un minuto.

Desplegar →

Preguntas frecuentes

¿Cuántos agentes caben en Pro-32 frente a Pro-64?

No hay un número limpio — depende de cuánto mantenga cada agente en memoria. Sensación aproximada: un equipo de 5–10 con memoria compartida más un almacén vectorial modesto va cómodo en 32 GB; un par de docenas de agentes, historiales más grandes, o un índice de memoria grande te mueve a 64 GB. Empieza más bajo, redimensiona cuando llegues al swap.

Mis agentes solo llaman a una API de LLM — ¿necesito esto?

Probablemente no. Los agentes ligeros, atados a la API, apenas tocan la memoria local; un plan NAT o con IP dedicada de 3–20 $ los gestiona bien. Pro se gana su sitio en cuanto los agentes mantienen estado compartido — historial, un conjunto de trabajo que se pasan, un almacén vectorial para memoria.

¿Necesito una GPU para una flota de agentes?

No. Los agentes orquestan y llaman a un LLM; el modelo corre en las GPU de tu proveedor. En local necesitas CPU y RAM para coordinación, memoria y cualquier búsqueda vectorial. Eso es exactamente lo que es un plan Pro.

¿Por qué sin KYC para un sistema de agentes?

Si un agente aprovisiona su propia infraestructura, o la carga de trabajo toca datos que preferirías no atar a tu identidad, pagar en cripto sin documento mantiene todo el bucle privado — y un agente puede pedir el servidor él mismo por MCP, sin paso humano.

Comentarios

Aún no hay comentarios. Sé el primero.

Deja un comentario

Los comentarios se moderan antes de aparecer.