Un scraper web sigue las instrucciones que escribiste. Un agente de navegador decide por sí mismo: mira la página renderizada, razona qué hacer a continuación y hace clic, escribe y desplaza un navegador real para lograrlo. Herramientas como browser-use, Skyvern y el computer-use de Anthropic convierten un LLM en algo que opera un navegador como lo haría una persona: rellena formularios, recorre flujos, lee resultados y se recupera cuando el diseño cambia.
Eso solo funciona si el navegador está siempre en marcha. En tu portátil se detiene en cuanto cierras la tapa. Esta página trata de poner un agente de navegador en un servidor, bien dimensionado, para que opere las 24 horas.
Scraper vs. agente: elige la herramienta correcta
Sé honesto sobre qué estás construyendo, porque cada uno quiere cosas distintas:
- Un scraper (httpx, Scrapy) trae URL conocidas y extrae campos fijos. Determinista, ligero, barato. Si esa es tu tarea, la página correcta es la guía de scraping web; no pagues por un navegador que no necesitas.
- Un agente de navegador renderiza la página en un Chromium real y deja que el LLM decida cada acción. Maneja sitios que un scraper no puede —apps dinámicas, diseños impredecibles, flujos de varios pasos— a costa de una máquina más pesada y llamadas al modelo en cada paso.
Esta página trata del segundo.
Qué necesita realmente la máquina
El bucle del agente en sí es diminuto; lo que consume recursos es el navegador headless.
- La RAM es el límite. Un Chromium headless son ~300-500 MB, y cada pestaña o contexto extra añade 100-200 MB. Un agente que maneja un navegador va cómodo en Small (8 $/mes — 4 vCPU, 4 GB). Ejecutar varios contextos de navegador a la vez te empuja a Medium (12 $).
- Sin GPU. El modelo corre en tu proveedor (Anthropic/OpenAI); el servidor hace orquestación y renderizado. Eso es CPU y RAM.
- NAT basta. El agente solo hace llamadas salientes —a los sitios que opera y a la API del modelo—. Una IP dedicada es solo para servicios entrantes.
El montaje
# Ubuntu 24.04
apt update && apt install -y python3-venv git
python3 -m venv ~/agent && source ~/agent/bin/activate
# browser-use + un Chromium para Playwright
pip install browser-use
playwright install --with-deps chromium
Un bucle mínimo lee la clave del modelo desde el entorno, nunca escrita en el código:
# run.py
import os, asyncio
from browser_use import Agent
from browser_use.llm import ChatAnthropic
async def main():
agent = Agent(
task="Open the status page and report which services are down.",
llm=ChatAnthropic(model="claude-sonnet-4-5", api_key=os.environ["ANTHROPIC_API_KEY"]),
)
await agent.run()
asyncio.run(main())
Mantenlo vivo entre caídas y reinicios con un servicio systemd — el mismo patrón que mantiene cualquier agente funcionando 24/7, con Restart=always y la clave del modelo en un EnvironmentFile, no en la unidad.
Vigila la RAM. Un agente de navegador que nunca cierra pestañas se comerá la máquina poco a poco — cierra páginas y contextos al terminar una tarea y limita la concurrencia. Un Chromium con fugas es la causa más común de que estos agentes se caigan.
La parte que es realmente nuestra: el agente puede alquilar su propia máquina
Aquí EQVPS se diferencia de un hosting normal. Por nuestro servidor MCP un agente puede registrarse, recargar un saldo en cripto y order_vps — pedir una máquina nueva él mismo, sin humano en el pago. Así, un agente de navegador que necesita un entorno limpio para una ejecución puede aprovisionar el servidor él mismo, operar el navegador y destruirlo al terminar — todo desde un saldo prepago.
Combina eso con el pago en cripto sin KYC y todo el bucle queda fuera de cualquier rastro de identidad: email para registrarse, USDC o USDT para pagar, root en cosa de un minuto.
Los límites honestos
- Solo CPU, una región (Alemania). Bien para manejar un navegador y llamar a una API; si necesitas una GPU o una zona concreta, tenlo claro de antemano.
- El coste del modelo va aparte. Cada paso es una llamada al modelo; la factura de API de un agente hablador suele eclipsar el servidor de 8 $. La máquina es la parte barata.
- Respeta a dónde lo apuntas. Un agente de navegador puede iniciar sesión, enviar y comprar. Apúntalo solo a sitios que tengas derecho a operar; el abuso, el fraude y la denegación de servicio violan la política de uso aceptable.
Dentro de eso, un agente de navegador en su propio servidor siempre activo es un patrón realmente útil: opera mientras duermes. Elige un plan, paga en cripto y ten uno funcionando en un minuto. Si tu tarea es extracción fija en vez de razonamiento, la guía de scraping web es la vía más barata y sencilla.
Comentarios
Aún no hay comentarios. Sé el primero.