Un scraper es la clase de cosa que empiezas una vez y quieres funcionando durante semanas — un monitor de precios, un crawl de investigación, un dataset que se rellena de noche. Eso no pertenece a tu portátil, y para mucha gente tampoco pertenece a un host que quiere un pasaporte y una tarjeta antes de darte una shell. Un VPS para el que te registras con un correo y pagas en cripto encaja con el trabajo: siempre activo, privado, y tuyo.
Aquí está en qué ejecutarlo, cómo configurarlo, y una cosa honesta sobre las IPs que la mayoría de las guías se saltan.
Por qué el sin KYC importa de verdad aquí
La mayoría de los hosters atan tu cuenta a un documento y una tarjeta, y lo registran. Para un proyecto de recolección de datos eso es una fuga de privacidad que no necesitas — tu infraestructura acaba enlazada a tu nombre y tu actividad de scraping. Pagar con un correo y cripto mantiene el proyecto separado de tu identidad. Ese es el atractivo de verdad para este público, más que el precio.
También es simplemente menos fricción: levanta una máquina para un crawl puntual, déjala correr, deshazte de ella — sin baile de verificación de cuenta cada vez.
Qué tamaño — y cómo pagas
El dimensionamiento depende por completo de cómo scrapeas:
- HTTP plano (Scrapy,
requests+ BeautifulSoup). Ligero. 1–2 GB de RAM maneja muchas solicitudes concurrentes porque no estás renderizando nada. - Navegador headless (Playwright, Puppeteer, Selenium). Hambriento. Cada instancia de Chromium come 300–700 MB, así que 4 GB es un suelo sensato, más si ejecutas varias en paralelo. Esta es la razón habitual por la que una máquina de scraping necesita RAM de verdad.
Sobre el pago: regístrate con un correo y paga en USDC o USDT en Base o Ethereum — sin tarjeta, sin documentos. Una tarjeta también funciona, pero el on-ramp tiene un mínimo de ~27 $, así que para un plan barato es más cómodo recargar un pequeño saldo una vez y tomar de él.
NAT es suficiente para el servidor — un scraper solo hace llamadas de salida. Elegirías una IP dedicada solo si además alojas algo entrante (una API que sirve los datos que recolectaste).
Ponerlo en marcha
Conéctate por SSH y configura tu toolchain. Un ejemplo de navegador headless, ya que ese es el caso más difícil:
sudo apt update && sudo apt install -y python3-venv
mkdir ~/scraper && cd ~/scraper
python3 -m venv venv && source venv/bin/activate
pip install playwright && playwright install --with-deps chromium
# o un stack ligero: pip install scrapy beautifulsoup4 httpx
# scrape.py — headless fetch
from playwright.sync_api import sync_playwright
with sync_playwright() as p:
b = p.chromium.launch()
page = b.new_page()
page.goto("https://example.com")
print(page.title())
b.close()
Para un crawl que corre durante horas, no lo dejes en una sesión SSH — envuélvelo en un servicio systemd (o tmux para una ejecución rápida) para que sobreviva a desconexiones y reinicios, el mismo patrón que mantiene vivo cualquier proceso. Si un agente de IA está conduciendo el scrape, puede incluso alquilar la máquina él mismo mediante MCP.
La parte honesta sobre las IPs
Aquí es donde la mayoría de los posts de «mejor VPS para scraping» exageran. Un VPS te da un servidor con una IP de salida. Eso es perfecto para ejecutar el scraper — una máquina limpia y dedicada que está siempre activa. No es un servicio de proxy, y una IP no te sorteará un objetivo que bloquea o rate-limita por dirección.
Si estás scrapeando a escala y chocando con bloqueos, la solución es un proveedor de proxy/rotación aparte delante de tus solicitudes — el VPS ejecuta tu código, la capa de proxy maneja las IPs. Dos trabajos distintos. Cualquiera que te diga que una sola máquina resuelve el bloqueo de IP a gran escala te está vendiendo algo.
Y scrapea con responsabilidad: respeta robots.txt, drena tu tasa de solicitudes, y quédate dentro de las condiciones de lo que recolectas. Un scraper educado es bloqueado mucho menos que uno codicioso.
Las salvedades
- Solo CPU, una región (Alemania). Bien para la lógica de scraping y navegadores headless; si necesitas específicamente una GPU o una geo particular, sábelo de antemano.
- Vigila la RAM con navegadores. Un bucle de Playwright que gotea se comerá la máquina — cierra páginas y contextos, deckla la concurrencia.
- Es un servidor, no un anonimizador mágico. Sin KYC mantiene la cuenta privada; cómo se ven tus solicitudes para los objetivos es cosa tuya (y de tu capa de proxy).
Dentro de eso, un VPS sin KYC es un hogar limpio y privado para un scraper que simplemente sigue funcionando. Elige un plan, paga en cripto, y ten tu recolector en línea en minutos.
Comentarios
Aún no hay comentarios. Sé el primero.