Um scraper é o tipo de coisa que você começa uma vez e quer rodando por semanas — um monitor de preços, um crawl de pesquisa, um dataset que se preenche durante a noite. Isso não pertence ao seu notebook, e para muita gente não pertence a um host que quer um passaporte e um cartão antes de te dar um shell tampouco. Um VPS no qual você se cadastra com um e-mail e paga em cripto encaixa no trabalho: sempre ligado, privado e seu.
Eis em que rodá-lo, como configurá-lo e uma coisa honesta sobre IPs que a maioria dos guias pula.
Por que sem KYC de fato importa aqui
A maioria dos hosts atrela sua conta a um documento e um cartão, e o registra. Para um projeto de coleta de dados isso é um vazamento de privacidade de que você não precisa — sua infraestrutura acaba ligada ao seu nome e à sua atividade de scraping. Pagar com um e-mail e cripto mantém o projeto separado da sua identidade. Esse é o real atrativo para este público, mais que o preço.
É também simplesmente menos atrito: suba uma máquina para um crawl avulso, deixe-a rodar, derrube-a — sem a dança de verificação de conta toda vez.
Que tamanho — e como você paga
O dimensionamento depende inteiramente de como você faz scraping:
- HTTP puro (Scrapy,
requests+ BeautifulSoup). Leve. 1–2 GB de RAM dá conta de muitas requisições concorrentes porque você não está renderizando nada. - Navegador headless (Playwright, Puppeteer, Selenium). Faminto. Cada instância de Chromium come 300–700 MB, então 4 GB é um piso sensato, mais se você roda vários em paralelo. Esta é a razão usual pela qual uma máquina de scraping precisa de RAM de verdade.
Sobre pagamento: cadastre-se com um e-mail e pague em USDC ou USDT na Base ou Ethereum — sem cartão, sem documentos. Um cartão também funciona, mas o on-ramp tem um mínimo de ~US$27, então para um plano barato é mais suave recarregar um saldo pequeno uma vez e puxar dele.
O NAT basta para o servidor — um scraper só faz chamadas de saída. Você escolheria um IP dedicado só se também hospeda algo de entrada (uma API que serve os dados que você coletou).
Colocando para rodar
Faça SSH e configure seu toolchain. Um exemplo de navegador headless, já que é o caso mais difícil:
sudo apt update && sudo apt install -y python3-venv
mkdir ~/scraper && cd ~/scraper
python3 -m venv venv && source venv/bin/activate
pip install playwright && playwright install --with-deps chromium
# ou uma stack leve: pip install scrapy beautifulsoup4 httpx
# scrape.py — fetch headless
from playwright.sync_api import sync_playwright
with sync_playwright() as p:
b = p.chromium.launch()
page = b.new_page()
page.goto("https://example.com")
print(page.title())
b.close()
Para um crawl que roda por horas, não o deixe numa sessão SSH — envolva-o num serviço systemd (ou tmux para uma rodada rápida) para que ele sobreviva a desconexões e reboots, o mesmo padrão que mantém qualquer processo vivo. Se um agente de IA está conduzindo o scrape, ele pode até alugar a máquina sozinho via MCP.
A parte honesta sobre IPs
É aqui que a maioria dos posts de "melhor VPS para scraping" exagera. Um VPS te dá um servidor com um IP de saída. Isso é perfeito para rodar o scraper — uma máquina limpa e dedicada que está sempre ligada. Ele não é um serviço de proxy, e um IP não vai te livrar de um alvo que bloqueia ou limita taxa por endereço.
Se você está fazendo scraping em escala e batendo em bloqueios, a solução é um provedor separado de proxy/rotação na frente das suas requisições — o VPS roda o seu código, a camada de proxy cuida dos IPs. Dois trabalhos diferentes. Quem te diz que uma máquina resolve o bloqueio de IP em larga escala está te vendendo algo.
E faça scraping de forma responsável: respeite o robots.txt, autolimite sua taxa de requisições e fique dentro dos termos do que você coleta. Um scraper educado é bloqueado muito menos que um ganancioso.
As ressalvas
- Só CPU, uma região (Alemanha). Bom para lógica de scraping e navegadores headless; se você precisa especificamente de uma GPU ou de uma geo particular, saiba disso de cara.
- Observe a RAM com navegadores. Um loop de Playwright vazando vai comer a máquina — feche páginas e contextos, limite a concorrência.
- É um servidor, não um anonimizador mágico. Sem KYC mantém a conta privada; como suas requisições parecem aos alvos é por sua conta (e da sua camada de proxy).
Dentro disso, um VPS sem KYC é uma casa limpa e privada para um scraper que simplesmente continua rodando. Escolha um plano, pague em cripto e tenha seu coletor online em minutos.
Comentários
Nenhum comentário ainda. Seja o primeiro.