Un scraper est le genre de chose que vous démarrez une fois et voulez faire tourner pendant des semaines — un moniteur de prix, un crawl de recherche, un jeu de données qui se remplit pendant la nuit. Ça n'a pas sa place sur votre portable, et pour beaucoup de gens, ça n'a pas non plus sa place sur un hébergeur qui veut un passeport et une carte avant de vous donner un shell. Un VPS auquel vous vous inscrivez avec un e-mail et que vous payez en crypto convient au travail : toujours actif, privé, et à vous.
Voici sur quoi le faire tourner, comment le configurer, et une chose honnête sur les IP que la plupart des guides sautent.
Pourquoi le sans-KYC compte réellement ici
La plupart des hébergeurs lient votre compte à une pièce d'identité et à une carte, et le journalisent. Pour un projet de collecte de données, c'est une fuite de confidentialité dont vous n'avez pas besoin — votre infrastructure finit liée à votre nom et à votre activité de scraping. Payer avec un e-mail et de la crypto garde le projet séparé de votre identité. C'est l'attrait réel pour ce public, plus que le prix.
C'est aussi juste moins de friction : montez une machine pour un crawl ponctuel, laissez-la tourner, démontez-la — sans danse de vérification de compte à chaque fois.
Quelle taille — et comment payer
Le dimensionnement dépend entièrement de la façon dont vous scrapez :
- HTTP simple (Scrapy,
requests+ BeautifulSoup). Léger. 1–2 Go de RAM gèrent beaucoup de requêtes concurrentes parce que vous ne rendez rien. - Navigateur headless (Playwright, Puppeteer, Selenium). Gourmand. Chaque instance Chromium mange 300–700 Mo, donc 4 Go est un plancher raisonnable, plus si vous en faites tourner plusieurs en parallèle. C'est la raison habituelle pour laquelle une machine de scraping a besoin de vraie RAM.
Sur le paiement : inscrivez-vous avec un e-mail et payez en USDC ou USDT sur Base ou Ethereum — sans carte, sans documents. Une carte fonctionne aussi, mais l'on-ramp a un minimum d'environ 27 $, donc pour une offre bon marché il est plus fluide de recharger un petit solde une fois et d'y puiser.
Le NAT suffit pour le serveur — un scraper ne fait que des appels sortants. Vous ne choisiriez une IP dédiée que si vous hébergez aussi quelque chose en entrant (une API qui sert les données que vous avez collectées).
Le mettre en marche
Connectez-vous en SSH et configurez votre chaîne d'outils. Un exemple avec navigateur headless, puisque c'est le cas le plus difficile :
sudo apt update && sudo apt install -y python3-venv
mkdir ~/scraper && cd ~/scraper
python3 -m venv venv && source venv/bin/activate
pip install playwright && playwright install --with-deps chromium
# ou une stack légère : pip install scrapy beautifulsoup4 httpx
# scrape.py — récupération headless
from playwright.sync_api import sync_playwright
with sync_playwright() as p:
b = p.chromium.launch()
page = b.new_page()
page.goto("https://example.com")
print(page.title())
b.close()
Pour un crawl qui tourne pendant des heures, ne le laissez pas dans une session SSH — enveloppez-le dans un service systemd (ou tmux pour une exécution rapide) pour qu'il survive aux déconnexions et aux redémarrages, le même schéma qui garde n'importe quel processus en vie. Si un agent IA pilote le scraping, il peut même louer la machine lui-même via MCP.
La partie honnête sur les IP
C'est là que la plupart des articles « meilleur VPS pour le scraping » survendent. Un VPS vous donne un serveur avec une IP sortante. C'est parfait pour faire tourner le scraper — une machine propre et dédiée qui est toujours active. Ce n'est pas un service de proxy, et une IP ne vous fera pas contourner une cible qui bloque ou limite le débit par adresse.
Si vous scrapez à grande échelle et rencontrez des blocages, la solution est un fournisseur de proxy/rotation séparé devant vos requêtes — le VPS fait tourner votre code, la couche proxy gère les IP. Deux travaux différents. Quiconque vous dit qu'une seule machine résout le blocage d'IP à grande échelle vous vend quelque chose.
Et scrapez de façon responsable : respectez robots.txt, limitez votre débit de requêtes, et restez dans les conditions de ce que vous collectez. Un scraper poli se fait bien moins bloquer qu'un gourmand.
Les réserves
- CPU uniquement, une seule région (Allemagne). Bien pour la logique de scraping et les navigateurs headless ; si vous avez spécifiquement besoin d'un GPU ou d'une géo particulière, sachez-le d'avance.
- Surveillez la RAM avec les navigateurs. Une boucle Playwright qui fuit mangera la machine — fermez les pages et les contextes, plafonnez la concurrence.
- C'est un serveur, pas un anonymiseur magique. Le sans-KYC garde le compte privé ; l'aspect de vos requêtes pour les cibles dépend de vous (et de votre couche proxy).
Dans ce cadre, un VPS sans KYC est un foyer propre et privé pour un scraper qui continue simplement de tourner. Choisissez une offre, payez en crypto, et ayez votre collecteur en ligne en quelques minutes.
Commentaires
Pas encore de commentaires. Soyez le premier.