Ein Scraper ist die Art Sache, die du einmal startest und wochenlang laufen lassen willst — ein Preis-Monitor, ein Recherche-Crawl, ein Datensatz, der sich über Nacht füllt. Das gehört nicht auf deinen Laptop, und für viele gehört es auch nicht auf einen Host, der einen Pass und eine Karte will, bevor er dir eine Shell gibt. Ein VPS, für den du dich mit einer E-Mail registrierst und in Krypto bezahlst, passt zum Job: immer an, privat und deins.
Hier ist, worauf du ihn betreiben solltest, wie man ihn einrichtet, und eine ehrliche Sache über IPs, die die meisten Leitfäden überspringen.
Warum ohne KYC hier tatsächlich zählt
Die meisten Hoster binden dein Konto an einen Ausweis und eine Karte und loggen es. Für ein Datensammlungs-Projekt ist das ein Datenschutz-Leck, das du nicht brauchst — deine Infrastruktur endet mit deinem Namen und deiner Scraping-Aktivität verknüpft. Mit einer E-Mail und Krypto zu zahlen hält das Projekt von deiner Identität getrennt. Das ist der echte Reiz für dieses Publikum, mehr als der Preis.
Es ist auch einfach weniger Reibung: fahr eine Maschine für einen einmaligen Crawl hoch, lass sie laufen, reiß sie ab — kein Konto-Verifizierungs-Tanz jedes Mal.
Welche Größe — und wie du zahlst
Die Dimensionierung hängt völlig davon ab, wie du scrapst:
- Einfaches HTTP (Scrapy,
requests+ BeautifulSoup). Leicht. 1–2 GB RAM bewältigen viele nebenläufige Anfragen, weil du nichts renderst. - Headless Browser (Playwright, Puppeteer, Selenium). Hungrig. Jede Chromium-Instanz frisst 300–700 MB, also sind 4 GB ein vernünftiger Boden, mehr, wenn du mehrere parallel betreibst. Das ist der übliche Grund, warum eine Scraping-Maschine echtes RAM braucht.
Zur Zahlung: registriere dich mit einer E-Mail und zahle in USDC oder USDT auf Base oder Ethereum — keine Karte, keine Dokumente. Eine Karte funktioniert auch, aber die Auffahrt hat ein ~27-$-Minimum, also ist es für einen günstigen Plan reibungsloser, einmal ein kleines Guthaben aufzuladen und daraus zu ziehen.
NAT reicht für den Server — ein Scraper macht nur ausgehende Aufrufe. Eine dedizierte IP würdest du nur wählen, wenn du auch etwas Eingehendes hostest (eine API, die die von dir gesammelten Daten bedient).
In Betrieb nehmen
Logg dich per SSH ein und richte deine Toolchain ein. Ein Headless-Browser-Beispiel, da das der schwierigere Fall ist:
sudo apt update && sudo apt install -y python3-venv
mkdir ~/scraper && cd ~/scraper
python3 -m venv venv && source venv/bin/activate
pip install playwright && playwright install --with-deps chromium
# oder ein leichter Stack: pip install scrapy beautifulsoup4 httpx
# scrape.py — headless fetch
from playwright.sync_api import sync_playwright
with sync_playwright() as p:
b = p.chromium.launch()
page = b.new_page()
page.goto("https://example.com")
print(page.title())
b.close()
Für einen Crawl, der stundenlang läuft, lass ihn nicht in einer SSH-Sitzung — verpack ihn in einen systemd-Dienst (oder tmux für einen schnellen Lauf), damit er Trennungen und Neustarts übersteht, das gleiche Muster, das jeden Prozess am Leben hält. Wenn ein KI-Agent den Scrape steuert, kann er die Maschine sogar selbst über MCP mieten.
Der ehrliche Teil über IPs
Hier übertreiben die meisten „bester VPS fürs Scraping“-Beiträge. Ein VPS gibt dir einen Server mit einer ausgehenden IP. Das ist perfekt, um den Scraper zu betreiben — eine saubere, dedizierte Maschine, die immer an ist. Es ist kein Proxy-Dienst, und eine IP bringt dich nicht um ein Ziel herum, das per Adresse blockiert oder rate-limitiert.
Wenn du im großen Maßstab scrapst und auf Blockaden triffst, ist die Lösung ein separater Proxy-/Rotations-Anbieter vor deinen Anfragen — der VPS betreibt deinen Code, die Proxy-Schicht handhabt die IPs. Zwei verschiedene Jobs. Jeder, der dir erzählt, dass eine Maschine großflächiges IP-Blockieren löst, verkauft dir etwas.
Und scrape verantwortungsvoll: respektiere robots.txt, drossle deine Anfragerate und bleib innerhalb der Bedingungen dessen, was du sammelst. Ein höflicher Scraper wird weit weniger blockiert als ein gieriger.
Die Vorbehalte
- Nur CPU, eine Region (Deutschland). Gut für Scraping-Logik und headless Browser; wenn du speziell eine GPU oder eine bestimmte Geo brauchst, wisse das vorab.
- Behalte RAM mit Browsern im Auge. Eine leckende Playwright-Schleife frisst die Maschine — schließe Seiten und Kontexte, deckle die Nebenläufigkeit.
- Es ist ein Server, kein magischer Anonymisierer. Ohne KYC hält das Konto privat; wie deine Anfragen für Ziele aussehen, liegt an dir (und deiner Proxy-Schicht).
Innerhalb dessen ist ein VPS ohne KYC ein sauberes, privates Zuhause für einen Scraper, der einfach weiterläuft. Wähle einen Plan, zahle in Krypto und bring deinen Sammler in Minuten online.
Kommentare
Noch keine Kommentare. Sei der Erste.