Scraper to rodzaj rzeczy, którą uruchamiasz raz i chcesz mieć działającą przez tygodnie — monitor cen, crawl badawczy, zbiór danych, który wypełnia się przez noc. To nie należy do Twojego laptopa, a dla wielu ludzi nie należy też do hosta, który chce paszportu i karty, zanim da Ci powłokę. VPS, na który rejestrujesz się e-mailem i płacisz kryptowalutą, pasuje do zadania: zawsze włączony, prywatny i Twój.
Oto na czym go uruchomić, jak to skonfigurować i jedna uczciwa rzecz o IP, którą większość przewodników pomija.
Dlaczego bez KYC faktycznie ma tu znaczenie
Większość hostów wiąże Twoje konto z dokumentem i kartą, i to loguje. Dla projektu zbierania danych to wyciek prywatności, którego nie potrzebujesz — Twoja infrastruktura kończy powiązana z Twoim nazwiskiem i Twoją aktywnością scrapingu. Płacenie e-mailem i kryptowalutą trzyma projekt oddzielony od Twojej tożsamości. To prawdziwy urok dla tej publiczności, bardziej niż cena.
To też po prostu mniej tarcia: uruchom maszynę na jednorazowy crawl, pozwól jej działać, zburz ją — bez tańca weryfikacji konta za każdym razem.
Jaki rozmiar — i jak płacisz
Dobór rozmiaru zależy całkowicie od tego, jak scrapujesz:
- Zwykły HTTP (Scrapy,
requests+ BeautifulSoup). Lekki. 1–2 GB RAM obsługuje wiele jednoczesnych żądań, bo niczego nie renderujesz. - Headless browser (Playwright, Puppeteer, Selenium). Głodny. Każda instancja Chromium zjada 300–700 MB, więc 4 GB to rozsądna dolna granica, więcej, jeśli uruchamiasz kilka równolegle. To zwykły powód, dla którego maszyna do scrapingu potrzebuje prawdziwego RAM.
O płatności: zarejestruj się e-mailem i płać w USDC lub USDT na Base lub Ethereum — bez karty, bez dokumentów. Karta też działa, ale on-ramp ma minimum ~27 $, więc dla taniego planu wygodniej doładować małe saldo raz i z niego czerpać.
NAT wystarczy dla serwera — scraper wykonuje tylko wychodzące wywołania. Dedykowane IP wybrałbyś tylko, jeśli hostujesz też coś przychodzącego (API serwujące zebrane dane).
Uruchamianie go
Zaloguj się przez SSH i skonfiguruj toolchain. Przykład z headless browser, bo to trudniejszy przypadek:
sudo apt update && sudo apt install -y python3-venv
mkdir ~/scraper && cd ~/scraper
python3 -m venv venv && source venv/bin/activate
pip install playwright && playwright install --with-deps chromium
# lub lekki stos: pip install scrapy beautifulsoup4 httpx
# scrape.py — pobranie headless
from playwright.sync_api import sync_playwright
with sync_playwright() as p:
b = p.chromium.launch()
page = b.new_page()
page.goto("https://example.com")
print(page.title())
b.close()
Dla crawla działającego godzinami nie zostawiaj go w sesji SSH — owiń go w usługę systemd (lub tmux do szybkiego przebiegu), by przetrwał rozłączenia i restarty, ten sam wzorzec, który utrzymuje dowolny proces przy życiu. Jeśli scrapem steruje agent AI, może nawet wynająć maszynę sam przez MCP.
Uczciwa część o IP
To tam, gdzie większość postów „najlepszy VPS do scrapingu” przesadza. VPS daje Ci jeden serwer z jednym wyjściowym IP. To idealne do uruchomienia scrapera — czysta, dedykowana maszyna, która jest zawsze włączona. To nie usługa proxy, a jedno IP nie obejdzie celu, który blokuje lub ogranicza zapytania po adresie.
Jeśli scrapujesz na skalę i trafiasz na blokady, rozwiązaniem jest osobny dostawca proxy/rotacji przed Twoimi żądaniami — VPS uruchamia Twój kod, warstwa proxy obsługuje IP. Dwa różne zadania. Każdy mówiący Ci, że jedna maszyna rozwiązuje blokowanie IP na dużą skalę, coś Ci sprzedaje.
I scrapuj odpowiedzialnie: szanuj robots.txt, dław tempo żądań i pozostań w granicach warunków tego, co zbierasz. Grzeczny scraper zostaje zablokowany znacznie rzadziej niż chciwy.
Zastrzeżenia
- Tylko CPU, jeden region (Niemcy). W porządku dla logiki scrapingu i headless browserów; jeśli konkretnie potrzebujesz GPU lub konkretnego geo, wiedz to z góry.
- Obserwuj RAM z przeglądarkami. Wyciekająca pętla Playwright zje maszynę — zamykaj strony i konteksty, ograniczaj współbieżność.
- To serwer, nie magiczny anonimizator. Bez KYC trzyma konto prywatnym; jak wyglądają Twoje żądania dla celów, jest na Tobie (i Twojej warstwie proxy).
W tych granicach VPS bez KYC to czysty, prywatny dom dla scrapera, który po prostu działa dalej. Wybierz plan, zapłać kryptowalutą i miej swój kolektor online w kilka minut.
Komentarze
Brak komentarzy. Bądź pierwszy.