Web scraper wykonuje instrukcje, które napisałeś. Agent przeglądarkowy decyduje sam: patrzy na wyrenderowaną stronę, rozumuje, co dalej, i klika, pisze oraz przewija prawdziwą przeglądarkę, by to osiągnąć. Narzędzia jak browser-use, Skyvern i computer-use od Anthropic zamieniają LLM w coś, co obsługuje przeglądarkę jak człowiek — wypełnia formularze, przechodzi przepływy, czyta wyniki, odzyskuje sprawność, gdy układ się zmienia.
To działa tylko, gdy przeglądarka działa nieprzerwanie. Na twoim laptopie zatrzymuje się w chwili, gdy zamkniesz klapę. Ta strona jest o umieszczeniu agenta przeglądarkowego na serwerze, poprawnie zwymiarowanym, by działał całą dobę.
Scraper czy agent — wybierz właściwe narzędzie
Bądź szczery co do tego, co budujesz, bo każdy chce czego innego:
- Scraper (httpx, Scrapy) pobiera znane URL-e i wyciąga stałe pola. Deterministyczny, lekki, tani. Jeśli to twoje zadanie, właściwa strona to przewodnik o web scrapingu — nie płać za przeglądarkę, której nie potrzebujesz.
- Agent przeglądarkowy renderuje stronę w prawdziwym Chromium i pozwala LLM decydować o każdej akcji. Radzi sobie ze stronami, którym scraper nie podoła — dynamiczne aplikacje, nieprzewidywalne układy, wieloetapowe przepływy — kosztem cięższej maszyny i wywołań modelu na każdym kroku.
Ta strona dotyczy drugiego.
Czego naprawdę potrzebuje maszyna
Sama pętla agenta jest maleńka; zasoby zjada headless przeglądarka.
- RAM to ograniczenie. Headless Chromium to ~300-500 MB, a każda dodatkowa karta lub kontekst dokłada 100-200 MB. Jeden agent sterujący przeglądarką jest wygodny na Small (8 $/mies. — 4 vCPU, 4 GB). Uruchamianie kilku kontekstów przeglądarki naraz popycha cię ku Medium (12 $).
- Bez GPU. Model działa u twojego dostawcy (Anthropic/OpenAI); serwer robi orkiestrację i renderowanie. To CPU i RAM.
- NAT wystarcza. Agent wykonuje tylko wywołania wychodzące — do stron, którymi operuje, i do API modelu. Dedykowane IP jest tylko dla usług przychodzących.
Konfiguracja
# Ubuntu 24.04
apt update && apt install -y python3-venv git
python3 -m venv ~/agent && source ~/agent/bin/activate
# browser-use + Chromium dla Playwright
pip install browser-use
playwright install --with-deps chromium
Minimalna pętla czyta klucz modelu ze środowiska, nigdy nie zaszyty w kodzie:
# run.py
import os, asyncio
from browser_use import Agent
from browser_use.llm import ChatAnthropic
async def main():
agent = Agent(
task="Open the status page and report which services are down.",
llm=ChatAnthropic(model="claude-sonnet-4-5", api_key=os.environ["ANTHROPIC_API_KEY"]),
)
await agent.run()
asyncio.run(main())
Utrzymuj go przy życiu przez awarie i restarty usługą systemd — tym samym wzorcem, który utrzymuje dowolnego agenta w ruchu 24/7, z Restart=always i kluczem modelu w EnvironmentFile, nie w jednostce.
Pilnuj RAM-u. Agent przeglądarkowy, który nigdy nie zamyka kart, powoli zje maszynę — zamykaj strony i konteksty po zakończeniu zadania i ograniczaj współbieżność. Wyciekający Chromium to najczęstsza przyczyna upadku takich agentów.
Część, która naprawdę jest nasza: agent może wynająć własną maszynę
Tu EQVPS różni się od zwykłego hostingu. Przez nasz serwer MCP agent może się zarejestrować, doładować saldo w krypto i order_vps — zamówić świeżą maszynę sam, bez człowieka przy płatności. Zatem agent przeglądarkowy, który potrzebuje czystego środowiska na jeden przebieg, może sam zaprovisionować serwer, obsłużyć przeglądarkę i zburzyć go po zakończeniu — wszystko z przedpłaconego salda.
Połącz to z płatnością krypto bez KYC, a cała pętla pozostaje poza jakimkolwiek śladem tożsamości: e-mail do rejestracji, USDC lub USDT do zapłaty, root w około minutę.
Uczciwe granice
- Tylko CPU, jeden region (Niemcy). W porządku do sterowania przeglądarką i wywoływania API; jeśli potrzebujesz GPU lub konkretnej lokalizacji, wiedz to z góry.
- Koszt modelu jest osobny. Każdy krok to wywołanie modelu; rachunek za API gadatliwego agenta zwykle przyćmiewa serwer za 8 $. Maszyna to tania część.
- Szanuj, gdzie go kierujesz. Agent przeglądarkowy potrafi się zalogować, wysłać i kupić. Kieruj go tylko na strony, którymi wolno ci operować; nadużycia, oszustwa i odmowa usługi naruszają politykę dopuszczalnego użytku.
W tych ramach agent przeglądarkowy na własnym, zawsze włączonym serwerze to naprawdę użyteczny wzorzec — działa, gdy śpisz. Wybierz plan, zapłać w krypto i uruchom jednego w minutę. Jeśli twoje zadanie to stała ekstrakcja, a nie rozumowanie, przewodnik o web scrapingu to tańsza, prostsza droga.
Komentarze
Brak komentarzy. Bądź pierwszy.