Ein Web-Scraper folgt den Anweisungen, die du geschrieben hast. Ein Browser-Agent entscheidet selbst: Er schaut auf die gerenderte Seite, überlegt, was als Nächstes zu tun ist, und klickt, tippt und scrollt einen echten Browser, um dorthin zu gelangen. Tools wie browser-use, Skyvern und Anthropics computer-use verwandeln ein LLM in etwas, das einen Browser wie ein Mensch bedient — Formulare ausfüllen, durch Abläufe navigieren, Ergebnisse lesen, sich erholen, wenn sich das Layout verschiebt.
Das funktioniert nur, wenn der Browser dauerhaft läuft. Auf deinem Laptop stoppt er in dem Moment, in dem du den Deckel schließt. Auf dieser Seite geht es darum, einen Browser-Agenten korrekt dimensioniert auf einen Server zu setzen, damit er rund um die Uhr arbeitet.
Scraper vs. Agent — das richtige Werkzeug wählen
Sei ehrlich, was du baust, denn sie wollen Unterschiedliches:
- Ein Scraper (httpx, Scrapy) holt bekannte URLs und zieht feste Felder. Deterministisch, leicht, günstig. Wenn das deine Aufgabe ist, ist der Web-Scraping-Guide die richtige Seite — zahl nicht für einen Browser, den du nicht brauchst.
- Ein Browser-Agent rendert die Seite in einem echten Chromium und lässt das LLM jede Aktion entscheiden. Er meistert Seiten, die ein Scraper nicht kann — dynamische Apps, unvorhersehbare Layouts, mehrstufige Abläufe — auf Kosten einer schwereren Maschine und Modellaufrufen pro Schritt.
Diese Seite handelt vom zweiten.
Was die Maschine wirklich braucht
Die Agent-Schleife selbst ist winzig; der Headless-Browser verbraucht die Ressourcen.
- RAM ist der Engpass. Ein Headless-Chromium sind ~300-500 MB, und jeder zusätzliche Tab oder Kontext fügt 100-200 MB hinzu. Ein Agent, der einen Browser steuert, ist auf Small (8 $/Monat — 4 vCPU, 4 GB) bequem. Mehrere Browser-Kontexte gleichzeitig drängen dich zu Medium (12 $).
- Keine GPU. Das Modell läuft bei deinem Anbieter (Anthropic/OpenAI); der Server macht Orchestrierung und Rendering. Das ist CPU und RAM.
- NAT genügt. Der Agent macht nur ausgehende Aufrufe — an die Seiten, die er bedient, und die Modell-API. Eine dedizierte IP ist nur für eingehende Dienste.
Das Setup
# Ubuntu 24.04
apt update && apt install -y python3-venv git
python3 -m venv ~/agent && source ~/agent/bin/activate
# browser-use + ein Chromium für Playwright
pip install browser-use
playwright install --with-deps chromium
Eine minimale Schleife liest den Modellschlüssel aus der Umgebung, nie hart kodiert:
# run.py
import os, asyncio
from browser_use import Agent
from browser_use.llm import ChatAnthropic
async def main():
agent = Agent(
task="Open the status page and report which services are down.",
llm=ChatAnthropic(model="claude-sonnet-4-5", api_key=os.environ["ANTHROPIC_API_KEY"]),
)
await agent.run()
asyncio.run(main())
Halte ihn über Abstürze und Neustarts hinweg mit einem systemd-Dienst am Leben — dasselbe Muster, das jeden Agenten rund um die Uhr laufen lässt, mit Restart=always und dem Modellschlüssel in einer EnvironmentFile, nicht in der Unit.
Achte auf den RAM. Ein Browser-Agent, der Tabs nie schließt, frisst die Maschine langsam auf — schließe Seiten und Kontexte am Ende einer Aufgabe und begrenze die Nebenläufigkeit. Ein leckender Chromium ist die häufigste Ursache, warum solche Agenten umkippen.
Der Teil, der wirklich unserer ist: Der Agent kann seine eigene Maschine mieten
Hier unterscheidet sich EQVPS von einem normalen Hoster. Über unseren MCP-Server kann ein Agent sich registrieren, ein Krypto-Guthaben aufladen und order_vps — selbst eine frische Maschine bestellen, ohne Mensch an der Kasse. Ein Browser-Agent, der eine saubere Umgebung für einen Lauf braucht, kann also den Server selbst bereitstellen, den Browser bedienen und ihn nach getaner Arbeit abreißen — alles aus einem Prepaid-Guthaben.
Kombiniere das mit Krypto-Zahlung ohne KYC, und die ganze Schleife bleibt frei von jeder Identitätsspur: E-Mail zur Anmeldung, USDC oder USDT zur Zahlung, Root in etwa einer Minute.
Die ehrlichen Grenzen
- Nur CPU, eine Region (Deutschland). In Ordnung, um einen Browser zu steuern und eine API aufzurufen; wenn du eine GPU oder eine bestimmte Region brauchst, wisse das vorab.
- Modellkosten sind separat. Jeder Schritt ist ein Modellaufruf; die API-Rechnung eines geschwätzigen Agenten stellt den 8-$-Server meist in den Schatten. Die Maschine ist der günstige Teil.
- Respektiere, wohin du ihn richtest. Ein Browser-Agent kann sich anmelden, absenden und kaufen. Richte ihn nur auf Seiten, die du bedienen darfst; Missbrauch, Betrug und Denial of Service verstoßen gegen die Acceptable-Use-Richtlinie.
In diesem Rahmen ist ein Browser-Agent auf seinem eigenen, stets laufenden Server ein wirklich nützliches Muster — er arbeitet, während du schläfst. Wähle einen Plan, zahle in Krypto, und starte einen in einer Minute. Wenn deine Aufgabe feste Extraktion statt Schlussfolgern ist, ist der Web-Scraping-Guide der günstigere, einfachere Weg.
Kommentare
Noch keine Kommentare. Sei der Erste.