EQVPS

VPS für browser-use-Agenten: computer-use-KI rund um die Uhr auf einem Server betreiben

5. Sept. 2026 · 4 Min. Lesezeit · EQVPS Team

Ein Web-Scraper folgt den Anweisungen, die du geschrieben hast. Ein Browser-Agent entscheidet selbst: Er schaut auf die gerenderte Seite, überlegt, was als Nächstes zu tun ist, und klickt, tippt und scrollt einen echten Browser, um dorthin zu gelangen. Tools wie browser-use, Skyvern und Anthropics computer-use verwandeln ein LLM in etwas, das einen Browser wie ein Mensch bedient — Formulare ausfüllen, durch Abläufe navigieren, Ergebnisse lesen, sich erholen, wenn sich das Layout verschiebt.

Das funktioniert nur, wenn der Browser dauerhaft läuft. Auf deinem Laptop stoppt er in dem Moment, in dem du den Deckel schließt. Auf dieser Seite geht es darum, einen Browser-Agenten korrekt dimensioniert auf einen Server zu setzen, damit er rund um die Uhr arbeitet.

Scraper vs. Agent — das richtige Werkzeug wählen

Sei ehrlich, was du baust, denn sie wollen Unterschiedliches:

Diese Seite handelt vom zweiten.

Was die Maschine wirklich braucht

Die Agent-Schleife selbst ist winzig; der Headless-Browser verbraucht die Ressourcen.

Das Setup

# Ubuntu 24.04
apt update && apt install -y python3-venv git
python3 -m venv ~/agent && source ~/agent/bin/activate

# browser-use + ein Chromium für Playwright
pip install browser-use
playwright install --with-deps chromium

Eine minimale Schleife liest den Modellschlüssel aus der Umgebung, nie hart kodiert:

# run.py
import os, asyncio
from browser_use import Agent
from browser_use.llm import ChatAnthropic

async def main():
    agent = Agent(
        task="Open the status page and report which services are down.",
        llm=ChatAnthropic(model="claude-sonnet-4-5", api_key=os.environ["ANTHROPIC_API_KEY"]),
    )
    await agent.run()

asyncio.run(main())

Halte ihn über Abstürze und Neustarts hinweg mit einem systemd-Dienst am Leben — dasselbe Muster, das jeden Agenten rund um die Uhr laufen lässt, mit Restart=always und dem Modellschlüssel in einer EnvironmentFile, nicht in der Unit.

Achte auf den RAM. Ein Browser-Agent, der Tabs nie schließt, frisst die Maschine langsam auf — schließe Seiten und Kontexte am Ende einer Aufgabe und begrenze die Nebenläufigkeit. Ein leckender Chromium ist die häufigste Ursache, warum solche Agenten umkippen.

Der Teil, der wirklich unserer ist: Der Agent kann seine eigene Maschine mieten

Hier unterscheidet sich EQVPS von einem normalen Hoster. Über unseren MCP-Server kann ein Agent sich registrieren, ein Krypto-Guthaben aufladen und order_vps — selbst eine frische Maschine bestellen, ohne Mensch an der Kasse. Ein Browser-Agent, der eine saubere Umgebung für einen Lauf braucht, kann also den Server selbst bereitstellen, den Browser bedienen und ihn nach getaner Arbeit abreißen — alles aus einem Prepaid-Guthaben.

Kombiniere das mit Krypto-Zahlung ohne KYC, und die ganze Schleife bleibt frei von jeder Identitätsspur: E-Mail zur Anmeldung, USDC oder USDT zur Zahlung, Root in etwa einer Minute.

Die ehrlichen Grenzen

In diesem Rahmen ist ein Browser-Agent auf seinem eigenen, stets laufenden Server ein wirklich nützliches Muster — er arbeitet, während du schläfst. Wähle einen Plan, zahle in Krypto, und starte einen in einer Minute. Wenn deine Aufgabe feste Extraktion statt Schlussfolgern ist, ist der Web-Scraping-Guide der günstigere, einfachere Weg.

FAQ

Was ist der Unterschied zwischen einem Browser-Agenten und einem Web-Scraper?

Ein Scraper folgt einem Skript, das du geschrieben hast — hol diese URLs, zieh diese Felder. Ein Browser-Agent wird von einem LLM gesteuert: Es schaut auf die Seite, entscheidet, was zu klicken oder zu tippen ist, und passt sich an, wenn sich das Layout ändert. browser-use, Skyvern und Anthropics computer-use arbeiten so. Es ist der Unterschied zwischen einem starren Crawler und einem Operator, der schlussfolgert. Wenn deine Aufgabe deterministische Extraktion ist, sieh dir den Scraping-Guide an; diese Seite handelt vom schlussfolgernden Typ.

Brauche ich eine GPU, um einen Browser-Agenten zu betreiben?

Nein. Das Schlussfolgern passiert in einem LLM, das du über eine API aufrufst (Anthropic, OpenAI usw.), also läuft auf dem Server nur ein Headless-Chromium plus deine Agent-Schleife — CPU- und RAM-Arbeit, keine GPU. Eine GPU bräuchtest du nur, wenn du das Modell auch lokal betreibst, was ein separates, viel schwereres Setup ist.

Wie viel RAM braucht es?

Das Gewicht liegt im Browser, nicht im Agenten. Eine Headless-Chromium-Instanz sind ~300-500 MB, plus 100-200 MB pro offenem Tab/Kontext, plus deine Runtime. Small (8 $, 4 GB) ist eine sinnvolle Untergrenze für einen Agenten, der einen Browser steuert; steig auf Medium um, wenn du mehrere Browser-Kontexte parallel betreibst.

Brauche ich eine dedizierte IP?

Meist nein. Ein Browser-Agent macht ausgehende Anfragen — an die Seiten, die er bedient, und an die Modell-API — also reicht ein NAT-Plan mit weitergeleitetem SSH und ist günstiger. Nimm eine dedizierte IP nur, wenn du auch einen eingehenden Dienst bereitstellst (ein Kontroll-Dashboard, einen Webhook-Empfänger).

Ist das erlaubt? Welche Grenzen?

Legitime Automatisierung von Seiten, die du nutzen darfst — ja. Respektiere die Bedingungen und Ratenlimits jeder Seite, hämmere kein Ziel bis zum Denial of Service, und nutze es nicht für Betrug, Credential Stuffing oder Konto-Missbrauch. Das ist ein Verstoß gegen die Acceptable-Use-Richtlinie und führt zur Kündigung. Ein Browser-Agent ist ein mächtiger Operator; richte ihn nur dorthin, wo du handeln darfst.

← Zurück zum BlogPläne & Preise ansehen →

Kommentare

Noch keine Kommentare. Sei der Erste.

Kommentar hinterlassen

Kommentare werden vor der Anzeige moderiert.