Sommerhitze — alles schmilzt, sogar unsere Preise.−25%−25 % auf jeden Jahresplan, bis 31. Aug.Pläne ansehen
EQVPS
Loslegen

VPS mit viel Arbeitsspeicher für KI-Agenten: wann deine Flotte den RAM wirklich braucht

9. Aug. 2026 · 3 Min. Lesezeit · EQVPS Team

Der Fehler, den ich beim Agenten-Hosting am häufigsten sehe, ist, für das Falsche zu dimensionieren. Jemand betreibt einen Agenten, er nutzt 400 MB, und man schließt daraus, dass Agenten günstig zu hosten sind. Dann skaliert man auf eine echte Crew, und die Maschine fängt um 3 Uhr morgens an zu swappen.

Ein Agent ist günstig. Das ist nicht der interessante Fall.

Wohin der Speicher wirklich geht

Ein Agent, der nur API-Aufrufe an ein Modell abfeuert, ist leicht — er wartet meist auf das Netzwerk. Du könntest ein Dutzend davon auf einem kleinen Plan betreiben und es nie bemerken.

Der RAM verschwindet, wenn Agenten anfangen, Zustand zu halten. Gesprächsverlauf, der mit jeder Runde wächst. Ein Arbeitssatz, den mehrere Agenten lesen und schreiben. Ein Vektorspeicher für das Langzeitgedächtnis, der im selben Prozess sitzt. In dem Moment, in dem deine Architektur aufhört, „API aufrufen, vergessen“ zu sein, und zu „erinnern, koordinieren, übergeben“ wird, wird der Speicher zur Einschränkung, nicht die CPU.

CrewAI, LangGraph, AutoGPT-artige Schleifen — sie tendieren alle in diese Richtung, wenn es ernst wird. Das Framework frisst den RAM nicht; der Zustand tut es.

Grobe Dimensionierung, ehrlich

Ich tue nicht so, als gäbe es eine Formel, denn die gibt es nicht — es hängt völlig davon ab, wie viel jeder Agent behält. Aber ein praktisches Gefühl aus dem Betrieb:

Starte unter dem, wo du glaubst sein zu müssen. Beobachte einen Tag lang htop. Skaliere hoch, wenn du Swap siehst, nicht vorher — hoch zu raten verschwendet nur Geld.

Der Teil, der schwer zu kaufen ist

Hier ist das, was es unangenehm macht: 64 GB RAM zu mieten ist einfach. 64 GB mit Krypto und ohne Identitätsprüfung zu mieten nicht. Die meisten Hoster, die ernsthaften Speicher günstig verkaufen, tun es hinter einer Karte und einem KYC-Formular.

Wenn dein Agent seinen eigenen Server bereitstellt oder die Workload Daten berührt, die du lieber nicht an einen Namen bindest, ist diese Kombination — viel Arbeitsspeicher, Krypto, kein KYC und vom Agenten selbst über MCP bestellbar — das eigentliche Produkt. Es ist nicht günstiger pro Gigabyte, und ich habe separat darüber geschrieben, warum dieser Vergleich in die Irre führt. Es ist zu Bedingungen verfügbar, die fast niemand anbietet.

Also was tust du

Wenn deine Agenten leicht und API-gebunden sind, denk nicht zu viel nach — ein kleiner NAT- oder dedizierte-IP-Plan reicht reichlich, überspring die ganze Frage nach viel Arbeitsspeicher. Wenn du eine echte Flotte betreibst, die Zustand hält, dimensioniere nach dem, was tatsächlich im Speicher ist, starte mit 32 GB und geh hoch, wenn der Graph es dir sagt.

Wenn du dort bist, deckt die Pro-Linie 32 bis 80 GB mit einer dedizierten IP und nächtlichen Backups ab. Wähle die Stufe, die zu deinem Arbeitssatz passt, nicht zu deinen Ambitionen.

FAQ

Wie viel RAM braucht ein einzelner KI-Agent?

Fast keinen, wenn er nur eine LLM-API aufruft — ein 3–10-$-Plan betreibt ihn gut. Das RAM-Problem beginnt, wenn Agenten Zustand lokal halten: Gesprächsverlauf, einen Arbeitssatz, den sie herumreichen, einen Vektorspeicher für das Gedächtnis. Ein Agent, klein. Eine Flotte mit gemeinsamem Speicher, nicht klein.

Wie viele Agenten passen auf 32 GB vs 64 GB?

Es gibt keine saubere Zahl, weil es davon abhängt, wie viel jeder Agent im Speicher hält. Grobes Gefühl: eine Crew aus 5–10 leichtgewichtigen Agenten plus ein bescheidener Vektorspeicher ist auf 32 GB bequem; treib es auf ein paar Dutzend Agenten, größere Verläufe oder einen großen Speicherindex, und 64 GB hört dich auf, den RAM-Graphen zu beobachten. Starte niedriger, skaliere, wenn du in Swap gerätst.

Brauche ich einen GPU, um Agenten zu betreiben?

Nein. Agenten orchestrieren und rufen ein LLM auf — das Modell läuft auf den GPUs deines Anbieters. Was du lokal brauchst, sind CPU und RAM für die Orchestrierung, das Gedächtnis und etwaige Vektorsuche. Pro-Pläne sind genau das.

Warum ist ohne KYC für eine Agentenflotte wichtig?

Wenn der Agent seine eigene Infrastruktur bereitstellt oder Daten verarbeitet, die du lieber nicht an deine Identität bindest, hält das Bezahlen in Krypto ohne Ausweis die ganze Schleife privat — und ein Agent kann den Server selbst über MCP ohne menschlichen Schritt bestellen.

← Zurück zum BlogPläne & Preise ansehen →

Kommentare

Noch keine Kommentare. Sei der Erste.

Kommentar hinterlassen

Kommentare werden vor der Anzeige moderiert.