Sommerhitze — alles schmilzt, sogar unsere Preise.−25%−25 % auf jeden Jahresplan, bis 31. Aug.Pläne ansehen
EQVPS
Loslegen

VPS für Multi-Agent-Systeme und Agent-Flotten

Ein Agent ist günstig zu hosten. Eine Crew von zehn, die geteilten Zustand hält, ist ein Speicherproblem. Eine CrewAI/LangGraph-Flotte dimensionieren, warum Zustand RAM frisst, und wo High-Memory ohne KYC passt. Ab 40 $/Mon.

Der häufigste Fehler beim Agent-Hosting ist, für einen Agenten zu dimensionieren. Jemand betreibt einen einzelnen Agenten, sieht ihn 400 MB nutzen und schließt, dass Agenten günstig zu hosten sind. Dann skaliert er auf eine echte Crew und die Maschine beginnt um 3 Uhr morgens zu swappen.

Ein Agent ist günstig. Das ist nicht der interessante Fall.

Wohin der Speicher tatsächlich geht

Ein Agent, der nur API-Aufrufe an ein Modell abfeuert, ist leicht — er wartet meist auf das Netzwerk. Betreib ein Dutzend davon auf einem kleinen Plan und du würdest es nie bemerken.

Das RAM verschwindet, wenn Agenten Zustand halten. Verlauf, der jede Runde wächst. Ein Arbeitsset, das mehrere Agenten lesen und schreiben. Ein Vektorspeicher für Langzeit-Gedächtnis im selben Prozess. In dem Moment, in dem die Architektur aufhört, „API aufrufen, vergessen“ zu sein, und wird zu „erinnern, koordinieren, übergeben“, ist Speicher die Einschränkung — nicht CPU. CrewAI, LangGraph, AutoGPT-artige Schleifen tendieren alle in diese Richtung, wenn sie ernst werden. Das Framework frisst nicht das RAM; der Zustand tut es. Wir haben uns hier in die Zahlen vertieft.

Grobe Dimensionierung

Beginne unter dem, wo du denkst, dass du sein musst, beobachte htop einen Tag, ändere die Größe nach oben, wenn du Swap siehst. Hoch zu raten verschwendet nur Geld.

Warum diese Form von Host

Eine Flotte, die ihre eigenen Server bereitstellt oder verwaltet, will eine API, die sie ohne einen Menschen steuern kann — und zunehmend auch, ohne einen zu bezahlen. Viel Speicher, eine dedizierte IP, Krypto-Zahlung, kein KYC, und das Ganze von einem Agenten über MCP bestellbar: diese Kombination ist selten, und sie ist, wofür die Pro-Linie gebaut ist. Sie ist nicht die günstigste pro Gigabyte, und wenn deine Agenten leicht sind, brauchst du sie wirklich nicht. Aber für ein ernsthaftes System, das Zustand hält und Privatsphäre schätzt, ist sie der richtige Sitz.

Wenn du dort bist, deckt Pro-32 eine echte Crew ab; skaliere auf 64 oder 80 GB hoch, wenn die Flotte wächst.

Bereit zum Bereitstellen? Zahle in Krypto, ohne KYC — online in etwa einer Minute.

Bereitstellen →

FAQ

Wie viele Agenten passen auf Pro-32 vs Pro-64?

Keine saubere Zahl — es hängt davon ab, wie viel jeder Agent im Speicher hält. Grobes Gefühl: eine Crew von 5–10 mit geteiltem Speicher plus ein bescheidener Vektorspeicher ist auf 32 GB bequem; ein paar Dutzend Agenten, größere Verläufe oder ein großer Speicher-Index bewegen dich zu 64 GB. Beginne niedriger, ändere die Größe, wenn du auf Swap triffst.

Meine Agenten rufen nur eine LLM-API auf — brauche ich das?

Wahrscheinlich nicht. Leichte, API-gebundene Agenten berühren kaum lokalen Speicher; ein NAT- oder Dedizierte-IP-Plan ab 3–20 $ bewältigt sie gut. Pro verdient seinen Platz, sobald Agenten geteilten Zustand halten — Verlauf, ein Arbeitsset, das sie herumreichen, einen Vektorspeicher für Gedächtnis.

Brauche ich eine GPU für eine Agent-Flotte?

Nein. Agenten orchestrieren und rufen einen LLM auf; das Modell läuft auf den GPUs deines Anbieters. Lokal brauchst du CPU und RAM für Koordination, Speicher und jede Vektorsuche. Das ist genau, was ein Pro-Plan ist.

Warum ohne KYC für ein Agent-System?

Wenn ein Agent seine eigene Infrastruktur bereitstellt, oder der Workload Daten berührt, die du lieber nicht an deine Identität binden würdest, hält das Zahlen in Krypto ohne Ausweis die ganze Schleife privat — und ein Agent kann den Server selbst über MCP bestellen, kein menschlicher Schritt.

Kommentare

Noch keine Kommentare. Sei der Erste.

Kommentar hinterlassen

Kommentare werden vor der Anzeige moderiert.