Brugsscenarier · High-memory · Pro (RAG, agent fleets, private LLM)
High-memory · Pro (RAG, agent fleets, private LLM)
AllAI & AgentsHigh-memory · Pro (RAG, agent fleets, private LLM)BotsWebsites, mail & services (dedicated IP)Self-hostingPrivacy & Anti-censorship
VPS til selv-hostet RAG i skala
Retrieval-augmented generation holder op med at være en laptop-demo, når korpusset bliver rigtigt. Et vektor-indeks vil have RAM, og dine embeddings er dine private data. Her er dimensioneringsregnestykket, og hvorfor høj-hukommelses, no-KYC-hosting passer. Fra $55/md.
→ pro-48
VPS til multi-agent-systemer og agent-flåder
Én agent er billig at hoste. En besætning på ti, der holder delt state, er et hukommelsesproblem. At dimensionere en CrewAI/LangGraph-flåde, hvorfor state æder RAM, og hvor no-KYC høj-hukommelse passer. Fra $40/md.
→ pro-32
VPS til privat høj-hukommelses-LLM-inferens
Større kvantiserede modeller har brug for rigtig RAM, ikke en GPU du ikke har. Hvor en høj-hukommelses-CPU-boks kører 30B-klasse-modeller privat, hvad der er realistisk, og hvor det ikke er. Fra $70/md.
→ pro-64