Οι περισσότεροι μαντεύουν τη RAM. Είτε αγοράζουν πολύ περισσότερη «για σιγουριά» είτε γνωρίζουν τον OOM killer στις 3 τα ξημερώματα. Η μνήμη είναι στην πραγματικότητα από τα πιο εύκολα πράγματα να διαστασιολογηθούν, γιατί οι φόρτοι είναι προβλέψιμοι μόλις ξέρετε τους χονδρικούς αριθμούς. Ορίστε, από έναν server 1 GB για bot μέχρι τους servers 64 GB που ψάχνει ο κόσμος όταν θέλει να τρέξει ένα μεγάλο μοντέλο τοπικά.
Χονδρικοί αριθμοί ανά φόρτο
Αυτά είναι πραγματικά νούμερα σταθερής κατάστασης για μια τυπική ρύθμιση, όχι τα ελάχιστα των κατασκευαστών.
| Φόρτος | RAM που χρησιμοποιεί πραγματικά | Πακέτο που ταιριάζει |
|---|---|---|
| Bot Telegram/Discord (Python, Node.js) | 100–300 MB | Nano 1 GB |
| Στατικό site + Caddy/Nginx | 50–150 MB | Nano 1 GB |
| WordPress + MariaDB, κανονική κίνηση | 0.8–1.5 GB | Micro-IP 2 GB |
| PostgreSQL για μικρή εφαρμογή | 0.5–2 GB (το αποφασίζετε με shared_buffers) | Micro / Small |
| n8n με μερικά workflows | 0.5–1.5 GB | Micro 2 GB |
| Host Docker με 5–10 μικρές υπηρεσίες | 2–4 GB | Small 4 GB |
| Coolify + builds + βάση δεδομένων | 3–4 GB | Small-IP 4 GB |
| LLM 7–8B, 4-bit, inference σε CPU | 5–6 GB | Medium 6 GB |
| LLM 14B, 4-bit | ~10 GB | Pro-32 |
| LLM 32B, 4-bit | ~20 GB | Pro-32 |
| LLM 70B, 4-bit | ~40–45 GB | Pro-48 / Pro-64 |
Δύο πράγματα να προσέξετε. Πρώτον, το άλμα ανάμεσα στους «κανονικούς» φόρτους και στα LLM είναι τεράστιο: ένα bot και ένα μοντέλο 70B διαφέρουν κατά διακόσιες φορές. Δεύτερον, οι περισσότερες υπηρεσίες είναι μια χαρά με 1–4 GB· ο κόσμος αγοράζει παραπάνω επειδή διαστασιολογεί για ένα μέλλον που σπάνια έρχεται.
Ο τύπος για LLM
Για τα γλωσσικά μοντέλα υπάρχει μια απλή εκτίμηση: παράμετροι × bits ανά βάρος ÷ 8, συν επιβάρυνση. Ένα μοντέλο 8B σε περίπου 4.5 bits (τυπική κβαντοποίηση Q4) είναι 8 × 4.5 ÷ 8 ≈ 4.5 GB βάρη. Προσθέστε 1–2 GB για το παράθυρο context (το KV cache μεγαλώνει με το μήκος του context) και το runtime, και φτάνετε στα 5–6 GB.
Το ειλικρινές κομμάτι: σε servers μόνο με CPU, η μνήμη είναι μόνο η μισή ιστορία. Περιμένετε μονοψήφιο αριθμό tokens ανά δευτερόλεπτο για μοντέλα 7–8B σε λίγα vCPU και περίπου ένα token ανά δευτερόλεπτο για 70B. Αυτό είναι μια χαρά για batch δουλειές, agents στο παρασκήνιο και ιδιωτικά πειράματα· δεν είναι εμπειρία chat για πολλούς ταυτόχρονους χρήστες. Αν κυρίως καλείτε APIs φιλοξενούμενων μοντέλων, ο agent σας χρειάζεται πολύ λιγότερα· δείτε μέγεθος VPS για AI agents.
Μετρήστε αντί να μαντεύετε
Αν έχετε ήδη server, οι αριθμοί είναι εκεί:
free -h # look at "available", not "free"
ps aux --sort=-rss | head -n 8 # the biggest processes, by resident memory
docker stats --no-stream # per-container usage
Το Linux χρησιμοποιεί την αδρανή RAM ως cache δίσκου, οπότε το «free» είναι πάντα μικρό, και αυτό είναι υγιές. Το Available είναι ο αριθμός που μετράει: η μνήμη που ο kernel μπορεί να δώσει σε προγράμματα αυτή τη στιγμή. Αν το available μένει πάνω από ~25% στην πιο πολυάσχολη ώρα σας, το μέγεθος είναι σωστό. Αν φτάνει τακτικά στο μηδέν και το swap μεγαλώνει, ανεβείτε.
Ελέγξτε και για παλαιότερους τερματισμούς OOM:
journalctl -k | grep -i "out of memory"
Swap: ζώνη ασφαλείας, όχι κινητήρας
Ένα αρχείο swap 1–2 GB σε μικρό server είναι φτηνή ασφάλεια: μια αναβάθμιση πακέτου ή ένα build Docker που θέλει στιγμιαία περισσότερη μνήμη επιβιώνει αντί να σκοτωθεί. Αλλά αν μια υπηρεσία ζει στο swap, κάθε αίτημα περιμένει τον δίσκο. Το swap είναι για αιχμές. Συνεχές swapping σημαίνει ότι χρειάζεστε το επόμενο πακέτο.
Τελικά, πόση να αγοράσετε;
- 1 GB: ένα bot, ένα μικρό API, ένα στατικό site.
- 2 GB: η λογική προεπιλογή για οτιδήποτε έχει βάση δεδομένων ή Docker.
- 4–6 GB: αρκετές υπηρεσίες σε ένα μηχάνημα, builds στον server, ένα μικρό τοπικό μοντέλο.
- 32–64 GB: μόνο όταν ένα μεγάλο πράγμα πρέπει να ζει στη μνήμη: τοπικό μοντέλο πάνω από 14B, μεγάλο ευρετήριο RAG, στόλος agents. Γι' αυτό υπάρχουν τα πακέτα υψηλής μνήμης.
Ξεκινήστε ένα μέγεθος μικρότερο από ό,τι σας λέει το ένστικτο, παρακολουθήστε το free -h για μια εβδομάδα και αναβαθμίστε αν το λένε οι αριθμοί. Στο EQVPS η αναβάθμιση πακέτου κρατά τα δεδομένα σας και χρεώνει μόνο την αναλογική διαφορά (πώς λειτουργούν οι αλλαγές πακέτου).
Σχόλια
Δεν υπάρχουν ακόμη σχόλια. Γίνετε ο πρώτος.