−25%

על Windows בתשלום שנתי, עד 31.10. לחבילות

EQVPS

כמה RAM צריך VPS? מספרים אמיתיים לפי עומס עבודה

26 בספט׳ 2026 · 3 דק' קריאה · EQVPS Team

רוב האנשים מנחשים את ה-RAM. הם או קונים הרבה יותר מדי «ליתר ביטחון» או מגלים את ה-OOM killer ב-3 לפנות בוקר. זיכרון הוא בעצם מהדברים הקלים ביותר לתכנון, כי עומסי עבודה צפויים ברגע שיודעים את המספרים בקירוב. הנה הם, משרת בוט של 1 GB ועד שרתי 64 GB שאנשים מחפשים כשהם רוצים להריץ מודל גדול מקומית.

מספרים בקירוב לפי עומס עבודה

אלה נתוני מצב יציב מהעולם האמיתי בהגדרה טיפוסית, לא המינימום של היצרנים.

עומס עבודהRAM בפועלהתוכנית המתאימה
בוט Telegram/Discord ‏(Python, ‏Node.js)100–300 MBNano ‏1 GB
אתר סטטי + Caddy/Nginx50–150 MBNano ‏1 GB
WordPress + MariaDB, תעבורה רגילה0.8–1.5 GBMicro-IP ‏2 GB
PostgreSQL לאפליקציה קטנה0.5–2 GB (אתם מחליטים דרך shared_buffers)Micro / Small
n8n עם כמה תהליכי עבודה0.5–1.5 GBMicro ‏2 GB
מארח Docker עם 5–10 שירותים קטנים2–4 GBSmall ‏4 GB
Coolify + בילדים + מסד נתונים3–4 GBSmall-IP ‏4 GB
LLM ‏7–8B, ‏4 ביט, הסקה על CPU5–6 GBMedium ‏6 GB
LLM ‏14B, ‏4 ביט~10 GBPro-32
LLM ‏32B, ‏4 ביט~20 GBPro-32
LLM ‏70B, ‏4 ביט~40–45 GBPro-48 / Pro-64

שני דברים לשים לב אליהם. ראשית, הקפיצה בין עומסים «רגילים» ל-LLMs עצומה: בוט ומודל 70B שונים בפקטור של מאתיים. שנית, רוב השירותים מסתדרים עם 1–4 GB; אנשים קונים יותר מדי כי הם מתכננים לעתיד שכמעט לא מגיע.

הנוסחה ל-LLM

למודלי שפה יש הערכה פשוטה: פרמטרים × ביטים למשקל ÷ 8, ועוד תקורה. מודל 8B בכ-4.5 ביט (כימות Q4 טיפוסי) הוא 8 × 4.5 ÷ 8 ≈ ‏4.5 GB של משקלים. הוסיפו 1–2 GB לחלון ה-context (מטמון ה-KV גדל עם אורך ה-context) ולסביבת הריצה, ומגיעים ל-5–6 GB.

החלק הכן: בשרתים עם CPU בלבד, זיכרון הוא רק חצי מהסיפור. צפו למספר חד-ספרתי של טוקנים בשנייה למודלי 7–8B על כמה vCPU, ובערך לטוקן אחד בשנייה ל-70B. זה בסדר לעבודות אצווה, לסוכנים ברקע ולניסויים פרטיים; זו לא חוויית צ'אט להרבה משתמשים בו-זמנית. אם אתם בעיקר קוראים ל-APIs של מודלים מתארחים, הסוכן שלכם צריך הרבה פחות; ראו גודל VPS לסוכני AI.

למדוד במקום לנחש

אם כבר יש לכם שרת, המספרים ממש שם:

free -h                              # look at "available", not "free"
ps aux --sort=-rss | head -n 8       # the biggest processes, by resident memory
docker stats --no-stream             # per-container usage

‏Linux משתמש ב-RAM פנוי כמטמון דיסק, אז «free» תמיד קטן, וזה בריא. ‏Available הוא המספר שחשוב: זיכרון שהקרנל יכול לתת לתוכניות עכשיו. אם available נשאר מעל ~25% בשעה העמוסה ביותר, הגודל נכון. אם הוא מגיע לאפס באופן קבוע וה-swap גדל, עלו בתוכנית.

בדקו גם הריגות OOM מהעבר:

journalctl -k | grep -i "out of memory"

‏Swap: חגורת בטיחות, לא מנוע

קובץ swap של 1–2 GB בשרת קטן הוא ביטוח זול: שדרוג חבילה או בילד של Docker שצריך לרגע יותר זיכרון שורד במקום להיהרג. אבל אם שירות חי ב-swap, כל בקשה מחכה לדיסק. ‏swap זה לקפיצות. החלפה מתמדת אומרת שצריך את התוכנית הבאה.

אז כמה לקנות?

התחילו מידה אחת קטן ממה שהבטן אומרת, עקבו אחרי free -h שבוע, ושדרגו אם המספרים אומרים. ב-EQVPS שדרוג תוכנית שומר את הנתונים שלכם וגובה רק את ההפרש היחסי (איך שינוי תוכנית עובד).

שאלות נפוצות

כמה RAM צריך VPS בסיסי?

לבוט אחד, API קטן או אתר סטטי, 1 GB מספיק, ולעתים קרובות עם מקום פנוי. ‏2 GB היא ברירת המחדל הנוחה ברגע שמוסיפים מסד נתונים או מריצים דברים ב-Docker. מתחת ל-1 GB, מנהלי חבילות וסביבות ריצה מודרניות מתחילים לסבול.

כמה RAM צריך כדי להריץ LLM על VPS?

בערך גודל המודל ברמת הכימות שלו ועוד ג'יגה או שניים ל-context. מודל 7–8B ב-4 ביט צריך כ-5–6 GB, מודל 14B כ-10 GB, ‏32B כ-20 GB ו-70B כ-40–45 GB. בגלל זה קיימים שרתים של 64 GB: הם מכילים מודל 70B עם מקום לשאר ה-stack שלכם.

האם swap הוא תחליף ל-RAM?

לא. ‏swap הוא רשת ביטחון לקפיצות קצרות: הוא מונע מבילד או מגיבוי להיהרג. אם עומס עבודה חי ב-swap כל היום, הכול נהיה איטי; זה הסימן לעבור לתוכנית גדולה יותר.

איך רואים כמה RAM השרת שלי באמת צורך?

הריצו 'free -h' והסתכלו על העמודה 'available' ולא על 'free': ‏Linux משתמש בזיכרון פנוי כמטמון דיסק ומחזיר אותו לפי דרישה. ‏'ps aux --sort=-rss | head' מראה את התהליכים הגדולים ביותר, ו-'docker stats --no-stream' את הצריכה לכל קונטיינר.

מתי VPS של 64 GB הגיוני?

כשדבר אחד צריך לשבת בזיכרון: מודל מקומי של 32–70B, אינדקס וקטורי גדול ל-RAG, או צי של סוכנים עם סביבות ריצה משלהם. לאתרים, לבוטים ולרוב ה-APIs זה כסף מבוזבז.

← חזרה לבלוגראו תוכניות ומחירים →

תגובות

אין עדיין תגובות. היו הראשונים.

השאירו תגובה

התגובות עוברות מודרציה לפני שהן מופיעות.