EQVPS

כמה VPS סוכן AI באמת צריך? מדריך מדידה

15 ביוני 2026 · 2 דק' קריאה · EQVPS Team

התשובה הכנה ל"כמה שרת הסוכן AI שלי צריך?" היא: פחות ממה שאתם חושבים — ישר עד שפתאום לא. הטריק הוא לדעת באיזה צד של הקו הזה ה-workload שלכם יושב. אז במקום לנחש, הנה מה שכל סוג סוכן בעצם משתמש.

השאלה האחת שמחליטה הכל

האם המודל רץ על השרת שלכם, או שהסוכן שלכם קורא למודל מעל API?

אם הסוכן שלכם מדבר עם LLM מאוחסן (המקרה הנפוץ), החלק החכם והיקר קורה על החומרה של מישהו אחר. הארגז שלכם רק מריץ לולאת תזמור: קח קלט, קרא ל-API, פרסר את התוצאה, אולי פגע במסד נתונים, חזור. זה קל. באמת קל — ארגז 1 GB עושה את זה בלי להזיע.

אם אתם מריצים את המודל מקומית, הכל משתנה: עכשיו RAM נשלט על ידי משקלי המודל, ותרצו כל ליבה שאתם יכולים להשיג. רוב האנשים לא צריכים את זה. אלה שכן בדרך כלל יודעים בדיוק למה (פרטיות, ללא מגבלות קצב, לא-מקוון). אם זה אתם, כתבנו מדריך נפרד על אחסון-עצמי של LLM מקומי.

מדידה לפי workload

מספרים אמיתיים, מהסוג שאתם יכולים לפעול לפיו:

WorkloadRAMvCPUדיסקהערות
סוכן צ'אט / עוזר (מגובה-API)1 GB215 GBהלולאה זעירה; המודל מרוחק
סקרייפר / סוכן נתונים2 GB225 GBמרווח ל-parsing + נתונים שגורדו
בוט מסחר1–2 GB215–25 GBהשהיה חשובה יותר מגודל — ראו את מדריך בוט-המסחר
כמה סוכנים במקביל4 GB435 GBכל סוכן זול; מקביליות מצטברת
LLM מקומי, 3B–7B (קוונטיזי)4–6 GB4–625–45 GBCPU-בלבד, רץ בקצב קריא, לא בכמות

הדפוס: סוכנים מגובי-API זעירים; מודלים מקומיים הם הדבר היחיד שכבד.

איפה ארגז CPU נעצר

בישרות לגבי התקרה: התוכניות שלנו מגיעות עד 6 GB RAM ו-6 ליבות, CPU-בלבד — ללא GPU. זה מכסה את כל מה שבטבלה למעלה, כולל מודל 7B מקומי לשימוש אישי. מה שהוא לא מכסה: מודלים 13B+, inference מקומי בתפוקה-גבוהה, או כל דבר שבאמת צריך GPU. אם זה ה-workload שלכם, VPS של CPU — שלנו או של כל אחד — הוא הכלי הלא נכון, ועדיף לדעת את זה עכשיו מאשר אחרי שפרסתם.

ל-95% מהסוכנים שקוראים ל-API, שום דבר מזה לא בעיה. הם שמחים על הארגז הקטן ביותר.

כלל אצבע מעשי

אל תקצו יותר מדי מתוך עצבנות. סוכנים קלים במהותם; העלות של ארגז קטן-מדי היא שינוי-גודל אחד, בעוד העלות של ארגז גדול-מדי היא לשלם על RAM בטל כל חודש.

כשבחרתם גודל, סוכן יכול לשכור את הארגז בעצמו דרך MCP, או שאתם יכולים להזמין אותו תוך דקה באתר. כך או כך, התחילו קטן — כמעט בוודאי תצטרכו פחות ממה שציפיתם.

שאלות נפוצות

כמה RAM סוכן AI צריך?

רוב הסוכנים שקוראים ל-API של LLM חיצוני צריכים מעט באופן מפתיע — 1–2 GB בשפע ללולאת התזמור, תור, ומסד נתונים קטן. ההרמה הכבדה (המודל) רצה על ה-GPU של מישהו אחר. אתם צריכים יותר RAM רק אם אתם מריצים את המודל מקומית או מחזיקים נתונים גדולים בזיכרון.

האם אני צריך GPU כדי להריץ סוכן AI?

לא, אם הסוכן קורא למודל מאוחסן מעל API — זו עבודת CPU-בלבד. אתם צריכים GPU רק כדי להריץ מודל גדול בעצמכם, ואפילו אז מודלים קוונטיזיים קטנים (3B–7B) רצים על CPU, רק לאט. לרוב ה-workloads של סוכנים VPS של CPU הוא הבחירה הנכונה והזולה יותר.

כמה מקום דיסק לסוכן AI?

15–25 GB מכסים את מערכת ההפעלה, הקוד שלכם, לוגים ומסד נתונים צנוע לרוב הסוכנים. תקצבו יותר רק אם אתם מאחסנים נתונים שגורדו, embeddings, או קבצי מודל (מודל 7B לבד הוא ~4 GB).

כמה ליבות CPU בוט צריך?

ליבה עד שתיים מטפלות בבוט או סוכן תמיד-מקוון בודד בנוחות. לכו ל-4+ ליבות כשאתם מריצים כמה סוכנים במקביל, עושים עבודה כבולת-CPU (parsing, inference מקומי קל), או משרתים בקשות מקביליות.

מה ה-VPS הקטן ביותר שיכול להריץ סוכן AI 24/7?

ארגז NAT של 1 GB / 2-ליבות מריץ סוכן או בוט תמיד-מקוון טיפוסי בסדר. עלו בגודל רק כשאתם מוסיפים מודל מקומי, מקביליות כבדה, או צרכי IP משלכם.

← חזרה לבלוגראו תוכניות ומחירים →

תגובות

אין עדיין תגובות. היו הראשונים.

השאירו תגובה

התגובות עוברות מודרציה לפני שהן מופיעות.