EQVPS

VPS з великою памʼяттю для ШІ-агентів: коли флоту реально потрібен RAM

Aug 9, 2026 · 2 min read · EQVPS Team

Найчастіше з хостингом агентів помиляються в підборі розміру. Людина запускає одного агента, той їсть 400 МБ, і робиться висновок: агентів дешево хостити. Потім вона масштабується до реальної команди — і машина починає свопити о третій ночі.

Один агент справді дешевий. Тільки це нецікавий випадок.

Куди насправді йде памʼять

Агент, що лише шле API-запити до моделі, легкий — він переважно чекає мережу. Дюжину таких можна ганяти на малому тарифі й не помітити.

RAM зникає, коли агенти починають тримати стан. Історія діалогу, що росте з кожним ходом. Робочий набір, який кілька агентів читають і пишуть. Векторне сховище памʼяті в тому ж процесі. У момент, коли архітектура перестає бути «покликав API, забув» і стає «памʼятаю, координую, передаю» — вузьким місцем стає памʼять, а не CPU.

CrewAI, LangGraph, цикли в дусі AutoGPT — усі вони йдуть у цей бік, коли доходить до серйозного. RAM їсть не фреймворк, а стан.

Грубий sizing, чесно

Не вдаватиму, що є формула, — її немає, усе залежить від того, скільки кожен агент тримає при собі. Але практичне відчуття від експлуатації:

Почніть нижче, ніж здається потрібним. Подивіться htop день. Розширюйтесь угору, коли побачите swap, а не заздалегідь — завищена здогадка просто палить гроші.

Що важко купити

Ось що робить ситуацію незручною: орендувати 64 ГБ RAM легко. Орендувати 64 ГБ криптою й без перевірки особи — ні. Більшість хостерів, що дешево продають серйозну памʼять, роблять це за карткою і формою KYC.

Якщо агент сам розгортає сервер чи навантаження торкається даних, які не хочеться привʼязувати до імені, — ця комбінація (багато памʼяті, крипта, no-KYC і замовлення самим агентом через MCP) і є продукт. Вона не дешевша за гігабайт, і чому це порівняння вводить в оману — окремо. Вона доступна на умовах, яких майже ніхто не дає.

Що робити

Якщо агенти легкі й упираються в API — не ускладнюйте, малого NAT чи dedicated-IP тарифу вистачить, пропустіть усе питання про памʼять. Якщо ганяєте реальний флот зі станом — рахуйте за тим, що реально в памʼяті, стартуйте з 32 ГБ і рухайтесь угору, коли графік скаже.

Коли дійдете — лінійка Pro закриває 32–80 ГБ з виділеним IP і нічними бекапами. Беріть тариф під робочий набір, а не під амбіції.

FAQ

Скільки RAM треба одному ШІ-агенту?

Майже нічого, якщо він лише смикає LLM API — тариф за $3–10 тягне його спокійно. Проблема з RAM починається, коли агенти тримають стан локально: історію діалогу, робочий набір, векторне сховище для памʼяті. Один агент — мало. Флот зі спільною памʼяттю — не мало.

Скільки агентів влізе на 32 ГБ проти 64 ГБ?

Чистої цифри немає — залежить від того, скільки кожен агент тримає в памʼяті. Грубо: команда з 5–10 легких агентів плюс скромне векторне сховище комфортно живе на 32 ГБ; пара десятків агентів, великі історії чи великий індекс памʼяті — і 64 ГБ знімають питання стеження за графіком RAM. Почніть нижче, розширтесь при swap.

Чи потрібен GPU для агентів?

Ні. Агенти оркеструють і кличуть LLM — модель крутиться на GPU провайдера. Локально потрібні CPU і RAM під оркестрацію, памʼять і векторний пошук. Pro-тарифи це саме те.

Чому no-KYC важливий для флоту агентів?

Якщо агент сам розгортає інфраструктуру чи працює з даними, які не хочеться привʼязувати до особи, оплата криптою без документа тримає весь цикл приватним — і агент замовляє сервер сам через MCP, без людини.

← Back to blogSee plans & pricing →

Коментарі

Поки немає коментарів. Будьте першим.

Залишити коментар

Коментарі проходять модерацію перед публікацією.