Yaz sıcağı — her şey eriyor, fiyatlarımız bile.−25%31 Ağustos'a kadar her yıllık planda −%25Planları gör
EQVPS
Hemen başla

Bir yapay zekâ ajanı gerçekte ne kadar VPS ister? Bir boyutlandırma rehberi

15 Haz 2026 · 3 dk okuma · EQVPS Team

"Yapay zekâ ajanım ne kadar sunucu ister?" sorusunun dürüst cevabı şudur: sandığından az — ta ki aniden az olmayana dek. Numara, iş yükünün o çizginin hangi tarafında oturduğunu bilmektir. O yüzden tahmin etmek yerine, işte her tür ajanın gerçekte ne kullandığı.

Her şeyi belirleyen tek soru

Model sunucunda mı çalışır, yoksa ajanın bir modeli bir API üzerinden mi çağırır?

Ajanın barındırılan bir LLM ile konuşuyorsa (olağan durum), akıllı, pahalı kısım başkasının donanımında olur. Kutun sadece bir orkestrasyon döngüsü çalıştırır: girdiyi al, API'yi çağır, sonucu ayrıştır, belki bir veritabanına vur, tekrarla. Bu hafiftir. Gerçekten hafif — 1 GB'lık bir kutu bunu hiç zorlanmadan yapar.

Modeli yerel olarak çalıştırırsan her şey değişir: artık RAM'e model ağırlıkları hâkimdir ve alabildiğin her çekirdeği istersin. Çoğu insanın buna ihtiyacı yoktur. İhtiyacı olanlar genellikle tam olarak nedenini bilir (gizlilik, hız sınırı yok, çevrim dışı). Bu sensen, yerel bir LLM'i kendin barındırma üzerine ayrı bir rehber yazdık.

İş yüküne göre boyutlandırma

Üzerine harekete geçebileceğin türden gerçek sayılar:

İş yüküRAMvCPUDiskNotlar
Sohbet / asistan ajanı (API destekli)1 GB215 GBDöngü minik; model uzakta
Kazıyıcı / veri ajanı2 GB225 GBAyrıştırma + kazınmış veri için pay
Alım-satım botu1–2 GB215–25 GBBoyuttan çok gecikme önemli — bkz alım-satım botu rehberi
Paralel birkaç ajan4 GB435 GBHer ajan ucuz; eşzamanlılık birikir
Yerel LLM, 3B–7B (nicemlenmiş)4–6 GB4–625–45 GBYalnızca-CPU, okunabilir hızda çalışır, toplu değil

Desen: API destekli ajanlar minik; ağır olan tek şey yerel modeller.

Bir CPU kutusu nerede durur

Tavan konusunda açık olalım: planlarımız 6 GB RAM ve 6 çekirdekte, yalnızca-CPU — GPU yok olarak son bulur. Bu, kişisel kullanım için bir 7B yerel model dahil yukarıdaki tablodaki her şeyi kapsar. Kapsamadığı şey: 13B+ modeller, yüksek çıktılı yerel çıkarım ya da gerçekten bir GPU gerektiren herhangi bir şey. İş yükün buysa, bir CPU VPS — bizimki ya da herhangi birininki — yanlış araçtır ve bunu dağıttıktan sonra değil, şimdi bilmek daha iyidir.

Bir API çağıran ajanların %95'i için bunların hiçbiri sorun değil. En küçük kutuda mutlular.

Pratik bir genel kural

Gerginlikten fazla-tedarik etme. Ajanlar doğaları gereği hafiftir; fazla küçük bir kutunun maliyeti bir yeniden boyutlandırma, fazla büyük bir kutunun maliyeti ise her ay boşta RAM için ödeme yapmaktır.

Bir boyut seçtiğinde, bir ajan kutuyu MCP üzerinden kendisi kiralayabilir ya da onu sitede bir dakikada sipariş edebilirsin. Her iki durumda da küçük başla — neredeyse kesinlikle beklediğinden azına ihtiyacın olacak.

SSS

Bir yapay zekâ ajanı ne kadar RAM ister?

Harici bir LLM API'si çağıran çoğu ajanın şaşırtıcı derecede azına ihtiyacı vardır — orkestrasyon döngüsü, bir kuyruk ve küçük bir veritabanı için 1–2 GB fazlasıyla yeter. Ağır iş (model) başkasının GPU'sunda çalışır. Yalnızca modeli yerel olarak çalıştırır ya da bellekte büyük veri tutarsan daha fazla RAM'e ihtiyacın olur.

Bir yapay zekâ ajanını çalıştırmak için GPU'ya ihtiyacım var mı?

Hayır, ajan barındırılan bir modeli bir API üzerinden çağırıyorsa — bu yalnızca-CPU işidir. Yalnızca büyük bir modeli kendin çalıştırmak için bir GPU'ya ihtiyacın var ve o zaman bile küçük nicemlenmiş modeller (3B–7B) CPU'da çalışır, sadece yavaş. Çoğu ajan iş yükü için bir CPU VPS doğru ve daha ucuz seçimdir.

Bir yapay zekâ ajanı için ne kadar disk alanı?

15–25 GB, çoğu ajan için işletim sistemini, kodunu, logları ve mütevazı bir veritabanını kapsar. Yalnızca kazınmış veri, gömme (embedding) ya da model dosyaları saklarsan daha fazla bütçele (tek başına bir 7B model ~4 GB).

Bir bot kaç CPU çekirdeği ister?

Bir ile iki çekirdek, her zaman açık tek bir botu ya da ajanı rahatça idare eder. Birkaç ajanı paralel çalıştırdığında, CPU-bağımlı iş yaptığında (ayrıştırma, hafif yerel çıkarım) ya da eşzamanlı isteklere hizmet ettiğinde 4+ çekirdeğe çık.

Bir yapay zekâ ajanını 7/24 çalıştırabilecek en küçük VPS nedir?

1 GB / 2 çekirdekli bir NAT kutusu, tipik her zaman açık bir ajanı ya da botu gayet iyi çalıştırır. Yalnızca yerel bir model, ağır eşzamanlılık ya da kendi IP ihtiyaçların eklendiğinde büyüt.

← Blog'a dönPlanları ve fiyatları gör →

Yorumlar

Henüz yorum yok. İlk olun.

Bir yorum bırakın

Yorumlar görünmeden önce denetlenir.