−25%

yıllık Windows ödemesinde, 31 Ekim'e kadar. Paketlere git

EQVPS

Bir VPS ne kadar RAM ister? İş yüküne göre gerçek rakamlar

26 Eyl 2026 · 3 dk okuma · EQVPS Team

Çoğu insan RAM'ini tahminle seçer. Ya “ne olur ne olmaz” diye fazlasıyla alır ya da OOM killer ile gece 3'te tanışır. Aslında bellek, boyutlandırması en kolay şeylerden biridir, çünkü kabaca rakamları bildiğinizde iş yükleri öngörülebilirdir. İşte bot için 1 GB'lık bir makineden, büyük bir modeli yerel olarak çalıştırmak isteyenlerin aradığı 64 GB'lık sunuculara kadar o rakamlar.

İş yüküne göre kabaca rakamlar

Bunlar tipik bir kurulum için kararlı durumdaki gerçek değerlerdir, üreticilerin minimum gereksinimleri değil.

İş yüküGerçekte kullandığı RAMUygun plan
Telegram/Discord botu (Python, Node.js)100–300 MBNano 1 GB
Statik site + Caddy/Nginx50–150 MBNano 1 GB
WordPress + MariaDB, normal trafik0,8–1,5 GBMicro-IP 2 GB
Küçük bir uygulama için PostgreSQL0,5–2 GB (shared_buffers ile siz belirlersiniz)Micro / Small
Birkaç iş akışıyla n8n0,5–1,5 GBMicro 2 GB
5–10 küçük hizmetli Docker sunucusu2–4 GBSmall 4 GB
Coolify + derlemeler + bir veritabanı3–4 GBSmall-IP 4 GB
7–8B LLM, 4 bit, CPU'da çıkarım5–6 GBMedium 6 GB
14B LLM, 4 bit~10 GBPro-32
32B LLM, 4 bit~20 GBPro-32
70B LLM, 4 bit~40–45 GBPro-48 / Pro-64

İki şey dikkat çekiyor. Birincisi, “normal” iş yükleriyle LLM'ler arasındaki sıçrama muazzamdır: bir botla 70B bir model arasında iki yüz katlık fark vardır. İkincisi, çoğu hizmet 1–4 GB ile gayet iyi çalışır; insanlar nadiren gelen bir gelecek için boyutlandırdıkları için fazla satın alır.

LLM formülü

Dil modelleri için basit bir tahmin vardır: parametre sayısı × ağırlık başına bit ÷ 8, artı ek yük. Yaklaşık 4,5 bitlik (tipik bir Q4 kuantizasyonu) 8B bir model 8 × 4,5 ÷ 8 ≈ 4,5 GB ağırlık eder. Bağlam penceresi (KV önbelleği bağlam uzunluğuyla büyür) ve çalışma ortamı için 1–2 GB ekleyin, 5–6 GB'a ulaşırsınız.

Dürüst kısım: yalnızca CPU'lu sunucularda bellek hikâyenin yarısıdır. Birkaç vCPU'da 7–8B modeller için saniyede tek haneli token, 70B için saniyede yaklaşık bir token bekleyin. Bu toplu işler, arka plan ajanları ve özel denemeler için yeterlidir; çok sayıda eşzamanlı kullanıcı için bir sohbet deneyimi değildir. Çoğunlukla barındırılan model API'lerini çağırıyorsanız ajanınızın çok daha azına ihtiyacı vardır: bkz. AI ajanları için VPS boyutlandırma.

Tahmin etmek yerine ölçün

Zaten bir sunucunuz varsa rakamlar hemen orada:

free -h                              # look at "available", not "free"
ps aux --sort=-rss | head -n 8       # the biggest processes, by resident memory
docker stats --no-stream             # per-container usage

Linux boştaki RAM'i disk önbelleği olarak kullanır, bu yüzden “free” her zaman küçüktür ve bu sağlıklıdır. Önemli olan available değeridir: çekirdeğin şu anda programlara verebileceği bellek. En yoğun saatinizde available ~%25'in üzerinde kalıyorsa boyutlandırma doğrudur. Düzenli olarak sıfıra iniyor ve swap büyüyorsa bir üst plana geçin.

Geçmişte OOM sonlandırmaları olup olmadığını da kontrol edin:

journalctl -k | grep -i "out of memory"

Swap: motor değil, emniyet kemeri

Küçük bir sunucuda 1–2 GB'lık bir swap dosyası ucuz bir sigortadır: kısa süreliğine daha fazla bellek isteyen bir paket güncellemesi veya Docker derlemesi sonlandırılmak yerine hayatta kalır. Ancak bir hizmet swap'ta yaşıyorsa her istek diski bekler. Swap ani yükselmeler içindir. Sürekli swap kullanımı, bir sonraki plana ihtiyacınız olduğu anlamına gelir.

Peki ne kadar almalısınız?

İçgüdünüzün söylediğinden bir boy küçükle başlayın, bir hafta boyunca free -h değerini izleyin ve rakamlar söylüyorsa yükseltin. EQVPS'te plan yükseltmesi verilerinizi korur ve yalnızca orantılı farkı tahsil eder (plan değişiklikleri nasıl çalışır).

SSS

Temel bir VPS ne kadar RAM ister?

Tek bir bot, küçük bir API veya statik bir site için 1 GB yeterlidir, çoğu zaman pay bile kalır. Bir veritabanı eklediğinizde veya işleri Docker'da çalıştırdığınızda rahat varsayılan 2 GB'tır. 1 GB'ın altında modern paket yöneticileri ve dil çalışma ortamları zorlanmaya başlar.

Bir VPS'te LLM çalıştırmak için ne kadar RAM gerekir?

Kabaca modelin kuantizasyondaki boyutu, artı bağlam için bir iki gigabayt. 4 bit bir 7–8B model yaklaşık 5–6 GB, 14B model yaklaşık 10 GB, 32B yaklaşık 20 GB ve 70B yaklaşık 40–45 GB ister. 64 GB'lık sunucuların var olma nedeni budur: yığınınızın geri kalanına da yer bırakarak 70B bir modeli sığdırırlar.

Swap, RAM'in yerini tutar mı?

Hayır. Swap kısa ani yükselmeler için bir güvenlik ağıdır: bir derlemenin veya yedeğin sonlandırılmasını önler. Bir iş yükü bütün gün swap'ta yaşıyorsa her şey yavaşlar; bu, bir üst plana geçme işaretidir.

Sunucumun gerçekte ne kadar RAM kullandığını nasıl görürüm?

'free -h' komutunu çalıştırın ve 'free' değil 'available' sütununa bakın: Linux boştaki belleği disk önbelleği olarak kullanır ve gerektiğinde geri verir. 'ps aux --sort=-rss | head' en büyük süreçleri, 'docker stats --no-stream' ise konteyner başına kullanımı gösterir.

64 GB'lık bir VPS ne zaman mantıklıdır?

Tek bir şeyin bellekte durması gerektiğinde: 32–70B yerel bir model, RAG için büyük bir vektör dizini veya kendi çalışma ortamlarına sahip bir ajan filosu. Web siteleri, botlar ve çoğu API için boşa harcanmış paradır.

← Blog'a dönPlanları ve fiyatları gör →

Yorumlar

Henüz yorum yok. İlk olun.

Bir yorum bırakın

Yorumlar görünmeden önce denetlenir.