حرّ الصيف — كل شيء يذوب، حتى أسعارنا.−25%−25% على كل خطة سنوية، حتى 31 أغسطسعرض الخطط
EQVPS

VPS لـ Ollama والنماذج اللغوية المحلية

استضف نماذج لغوية صغيرة ذاتيًا على خادم CPU — خاص، دون قياس، مدفوع بالعملات المشفّرة. صادق حول ما يستطيع استدلال CPU فعله وما لا. من 12$ شهريًا.

لنُنهِ الجزء المخيّب أولًا، لأن الإنترنت مليء بصفحات لا تفعل.

خوادمنا بمعالج فقط. لا نوفّر GPU. يعني ذلك أن عمل LLM المحلي هنا له سقف صارم، والتظاهر بخلافه سيهدر مالك فقط.

ما يعمل فعلًا على CPU

مع ما يصل إلى 6 vCPU و6 GB من الذاكرة (خطة Medium — 12$ شهريًا)، أنت في نطاق النماذج المكمّمة الصغيرة:

إن احتجت دردشة 70B تفاعلية سريعة، تحتاج مضيف GPU — ذلك منتج مختلف من مزوّد مختلف، ونفضّل إخبارك على أخذ 12$ منك.

أين يفوز خادم CPU فعلًا

الخصوصية. مستنداتك، مطالباتك، تضميناتك — لا تغادر جهازًا تتحكم به، ولا تصبح بيانات تدريب لأحد. للكثيرين هذا هو الهدف كله، وبضع رموز في الثانية مقايضة مقبولة.

تنبّؤ التكلفة. لا فاتورة لكل رمز. خط يصنّف خمسين ألف سجل يكلّف مثل واحد يصنّف خمسين: 12$.

العمل غير المتزامن. معظم عمل LLM المفيد ليس نافذة دردشة. إنه طابور: لخّص هذه، وسِم تلك، ضمّن هذا المتن. خادم CPU يطحن تراكمًا ليلًا جيّد تمامًا في ذلك.

الإعداد

# Ubuntu 24.04 — خطة Medium موصى بها
curl -fsSL https://ollama.com/install.sh | sh

# ابدأ بشيء صغير وارَ بنفسك
ollama pull llama3.2:3b
ollama run llama3.2:3b "Summarize this in one sentence: ..."

# التضمينات — النقطة المثالية لـ CPU
ollama pull nomic-embed-text
curl http://localhost:11434/api/embeddings \
  -d '{"model":"nomic-embed-text","prompt":"hello world"}'

يخدم Ollama واجهة HTTP على localhost:11434. أبقِها هناك. إن احتجت الوصول إليها من مكان آخر، ضعها خلف وكيل عكسي بمصادقة على خطة بـ IP مخصّص — لا تكشف نقطة نموذج دون مصادقة للإنترنت المفتوح أبدًا.

اقرنها بقاعدة بيانات متجهية (Qdrant أو pgvector في Docker) ولديك حزمة RAG خاصة كاملة على خادم واحد بـ 12$. ذلك المزيج — تضمينات محلية صغيرة، مخزن متجهي محلي، API خارجي فقط لخطوة التوليد الثقيلة — هو الإعداد المنطقي فعلًا على عتاد كهذا.

اختيار الخطة

الاستخدامالخطةالسعر
تضمينات، نماذج 1–3B، خط RAGMedium12$ شهريًا
نفسه، إضافة إلى نقطة عامة خلف مصادقةMedium-IP20$ شهريًا
مجرد اختبار نماذج صغيرةSmall8$ شهريًا

بمعالج فقط، حتى 6 vCPU و6 GB RAM. تخزين NVMe، حركة بيانات دون قياس، ألمانيا أو فنلندا. دفع بالعملات المشفّرة، بدون KYC. الفوترة السنوية تحويل واحد بدل اثني عشر.

قراءات ذات صلة


مستعدّ؟ انشر خادمًا ← — يعمل خلال دقيقة تقريبًا، مدفوع بالعملات المشفّرة، دون هوية.

Ready to deploy? Pay with crypto, no KYC — live in about a minute.

Deploy now →

FAQ

هل يمكنني تشغيل Llama 70B على هذا؟

لا. خططنا بمعالج فقط بذاكرة تصل إلى 6 GB — ذلك نطاق النماذج المكمّمة الصغيرة (تقريبًا 1B–8B بدقة 4-bit). نموذج 70B يحتاج GPU وذاكرة أكبر بكثير. لا نوفّر GPU، ونفضّل قول ذلك على بيعك خيبة أمل.

ما سرعة استدلال CPU فعلًا؟

توقّع بضع رموز في الثانية على نموذج 7–8B بتكميم 4-bit، وأفضل بوضوح على نماذج 1–3B. مناسب للمهام الخلفية والتضمينات والتصنيف والخطوط غير المتزامنة. غير مناسب لدردشة تفاعلية سريعة.

إذًا لأي شيء يصلح هذا فعلًا؟

تضمينات خاصة، تصنيف، طوابير تلخيص، خطوط RAG حيث لا يهمّ زمن الاستجابة، وإبقاء البيانات خارج واجهات API الخارجية. وأيضًا: التعلّم والاختبار والنمذجة قبل استئجار GPU في مكان ما.

هل تطلبون هوية؟

لا. بريد للتسجيل، USDC أو USDT للدفع. وهو غالبًا سبب رغبة الناس في نموذج خاص أصلًا.

التعليقات

لا تعليقات بعد. كن الأول.

اترك تعليقًا

تُراجَع التعليقات قبل ظهورها.