EQVPS

كيفية تثبيت Ollama على VPS (واستدعاء واجهته البرمجية)

ثبّت Ollama على VPS، اسحب نموذجاً صغيراً واستدعِ واجهته البرمجية عبر HTTP — مع الملاحظة الصريحة أن هذه أجهزة معالِج مركزي، فالتزم بالنماذج المُكمَّمة الصغيرة والتضمينات. أوامر جاهزة للنسخ واللصق، وكيفية كشفه بأمان.

يجعل Ollama تشغيل نموذج محلي عملية تثبيت من سطر واحد. هذا هو الدليل؛ للصورة الصريحة عمّا يستطيعه استدلال المعالِج المركزي وما لا يستطيعه (ونقطة RAG المثالية) راجع حالة استخدام VPS لـ Ollama واستضافة Ollama ذاتياً.

1. ثبّت Ollama

curl -fsSL https://ollama.com/install.sh | sh

يثبّت ذلك Ollama ويشغّله كخدمة systemd تستمع على localhost:11434.

2. اسحب وشغّل نموذجاً صغيراً

على جهاز بمعالِج مركزي، ابدأ صغيراً:

ollama pull llama3.2:3b
ollama run llama3.2:3b "Summarize this in one sentence: ..."

نماذج 3B قابلة للاستخدام حقاً على المعالِج المركزي؛ و7–8B تعمل ببضعة توكنات/ثانية (مقبول للدُفعات، مؤلم للدردشة)؛ و13B+ ستستخدم مبادلة الذاكرة وتزحف — لا تفعل.

3. استدعِ واجهة HTTP

curl http://localhost:11434/api/generate \
  -d '{"model":"llama3.2:3b","prompt":"ping","stream":false}'

التضمينات هي نقطة المعالِج المركزي المثالية:

ollama pull nomic-embed-text
curl http://localhost:11434/api/embeddings \
  -d '{"model":"nomic-embed-text","prompt":"hello world"}'

4. أبقِه على localhost — اكشفه بأمان عند الحاجة

يرتبط Ollama بـ 127.0.0.1:11434 افتراضياً. أبقِه هناك. إن احتجت للوصول إليه من جهاز آخر، ضع أمامه وكيلاً عكسياً بمصادقة على خطة IP مخصّص (دليل nginx + HTTPS) أو استخدم نفق SSH — لا تكشف أبداً نقطة نهاية نموذج بلا مصادقة علناً.

الجزء الصريح

هذه نسخ بمعالِج مركزي فقط (بلا GPU). النماذج المُكمَّمة الصغيرة والتضمينات تعمل جيداً؛ الكبيرة لا. اقرِن Ollama بـ قاعدة بيانات متجهات لمكدّس RAG خاص — تضمينات محلية صغيرة مع مخزن متجهات محلي هو الإعداد الذي يتألق هنا حقاً. Medium (12$ شهرياً، 6 غيغابايت) هي الخطة المريحة. root في نحو دقيقة، بلا KYC، والدفع بالعملات المشفّرة.

الأسئلة الشائعة

كيف أثبّت Ollama على VPS؟

أمر واحد: curl -fsSL https://ollama.com/install.sh | sh. ثم ollama pull لنموذج صغير وollama run له، أو استدعِ واجهة HTTP على localhost:11434. الخطوات في الأسفل. على VPS بمعالِج مركزي التزم بالنماذج المُكمَّمة الصغيرة (1B–8B) والتضمينات — النماذج الكبيرة تحتاج GPU.

هل ستكون النماذج سريعة على VPS بمعالِج مركزي؟

الصغيرة نعم، الكبيرة لا. توقّع بضعة توكنات في الثانية على نموذج 7–8B بتكميم 4 بت، وأداءً سريعاً بحق على نماذج 1–3B ونماذج التضمين. ممتاز للمهام الخلفية والتصنيف وأنابيب RAG — لا لدردشة تفاعلية سريعة على نموذج كبير.

هل أكشف واجهة Ollama البرمجية للإنترنت؟

لا. أبقِها على localhost:11434. إن احتجت وصولاً عن بُعد، ضعها خلف وكيل عكسي بمصادقة على خطة IP مخصّص، أو صِل إليها عبر نفق SSH. لا تكشف أبداً نقطة نهاية نموذج بلا مصادقة على الإنترنت المفتوح.

أي خطة أحتاج؟

خطة Medium لدينا (12$ شهرياً، 6 غيغابايت) تناسب النماذج الصغيرة والتضمينات بأريحية؛ وSmall (8$) تصلح لاختبار نماذج 1–3B. هذه نسخ بمعالِج مركزي فقط — بلا GPU — فحدّد الحجم ببصمة ذاكرة النموذج، لا بالأمل في السرعة.

هل تطلبون هوية أو بطاقة؟

لا. بريد إلكتروني للتسجيل، والدفع بـ USDC أو USDT — بلا مستندات، بلا بطاقة.

التعليقات

لا تعليقات بعد. كن الأول.

اترك تعليقًا

تُراجَع التعليقات قبل ظهورها.