استضافة الذكاء الاصطناعي للاستدلال وRAG ومنظومات الأتمتة

  • cPanel على CloudLinux
  • تخزين NVMe SSD
  • صلاحية جذر كاملة على Cloud VPS

حدّد ما يحتاج إليه تطبيق الذكاء الاصطناعي لديك فعلًا قبل أن تدفع مقابله.

معظم المنتجات التي توصف بأنها تطبيقات AI هي تطبيقات ويب عادية مع استدعاء HTTP واحد بطيء ومكلف في منتصفها. فالنموذج يعمل في مكان آخر. وما تستضيفه أنت فعليًا هو واجهة أمامية، وطابور مهام، ومخزن للتضمينات، وكومة من مفاتيح API. وهذا المزيج لا يتصرف أبدًا مثل موقع تعريفي، وهو السبب في أن كثيرًا من مشاريع AI الجانبية تُخنق أو تُعلَّق في شهرها الأول. وتوضح هذه الصفحة بصراحة أي أجزاء منظومة AI تعمل بسعادة على الاستضافة المشتركة لدى ElySpace، وأي أجزاء تحتاج إلى VPS سحابي بصلاحية الجذر، وأي أجزاء لا يستطيع أحد تشغيلها دون GPU.

ما يطلبه حمل الذكاء الاصطناعي من مزوّد الاستضافة

ستة متطلبات لا يفرضها موقع عادي أبدًا. اقرأها قبل أن تقارن الخطط، لأنها ما يفصل بين مشروع ذكاء اصطناعي يبقى عاملًا وآخر تحدّ استضافته نفسها من معدّل طلباته.

أيقونة إصدارات بيئة التشغيل المثبّتة

بيئة تشغيل يمكنك تثبيتها

تتعطل مكتبات AI عند الإصدارات الفرعية. فترقية طفيفة في المُجزّئ اللغوي أو في حزمة تطوير العميل قد تغيّر مخرجاتك بين ليلة وضحاها. أنت بحاجة إلى اختيار إصدار المفسّر وتجميد مجموعة التبعيات، لا أن ترث ما أُعيد بناء الخادم به الأسبوع الماضي.

أيقونة عملية معالجة في الخلفية

عمل يستمر بعد انتهاء الطلب

تضمين مجموعة مستندات، أو إعادة الفهرسة بعد الرفع، أو إعادة محاولة توليد فاشل: لا شيء من ذلك يتسع داخل طلب متصفح. مكانه في عامل معالجة يواصل العمل بعد أن يغلق الزائر التبويب، وهذا متطلب استضافة مختلف تمامًا.

أيقونة تخزين قاعدة بيانات المتجهات

مكان لحفظ المتجهات

يحتاج الاسترجاع إلى فهرس. وقد يكون pgvector داخل Postgres، أو ملف SQLite، أو محركًا مخصصًا مثل Qdrant أو Weaviate أو Milvus. كل منها يحتاج إلى ذاكرة وإلى قراءات عشوائية ثابتة، والإجابة الصادقة عن أيها سيناسبك تتوقف على عدد المستندات التي تُقسّمها إلى أجزاء.

أيقونة طلب API صادر بطيء

استدعاءات صادرة بطيئة عن قصد

استجابة API النموذج خلال ثماني ثوانٍ أمر طبيعي، لا عطل. أما خادم الويب لديك، ومهلة PHP أو Node، والوسيط، والمتصفح، فجميعها لا تتفق على ذلك. وجعل المُهل وإعادات المحاولة وإعدادات إبقاء الاتصال متوافقة هو معظم العمل في إطلاق ميزة AI.

أيقونة اتصال بث مستمر

اتصال يبقى مفتوحًا

البث رمزًا تلو الآخر يعني أن زائرًا واحدًا يحتجز اتصالًا طوال مدة الإجابة. وعشرة أشخاص يتحادثون في الوقت نفسه يعني عشرة اتصالات متزامنة لا تكاد تفعل شيئًا، وهو تحديدًا النمط الذي صُممت حدود التزامن في الاستضافة المشتركة لإيقافه.

أيقونة حماية مفتاح API السري

مفاتيح لا تصل إلى المتصفح أبدًا

مفتاح API النموذج داخل JavaScript الواجهة الأمامية هو فاتورة يستطيع شخص آخر تضخيمها. مكان المفاتيح في ملف خارج جذر الويب أو في ملف بيئة يرفض الخادم تقديمه، مع تمرير كل استدعاء عبر الواجهة الخلفية الخاصة بك حتى تتمكن من تحديد المعدل وتسجيل الاستخدام.

أين ينتمي كل جزء من منظومة الذكاء الاصطناعي

لا تستطيع أي شركة استضافة أن تضع كل عمود أدناه في خطة مبتدئة. وفرز مكوّناتك ضمن هذه السلال الثلاث أولًا سيوفّر عليك ترحيلًا لاحقًا.

يعمل جيدًا على استضافة cPanel المشتركة يحتاج إلى خادم VPS سحابي بصلاحية جذر يحتاج إلى وحدة معالجة رسومية أو واجهة API لنموذج
  • موقع منتجك ووثائقه وصفحات أسعاره
  • واجهة أمامية تستدعي واجهة API لنموذج مع كل طلب
  • شاشات التسجيل والمصادقة والفوترة
  • سجلات المطالبات والردود في MySQL
  • مهام دفعية عبر cron، بمعدل لا يتجاوز مرة كل 15 دقيقة
  • عمّال الطوابير والمجدولات التي تبقى مقيمة
  • قاعدة بيانات متجهية مستضافة ذاتيًا بعمليتها الخلفية الخاصة
  • نقاط websocket والأحداث المرسلة من الخادم
  • Docker وsystemd وإصدار Python الذي تختاره
  • زواحف ومهام استيعاب تبني الفهرس
  • تدريب نموذج خاص بك أو ضبطه الدقيق
  • تقديم نموذج كبير مفتوح الأوزان بزمن استجابة يناسب الدردشة
  • توليد الكلام أو الصور أو الفيديو في الوقت الفعلي
  • تضمين ملايين المستندات في تمريرة واحدة
  • أي شيء يبدأ دليل تثبيته بـ CUDA

مخازن المتجهات والمهل الزمنية
والمهام التي لا تنتهي

المشكلات الهندسية الثلاث الكامنة خلف معظم تذاكر الدعم التي نراها من فرق تعمل على استضافة تطبيقات الذكاء الاصطناعي.

تشريح منظومة RAG،
والجزء الذي يؤلم

منظومة الاسترجاع تتكوّن من أربعة أجزاء متحركة: مهمة استيعاب تقسّم مستنداتك المصدرية إلى مقاطع، واستدعاء تضمين يحوّل كل مقطع إلى متجه، ومخزن يحتفظ بهذه المتجهات، ومسار استعلام يجلب أقرب التطابقات ويمرّرها إلى النموذج. ثلاثة من هذه الأربعة زهيدة التكلفة. أما الاستيعاب فهو الجزء المؤلم، لأنه متقطع ومتفجّر، وقد يعمل لساعات، ويرهق التخزين أثناء عمله. ابنِه كمهمة يمكنك بدؤها وإيقافها واستئنافها من سطر الأوامر بدلًا من شيء يطلقه طلب ويب، وعندها يصبح ما تبقى من المنظومة استضافة مواقع عادية. والفرق التي تبني النمط نفسه بأدوات مرئية تقرن هذه الصفحة عادةً بـخطط أتمتة n8n المُدارة لدينا، حيث يكون محرّك سير العمل نفسه هو العملية طويلة التشغيل.

مخطّط لمهمة استيعاب تغذّي مخزن تضمينات ومسار استعلام

لماذا تكسر طلبات الذكاء الاصطناعي
المهل الزمنية الافتراضية لدى الجميع

أي عملية توليد تستغرق اثنتي عشرة ثانية سيقطعها شيء واحد على الأقل بين شيفرتك والزائر ما لم تذهب وتغيّر ذلك. فلدى PHP حد لزمن تنفيذ السكربت. ولدى LiteSpeed مهلة اتصال خاصة به. وCloudflare، الذي يقف أمام كل موقع لدى ElySpace، يغلق أي طلب لا ينتج بايتات لمدة طويلة. والحل ليس مهلة أطول في كل مكان: بل بثّ البايتات الأولى مبكرًا، أو قبول الطلب وتسليمه إلى عامل معالجة، وترك المتصفح يستعلم دوريًا أو يشترك لتلقي النتيجة. قرّر أي هذين النمطين تستخدم قبل أن تختار خطة، لأن البث يُبقي الاتصال مفتوحًا بينما الاستعلام الدوري لا يفعل.

رسم توضيحي لاستجابة خادم سريعة لإجابات الذكاء الاصطناعي المتدفّقة

حدود الاستضافة المشتركة،
بالأرقام، قبل أن تبدأ البناء

تنشر ElySpace سقوف استضافتها المشتركة بدلًا من إخفائها، وفي أعمال AI تكون الأرقام أهم من التسويق. فالخطط الأساسية محدودة بواسطة CloudLinux بالأرقام الواردة أدناه، والقواعد التالية سياسة لا تفضيلًا. وإذا اصطدم تصميمك بأي منها، فأنت أمام خادم VPS سحابي، ومعرفة ذلك الآن أرخص من معرفته بعد التعليق.

النص الكامل، بما في ذلك البنود المتعلقة بتطبيقات المحادثة الفورية وزواحف الويب، موجود في حدود موارد الاستضافة المشتركة لدينا. واقرأ بندَي المحادثة والعناكب على وجه الخصوص إذا كنت تخطط لروبوت دعم أو زاحف لجمع البيانات، لأن كليهما مذكور هناك ويُتوقع أن يعيش كلاهما في بيئة مخصصة.

  • 100% من نواة معالجة واحدة و1024 MB من الذاكرة في الخطط المبدئية
  • 10 عمليات دخول، وهي سقف التزامن الحقيقي لديك
  • معدّل إدخال وإخراج 10 MB/s و1024 IOPS، مشتركة مع قاعدة بياناتك
  • مهام cron بمعدل لا يتجاوز مرة كل 15 دقيقة
  • قد لا تتمكّن عمليات الويب من التفرّع أو إنشاء عمليات فرعية
لوحة تحكّم الخادم تعرض حدود الموارد وصلاحية الجذر

كيف تطلق تطبيق ذكاء اصطناعي
على ElySpace

أربع خطوات، بالترتيب الذي يتفادى إعادة العمل. والخطوة الأولى هي التي يتخطّاها الناس، وهي التي تحدّد كل ما عداها.

01

صنّف المكوّنات

ضع كل مكوّن من مكوّنات تطبيقك في أحد الأعمدة الثلاثة أعلاه. العمود الأثقل هو الذي يحدد الخطة.

02

اختر الخطة

البناء الذي يقتصر على الواجهة الأمامية يناسب الاستضافة المشتركة. أما أي شيء مقيم في الذاكرة أو يعمل بالحاويات أو يبث، فيبدأ على VPS سحابي.

03

انشر وثبّت الإصدارات

ادفع الشيفرة عبر Git، وثبّت إصدارات اعتمادياتك، وضع المفاتيح في ملف لن يقدّمه الخادم للزوار، وجدول المهام.

04

راقب المؤشرات

يعرض cPanel استهلاكك الحي من CPU والذاكرة وعمليات الدخول. ارتقِ إلى خطة أعلى قبل أن يستوي الرسم البياني عند السقف.

GPU أو CPU: السؤال الذي تخطئ فيه معظم مشاريع AI

على الأرجح أنك لا تحتاج إلى GPU. لكنك تحتاج بالتأكيد تقريباً إلى صلاحية root.

لا يلزم GPU إلا حين تكون أوزان النموذج على جهازك أنت. أما إن كنت تستدعي نموذجاً مستضافاً عبر API، فإن كل عملية تنسور ثقيلة تجري في مركز بيانات شخص آخر، بينما يقوم خادمك بمعالجة النصوص وتحليل JSON والكتابة في قاعدة البيانات. هذا عمل CPU، وعدد قليل من الأنوية الافتراضية يكفي إلى حد بعيد. والمكان الذي تتعثر فيه الفرق فعلاً ليس القدرة الحوسبية بل الصلاحيات: فهي تحتاج إلى تشغيل خدمة daemon، أو فتح منفذ، أو تثبيت حزمة نظام، أو إبقاء عملية حية، ولا يسمح لها بذلك أي حساب مشترك في أي مكان. لهذا فإن مسار الترقية الواقعي لمشروع AI هو خادم سحابي قابل للتوسع أو خطة VPS بصلاحية root بدلاً من عتاد استثنائي. وإن كان مشروعك يحتاج فعلاً إلى تهيئات معجَّلة بـ GPU، فهي ليست ضمن خطط ElySpace المنشورة، لذا تحدّث إلى فريقنا عمّا تحاول تشغيله وسنخبرك بصراحة ما إذا كان بإمكاننا المساعدة.

خادم افتراضي بأنوية وذاكرة مخصصة لأحمال عمل تطبيقات AI
أخبرنا بما تبنيه

لست متأكدًا في أي عمود يقع مشروعك؟

أرسل إلينا شكل منظومتك التقنية: إطار العمل، وواجهة API للنموذج التي تستدعيها، وما إذا كان أي مكوّن يحتاج إلى البقاء مقيمًا في الذاكرة، وعدد المستندات التي تفهرسها تقريبًا. سنخبرك أي خطة من ElySpace تناسبك، وكذلك — وهو أمر لا يقل فائدة — متى لا تناسبك. الدردشة المباشرة والتذاكر متاحة على مدار الساعة طوال أيام الأسبوع، والترحيل المجاني ينطبق إذا كنت تنقل تطبيق AI عاملًا من مضيف آخر. وكل خطة مشمولة بالتزام وقت التشغيل بنسبة 99.9% المنصوص عليه في اتفاقية مستوى الخدمة لدينا، وتعمل على LiteSpeed Enterprise وCloudLinux وcPanel وImunify360 وJetBackup وتخزين NVMe SSD. وإذا كنت تفضّل البدء بالأساسيات، فإن نظرتنا العامة على استضافة cPanel تغطي المنصة المشتركة، بينما تناسب الخطط ذات الأنوية المخصصة واجهة أمامية مزدحمة بالفعل.

تحدّث إلى مهندس افتح تذكرة
مهندس دعم من ElySpace يراجع منظومة تطبيق

اقرأ تقييمات عملائنا

هذا يكفي منا على الأرجح، سندع عملاءنا يتحدّثون، ومع أكثر من 2000 تقييم على Trustpilot وFacebook، اطّلع بنفسك على سبب ثقتك بنا لتشغيل موقعك.

الأسئلة الشائعة حول استضافة الذكاء الاصطناعي

استضافة AI هي استضافة ويب عادية مُحجَّمة لثلاث عادات غير معتادة. فتطبيق AI يجري استدعاءات خارجية بطيئة قد تستمر ثوانيَ عديدة، وكثيرًا ما يحتاج إلى عملية تواصل العمل بعد أن يغادر الزائر، وهو يخزّن متجهات تضمين تُقرأ باستمرار. أما الموقع التعريفي فلا يفعل شيئًا من ذلك. والبنية التحتية تحته هي منصة LiteSpeed وCloudLinux وcPanel وNVMe نفسها التي نشغّلها لكل عميل. ما يتغير هو الخطة التي تحتاجها وطريقة بناء التطبيق فوقها.

الأمر يعتمد كليًا على ما يفعله التطبيق، لا على لغة البرمجة. السكربت الذي يرسل طلبًا ويستقبل ردًا من واجهة API لنموذج ما ثم يكتب في MySQL خيار مناسب. أما خدمة Python التي تتوقع الارتباط بمنفذ خاص بها أو العمل تحت systemd أو إنشاء عمليات عاملة فليست مناسبة، لأن الحسابات المشتركة لا تملك صلاحية الجذر ولا يُسمح لعمليات الويب بالتفرّع أو إنشاء عمليات فرعية. افتح تذكرة دعم موضحًا متطلباتك قبل الشراء وسنؤكد لك أي المفسّرات والمحدِّدات مفعّلة في الخطة التي تنظر إليها.

التهيئات المسرَّعة بوحدات GPU ليست خطة منشورة لدى ElySpace. فتشكيلاتنا المشتركة والسحابية وVPS قائمة على CPU، وهو الشكل الصحيح للتطبيقات التي تستدعي نموذجًا مستضافًا عبر API بدلًا من تشغيل الأوزان محليًا. وإذا كان مشروعك يحتاج فعلًا إلى استدلال محلي أو ضبط دقيق، فتواصل مع فريقنا، وصف النموذج وزمن الاستجابة الذي تحتاجه، وسنخبرك بصراحة ما إذا كان بإمكاننا تجهيز شيء مناسب أم أن مصلحتك في مكان آخر. فنحن نفضّل أن نقول لا على أن نبيعك خادمًا لا يستطيع أداء المهمة.

نعم، على VPS سحابي، حيث تملك صلاحية الجذر ويمكنك تثبيت المحرّك كخدمة. فأنظمة Qdrant وWeaviate وMilvus وPostgres مع pgvector تعمل جميعها كعمليات خفية خاصة بها وتحتاج إلى عملية دائمة، لذا مكانها VPS لا حساب مشترك. وإذا كان متنك النصي صغيرًا، فسيعمل فهرس مدعوم بملف مثل SQLite أو ملف متجهات مسطّح داخل مجلد تطبيقك على الاستضافة المشتركة، وفق حدود الإدخال والإخراج وعُقد الملفات نفسها التي تنطبق على أي ملف آخر. وحدّد حجم الذاكرة وفق فهرسك، لا وفق عدد مشاهدات صفحاتك.

لا. خطّط لعمليات تشغيل مجدولة بدلًا من خدمة دائمة مقيمة. فالحسابات المشتركة لا تملك صلاحية الجذر ولا systemd ولا مشرف عمليات، لذا لا شيء يبقي عاملًا طويل العمر حيًا أو يعيد تشغيله بعد إعادة تشغيل الخادم. ما تحصل عليه فعلًا هو cron في cPanel، وهو لا يمكن أن يعمل أكثر من مرة كل 15 دقيقة. وهذا كافٍ لإعادة الفهرسة الليلية أو لدفعة تفرّغ طابورًا وفق جدول. لكنه غير كافٍ للمعالجة شبه الفورية. وإذا كان منتجك يعد بنتيجة خلال ثوانٍ، فإن العامل يحتاج إلى خادم VPS.

تعامل مع أي اتصال دائم على أنه ميزة خاصة بـ VPS. فعلى خادم بصلاحية جذر تتحكم أنت بخادم الويب وإعدادات الوكيل والمنافذ، فتكون websockets والأحداث المرسَلة من الخادم من اختصاصك لتهيئتها. أما على الاستضافة المشتركة، فكل اتصال مفتوح يُحتسب ضمن مخصص صغير لعمليات الدخول، فقد تستنزف حفنة من المحادثات المتزامنة الخطة كلها مع استهلاك شبه معدوم للمعالج. فإذا كان البث محوريًا في واجهتك، فابدأ على VPS سحابي. وإذا كان مجرد ميزة مستحسنة، فارجع إلى الاستعلام الدوري عن النتيجة وستكفيك الاستضافة المشتركة.

حركة المطالبات والاستجابات نصية، ولذلك يكون حجمها تافهًا عادةً. فالمحادثة الطويلة تُقاس بالكيلوبايتات، وآلاف منها لن تُرهق خطة استضافة. والاستثناء هو الوسائط: فرفع ملفات صوتية للتفريغ النصي، أو تمرير صور عبر نموذج رؤية، ينقل بايتات حقيقية في الاتجاهين وينبغي تقديره بشكل صحيح. وأي شيء يحتاج إلى منفذ صادر غير معتاد بدلًا من HTTPS القياسي ينبغي طرحه على الدعم أولًا، لأن المنصات المشتركة تقيّد المنافذ الصادرة افتراضيًا.

اقرأ بند المحادثة في سياسات استخدام الموارد لدينا قبل أن تبني التطبيق. فتطبيقات المحادثة التفاعلية الفورية مذكورة هناك بوصفها محظورة على الاستضافة المشتركة، إلى جانب عناكب الويب وأدوات الفهرسة، وتنص السياسة على أن أعباء العمل من هذا النوع مكانها بيئة مخصصة. ويشمل ذلك روبوت الدعم المستضاف ذاتيًا كما يشمل الزاحف الذي قد تكتبه لتغذيته. ضع كليهما على خادم VPS سحابي. أما الأداة التي ترسل نموذجًا وتعرض إجابة فهي شيء مختلف، ولا مانع من تشغيلها على الاستضافة المشتركة.

لا تضعها أبدًا في JavaScript الواجهة الأمامية، ولا داخل جذر المستندات دون قاعدة منع. احتفظ بالمفاتيح في ملف مخفي أو في مجلد أعلى من public_html، وتأكد من أن ملف .htaccess لديك يمنع الطلبات الموجَّهة إلى أسماء الملفات التي تبدأ بنقطة حتى لا يُقدَّم ملف البيئة أبدًا. ومرّر كل استدعاء للنموذج عبر الواجهة الخلفية الخاصة بك حتى تتمكن من تحديد معدله وتسجيله وتدوير المفتاح دون إعادة نشر أي عميل. إن Imunify360 وجدار حماية المنصة يحميان الخادم؛ أما المفتاح فلا يحميه سوى تصميم تطبيقك.

ستصل إلى سقف عمليات الدخول قبل وقت طويل من وصولك إلى سقف المعالج. فطلبات AI تقضي معظم عمرها في انتظار واجهة API خاصة بطرف آخر، لذا يُظهر الرسم البياني في cPanel تراكم الاتصالات بينما يبقى المعالج خاملًا. راقب مقياس عمليات الدخول، لا مقياس المعالج. وحين يبدأ في الاستواء، انقل التطبيق إلى خادم VPS سحابي بأنوية مخصصة وأبقِ الواجهة الأمامية الثابتة في مكانها. الترحيل المجاني مشمول، ويمكن لفريقنا نقل الملفات وقواعد البيانات وإدخالات cron نيابةً عنك.