دليل شراء خوادم GPU: كيف تحدد المواصفات وتشتري وتنشر عتاد الذكاء الاصطناعي
شراء البنية التحتية للذكاء الاصطناعي ووحدات معالجة الرسومات · نُشر 2026-07-25
شراء خادم GPU يتلخص في أربعة قرارات تُتخذ بالترتيب الصحيح: مطابقة فئة GPU مع حمل العمل، واختيار عامل الشكل (PCIe أو SXM)، والحسم بين الشرائح الجديدة والمجددة، واختيار منصة توفر ما تتطلبه وحدات GPU من طاقة وتبريد واتصال. إن أصبت الترتيب صار الباقي إجراءات شراء اعتيادية؛ وإن عكسته (المنصة أولاً وحمل العمل أخيراً) اشتريت إما جهازاً أكبر من حاجتك وإما جهازاً يُخنق أداؤه حرارياً.
هذا هو الدليل المحوري لسلسلتنا عن البنية التحتية للذكاء الاصطناعي ووحدات GPU. وهو يعكس الطريقة التي نحدد بها فعلياً مواصفات أنظمة GPU ونسعّرها للمشترين في AXISLINK، ويحيل إلى أدلة أعمق عن الأسعار وقواعد التصدير ومقارنات طرازات بعينها كلما صدرت تلك الأدلة.
لمحة سريعة
- حمل العمل يحدد فئة GPU؛ وكل ما عداه يتبع ذلك
- وحدات SXM تمنح نطاقاً ترددياً كاملاً للربط البيني؛ وبطاقات PCIe تقايض السرعة بالمرونة
- وحدات GPU المجددة لمراكز البيانات قد تخفض التكلفة بشدة إذا جرى التحقق من مصدرها
- العقدة المزودة بـ 8 وحدات GPU مشروع طاقة وتبريد، لا مجرد شراء خادم
- مسرعات الذكاء الاصطناعي المتقدمة تخضع لضوابط التصدير: خطط للامتثال قبل الطلب
- مدد التوريد تختلف باختلاف القناة؛ والسوق الثانوية تتحرك أسرع من طوابير التخصيص
ابدأ من حمل العمل لا من GPU
السوق تتحدث بأرقام طرازات GPU، لكن تحديد المواصفات يبدأ مما يجب أن تنجزه الآلة. مطابقة تقريبية كما تبدو في مشهد الجيل الحالي:
| حمل العمل | الأهم فيه | فئة GPU المعتادة |
|---|---|---|
| تدريب نماذج LLM وضبطها الدقيق | سعة الذاكرة، والنطاق الترددي للربط البيني، والتوسع عبر عدة وحدات GPU | مسرعات مراكز البيانات الرائدة (فئة H100/H200، بتصميم SXM) |
| استدلال LLM على نطاق واسع | سعة الذاكرة مقابل كل دولار، ومعدل المعالجة | فئة H100/A100 أو بطاقات استدلال بذاكرة كبيرة (فئة L40S) |
| نماذج Diffusion والتصيير والوسائط | قدرة الحوسبة الخام، وذاكرة VRAM، ومنظومة التعريفات | فئة L40S أو بطاقات محطات العمل (عائلة RTX 6000) |
| تعلم الآلة التقليدي والتحليلات والرؤية الحاسوبية | التكلفة لكل GPU، وبساطة العقدة الواحدة | بطاقات مراكز البيانات من الجيل السابق (A100 وحتى فئة V100) |
| VDI ومحطات العمل الافتراضية | نموذج الترخيص، والكثافة لكل بطاقة | وحدات GPU مصممة خصيصاً للمحاكاة الافتراضية |
نتيجتان عمليتان. الأولى: تظل رائدات الجيل السابق مفيدة حقاً؛ فعنقود A100 لا يزال قادراً على تدريب نماذج جادة وتقديم خدماتها، بجزء يسير من سعر الرائدات الحالية في السوق الثانوية. الثانية: شراء GPU أكبر مما يحتاجه حمل العمل لا يجعل أي شيء جاهزاً للمستقبل إذا تحول الربط البيني أو التخزين أو الشبكة إلى عنق الزجاجة أولاً.
PCIe أم SXM: مفترق عامل الشكل
الجيل نفسه من GPU يُطرح عادة بشكلين، وهذا الاختيار يرسم ملامح الخادم بأكمله.
| بطاقات PCIe | وحدات SXM | |
|---|---|---|
| التركيب | فتحات قياسية في كثير من طرازات الخوادم | ملحومة على لوحة أساس مخصصة (فئة HGX) |
| النطاق الترددي بين GPU وGPU | محدود؛ موصلات جسر في بعض الأزواج | ربط بيني شبكي كامل بنطاق ترددي مرتفع |
| الطاقة والتبريد | استهلاك أقل لكل بطاقة، ويمكن تبريدها بالهواء في 2U | أعلى استهلاك؛ ويلزمها هيكل مصمم خصيصاً |
| المرونة | إضافة البطاقات أو نقلها بين الأنظمة | تكوينات ثابتة من 4 أو 8 وحدات GPU |
| الاستخدام الأمثل | الاستدلال وأحمال العمل المختلطة والتوسع التدريجي | التدريب متعدد GPU حيث تؤتي كفاءة التوسع ثمارها |
القاعدة العملية الصريحة من واقع أعمال التسعير لدينا: آلات الاستدلال أحادية العقدة وأجهزة البحث المختلطة تكون عادة تجميعات PCIe؛ أما عناقيد التدريب الجادة متعددة GPU فهي تجميعات SXM، والعلاوة السعرية تشتري معدل تدريب حقيقياً لا رقماً في ورقة المواصفات.
جديد أم مجدد: ما الذي تقدمه السوق الثانوية فعلاً
تدخل وحدات GPU الخاصة بمراكز البيانات إلى السوق الثانوية عندما تجدد الشركات فائقة النطاق ومختبرات الذكاء الاصطناعي أساطيلها. هذا المعروض يجعل مسرعات الجيل السابق أرخص كثيراً من الرائدات الجديدة، وبه تتمكن فرق كثيرة من امتلاك قدرة حقيقية. ما يفصل شراء المجدد الجيد عن المقامرة:
- المصدر: من شغّل البطاقة، وفي أي بيئة، ولماذا أُخرجت من الخدمة
- الاختبار: نتائج burn-in لكل بطاقة على حدة لا لكل دفعة، مع فحوص الذاكرة والحرارة
- تصنيف الحالة مثبت كتابةً، مع صور فوتوغرافية للمخزون المستعمل
- الضمان: نافذة إرجاع معلنة من البائع، لأن تغطية الشركة المصنعة نادراً ما تنتقل
- حالة البرنامج الثابت والتراخيص: هناك بطاقات مقفلة أو مقيدة ببائع معين ويجب الإفصاح عنها
هذا عمل قائم على المصدر. والسبب الذي يجعل المشترين يمررون مشتريات المجدد عبر طرف تجاري خاضع للمساءلة بدلاً من إعلان في سوق إلكترونية هو أن التحقق والتصنيف وسبل الانتصاف هي المنتج الفعلي؛ فالشريحة واحدة في الحالتين. لهذا السبب تحديداً يعرض مخزوننا من وحدات GPU والمسرعات الحالة والتصنيف صراحةً.
المنصة: الخادم المحيط بوحدات GPU
وحدات GPU لا تعمل من تلقاء نفسها. وقرار المنصة هو الموضع الذي تنكسر فيه الميزانيات بصمت.
الهيكل والكثافة
الأشكال الشائعة: خوادم 2U تستوعب من 2 إلى 4 بطاقات PCIe؛ وأبراج وهياكل رفوف 4U/5U تستوعب من 4 إلى 8 بطاقات PCIe بتدفق هواء أفضل؛ ومنصات HGX مصممة خصيصاً بارتفاع 6U-8U تحمل 8 وحدات SXM (فئة Dell PowerEdge XE9680، وفئة HPE Cray، وأنظمة HGX من Supermicro). الهيكل الذي تتسع فيه البطاقات ليس هو نفسه الهيكل الذي يبردها تحت حمل متواصل.
الطاقة هي القيد الخفي
العقدة الرائدة المزودة بـ 8 وحدات GPU تسحب نحو 10 kW تحت الحمل. وهذا يتجاوز قدرة كثير من غرف الخوادم المكتبية ويشكل جزءاً معتبراً من ميزانية الرف في مركز الاستضافة المشتركة. قبل الطلب، تأكد من ميزانية طاقة الرف وسعة وحدات PDU، ومن سعة التبريد للحرارة المنتجة فعلاً، ومما إذا كان المرفق يحاسب حسب الطاقة المخصصة. وأكثر من مرة أعدنا تسعير مشترٍ من عقدة واحدة بـ 8 وحدات GPU إلى عقدتين بـ 4 وحدات GPU لمجرد حدود طاقة المرفق.
CPU والذاكرة والتخزين والشبكة
قواعد توازن تصمد عبر الأجيال: ذاكرة نظام تساوي على الأقل إجمالي ذاكرة GPU (وضعفها مريح للتدريب)؛ وتخزين مؤقت NVMe سريع بما يكفي لإبقاء وحدات GPU مغذاة بالبيانات؛ وللتدريب متعدد العقد نسيج شبكي (Ethernet عالي السرعة أو فئة InfiniBand) على قدر الطموح، لأن الربط البيني الجائع يترك الشرائح الباهظة عاطلة.
ضوابط التصدير: خطط للامتثال قبل أن تطلب
تخضع مسرعات الذكاء الاصطناعي المتقدمة لضوابط التصدير، وأبرزها قواعد Bureau of Industry and Security الأمريكي التي تقيد شحن وحدات GPU الأعلى فئة لمراكز البيانات إلى وجهات معينة. ما يعنيه هذا عملياً للمشتري:
- يختلف توافر المسرعات الرائدة باختلاف سوق الوجهة؛ والوجهات المقيدة لا يمكنها قانونياً استلام بعض وحدات SKU
- سيطلب البائعون معلومات المستخدم النهائي والاستخدام النهائي للطرازات الخاضعة للرقابة؛ فاعتبر ذلك علامة على طرف قانوني لا عائقاً
- اللوائح تتغير؛ ومجموعة القواعد السارية حالياً، لا ملخص العام الماضي، هي التي تحكم شحنتك
نقول هذا صراحة في شروطنا: قد تتطلب الطلبات معلومات المستخدم النهائي، ونرفض الصفقات التي لا يمكن تنفيذها قانونياً. ويفصّل دليل مخصص في هذه السلسلة تلك القواعد للمشترين في الخارج بعمق أكبر.
قنوات التوريد ومدد التسليم
ثلاث قنوات عريضة تورد أنظمة GPU. تخصيص OEM (طلب نظام مهيأ عبر قنوات Dell أو HPE أو Supermicro أو Lenovo) يمنح أنظمة جديدة مدعومة بالضمان، بمدد توريد تطول عندما يقفز الطلب. والسوق الثانوية وسوق المجدد تتحركان أسرع وتسعّران الأجيال السابقة بأسعار جذابة، مع اعتماد الجودة كلياً على التحقق. وشركات التجارة مثل شركتنا تعمل على الجانبين: توريد وحدات GPU والمنصات الجديدة أو المجددة، والتحقق منها وتجميعها، وشحنها مع وثائق التصدير من هونغ كونغ أو البر الرئيسي للصين. وأي قناة تفوز يعتمد على ما إذا كان قيدك هو الميزانية أم مدة التوريد أم تغطية الضمان.
مثال مفصل على مسار القرار
مشترٍ يريد الضبط الدقيق لنماذج مفتوحة متوسطة الحجم وتقديم خدماتها لبضعة آلاف من المستخدمين. مسار القرار: حمل العمل مزيج من التدريب والاستدلال؛ وسعة الذاكرة أهم من ذروة الربط البيني، لذا فإن من 4 إلى 8 مسرعات PCIe من فئة H100/A100 تتفوق على لوحة أساس SXM في التكلفة؛ وبطاقات A100 80GB المجددة الموثقة المصدر تخفض ميزانية الشرائح إلى النصف؛ والمنصة هيكل 4U بمزودات طاقة احتياطية وتخزين NVMe مؤقت؛ وفحص المرفق يؤكد أن الرف يستطيع تغذيتها. هذه مواصفة كاملة يمكن الدفاع عنها، وكل خطوة فيها حوار نجريه مع المشترين أسبوعياً.
الأسئلة الشائعة
ما الفرق بين خادم GPU والخادم العادي؟
خادم GPU مبني حول طاقة المسرعات وتبريدها: مزودات طاقة بقدرة أعلى، وتدفق هواء مصمم للبطاقات أو الوحدات تحت حمل متواصل، وبنية PCIe أو SXM لربطها. الخادم العادي قد يستوعب أحياناً بطاقة أو بطاقتين؛ أما خادم GPU فمصمم لطاقم كامل من البطاقات.
هل أشتري قدرة حوسبة GPU أم أستأجرها؟
الاستئجار يفوز في الأعمال المتقطعة أو الاستكشافية؛ والتملك يفوز عندما يكون الاستخدام متواصلاً، أو حين تهم جاذبية البيانات أو الخصوصية، أو حين تتجاوز أسعار GPU السحابية تكلفة العتاد المستهلكة على دورة تشغيلك. كثير من الفرق تستأجر للنماذج الأولية وتشتري للإنتاج. ودليل مستقل في هذه السلسلة يستعرض الحسابات بالتفصيل.
هل وحدات GPU المجددة لمراكز البيانات موثوقة؟
بطاقات مراكز البيانات مهندسة للتشغيل المتواصل، والبطاقات المسحوبة من الأساطيل بطريقة سليمة مع نتائج اختبار لكل بطاقة تدوم طويلاً في الخدمة. الخطر يتركز في المصدر والاختبار لا في فكرة الشريحة نفسها: اشترِ مخزوناً مصنفاً ومختبراً وموثقاً من بائع خاضع للمساءلة.
ما مقدار الطاقة التي يحتاجها خادم بـ 8 وحدات GPU؟
عقد SXM الرائدة بـ 8 وحدات GPU تسحب نحو 10 kW تحت الحمل؛ وتجميعات PCIe أقل، لكنها تظل أبعد كثيراً من تمديدات المكاتب العادية. تأكد من طاقة المرفق وتبريده قبل الطلب لا بعد التسليم.
هل يمكنني ترقية خادم بـ 4 وحدات GPU إلى 8 وحدات GPU لاحقاً؟
على منصات PCIe، فقط إذا صُمم الهيكل ومزودات الطاقة وتدفق الهواء لذلك منذ البداية. أما لوحات أساس SXM فهي تكوينات ثابتة. إذا كان النمو مرجحاً، فاشتر المنصة الأكبر بعدد أقل من البطاقات واملأها تدريجياً مع الوقت.
هل تورد هذه الأجهزة؟
تورد AXISLINK للمشترين التجاريين حول العالم من هونغ كونغ والبر الرئيسي للصين، مع وثائق التصدير وترتيب الشحن. أرسل متطلباتك واستلم عرض أسعار رسمياً، عادةً خلال 24 ساعة.
اطلب عرض سعر