Supermicro
طراز: AS-8126GS-NB3RT
اطلب عرض سعر للخادم الخاص بك
اخبرنا عن عبء عملك واحتياجات النشر الخاصة بك. يرد أخصائينا خلال 24 ساعة عبر البريد الإلكتروني أو WhatsApp أو الهاتف.
لماذا يُقتبس هذا الخادم للطلب فقط
تم تكوين وعرض هذه الخوادم حسب الطلب. يحدد بناءك، التخزين، الشبكة، الضمان، وتكامل الرف السعر النهائي، ويحدد وجهة تسليمك الشحن والجمارك. قدم النموذج أدناه وسيرد عليك متخصصنا خلال 24 ساعة بعرض كامل يشمل العتاد، الضمان، والتوصيل DDP العالمي.
شكراً لك! سيقوم مختصونا بالرد خلال 24 ساعة مع عرض السعر المخصص لك.
كيف تعمل عملية طلب الخادم الخاص بك
إرسال النموذج
مشاركة تفاصيل عبء العمل والنشر
احصل على عرض السعر الخاص بك
الأسعار الكاملة خلال 24 ساعة
مراجعة مع متخصص
إكمال التكوين والتسليم
التوصيل
تم الشحن وهو جاهز للنشر
حقيقي
الأجهزة المختبرة
عالميًا
الشحن العالمي
الدعم
خبراء التعدين
منصة Supermicro 8U A+ لبطارية NVIDIA HGX B300 NVL8: ثمانية معالجات جرافيكس Blackwell Ultra B300 SXM مع 288 جيجابايت من HBM3e لكل منها، تجمع بين 2.3 تيرابايت من ذاكرة GPU لكل عقدة خلف ربط NVLink والإصدار الخامس من NVSwitch، مع منافذ شبكة سعة 800 جيجابت/ثانية مدمجة مباشرة على اللوحة الأساسية. معالجان من نوع AMD EPYC 9005 أو 9004، حتى 6 تيرابايت من DDR5 6400، ثماني حاويات NVMe من نوع E1.S، وستة مصادر طاقة Titanium بقوة 6600 واط. عقدة الاستدلال والتدريب من حقبة التفكير، معروضة ومُشحنة عالميًا DDP بواسطة MillionMiner.
التسعير، وقت التنفيذ، وخيارات الاستضافة. نصيحة شخصية من فريق المبيعات لدينا.
التسعير، وقت التنفيذ، وخيارات الاستضافة. نصيحة شخصية من فريق المبيعات لدينا.
يعد Blackwell Ultra الجيل الأول من وحدات معالجة الرسوميات (GPU) التي تم تصميمها بعد أن تعلمت الصناعة مدى تكلفة نماذج الاستدلال في تقديم الخدمات. أجاب B200 على سؤال التدريب؛ وB300 يجيب على سؤال عصر الاستدلال الذي تبعه، والتغييرات هنا محددة وليست تجميلية فقط. منصة Supermicro A+ هذه هي العقدة التي تحتوي على 8 وحدات معالجة رسومية من نوع NVIDIA Blackwell Ultra B300 SXM. يجمع مجمع GPU على اللوحة الأساسية HGX B300 NVL8 ثمانية وحدات معالجة رسومية من نوع NVIDIA Blackwell Ultra B300 SXM، كل منها يحتوي على 288 جيجابايت من HBM3e، أي 60 بالمئة أكثر من B200، مما يسمح بتجميع 2,304 جيجابايت عبر العقدة. ينضم NVLink من الجيل الخامس إلى كل وحدة معالجة رسومية بسرعة 1.8 تيرابايت/ثانية عبر NVSwitch في شبكة كاملة. تصنف NVIDIA معدل throughput الكثيف لـ FP4 للعقدة B300 عند 1.5 ضعف معدل B200، مع زيادة مركزة تماما حيث يوجد استضافة الأحجام الكبيرة، والسبب في ذلك هو أن محرك Transformer من الجيل الثاني: المقياس micro-tensor هو الذي يجعل الاستنتاج ذو الأربعة بتات يحتفظ بدقة الإنتاج. يظل عرض النطاق الترددي للذاكرة لكل وحدة معالجة رسومية ضمن فئة 8 تيرابايت/ثانية؛ السعة هي العنوان الرئيسي، لأن السعة هي ما تنفذه عبء العمل في الاستدلال أولاً. لماذا تحدد السعة عصر الاستدلال. نموذج يفكر قبل الإجابة يولد رموزًا داخلية، وكل واحد منها يحتل مخزن KV طوال مدة الاستجابة. تتضاعف آثار تتبع الاستدلال الطويل، والنوافذ السياقية الممتدة، والخدمة بتزامن عالٍ. على العقد الصغيرة، يكون الناتج هو التحميل الزائد، أو انهيار حجم الدُفعة، أو كليهما، وتنخفض هوامش الخدمة معها. عقدة بسعة 2.3 تيرابايت تحتوي على أوزان على مستوى الحدود الأمامية والمؤشرات المؤقتة التي تولدها في آنٍ واحد، وهذه هي الفارق بين نموذج يناسب وبيئة نشر تربح.
النسيج المدمج، وما يغيره في الهيكل. تحمل لوحة الأساس HGX B300 NVL8 شبكتها الخاصة: ثمانية منافذ OSFP بسرعة 800 جيجابت/ثانية، واحدة لكل وحدة معالجة رسومية، وهو ضعف معدل كل منفذ من محولات الإضافة من الجيل السابق. لهذا السبب، تظهر ورقة المواصفات فقط منصتين للتمديد PCIe 5.0، حيث كانت أنظمة فئة B200 تحتوي على اثنتي عشرة منصة؛ كانت المنصات الاثنتي عشرة تستخدم لاستضافة NICs، وتلك NICs الآن موجودة على اللوحة الأساسية. بالنسبة لنشر العقد المتعددة، فإن النتيجة هي بنية أكثر نظافة، ونسيج أسرع، وتصميم موثوق لتوصيل GPUDirect RDMA مضمون بدلاً من التركيب حسب الطلب. المنصتان المتبقيتان تستضيفان التخزين وشبكة الإدارة.
الخادم Supermicro. المعالجان AMD EPYC 9005 أو 9004، حتى 192 نواة لكل مقبس على خط 9005، يوفران عمليات ما قبل المعالجة، والتوكن، وتحميل البيانات التي تتطلبها ثماني وحدات معالجة رسومية من هذا الطراز. تملأ 24 وحدة DDR5 بسرعة 6400 MT/ثانية منصة واحدة لكل قناة عبر اثني عشر قناة لكل معالج، وتتوفر بسعة تصل إلى 6 تيرابايت، مع الحفاظ على كامل عرض النطاق الترددي، بينما تكون بعيدًا عن تجمع وحدات معالجة الرسومات، وهو قاعدة الحجم التي يشرحها هذا الكتالوج، مع وجود مساحة كافية. تحتوي ثمانية فتحات NVMe أمامية قابلة للتبديل السريع من نوع E1.S على مجموعات البيانات على العقدة، وستة مزودات طاقة Titanium بقوة 6600W بدلًا من ذلك، في ترتيب متكرر، وتحدد غلاف طاقة غير غامض ما إذا كانت هذه آلة مركز البيانات من فئة التهوية بالهواء من عقدة واحدة.
القرار بعدم اختيار HGX B200 في هذا الكتالوج. تقدم وحدة Gigabyte B200 سعة 1.4 تيرابايت ونفس جيل NVLink، ولبرامج التدريب وفرق الخدمة التي تعمل ضمن تلك السعة الذكرية، يبقى الاختيار المنطقي هو Blackwell. يثبت B300 مكانته في ثلاث حالات: فرق الاستدلال والاستنتاج ذات السياق الطويل، حيث عمق ذاكرة KV يحدد حجم الدُفعة، وبالتالي الاقتصاد الوحدوي، والنشر الذي يخدم نماذج الحدود، والتي تتجاوز 1.4 تيرابايت، والمشغلين الذين يقومون بتوحيد الشبكة المدمجة بسرعة 800 جيجابت/ثانية لنمو العقد المتعددة. أدنى من تلك العتبات، يكسب B200 من حيث الاقتصاديات؛ عندها، يعتبر B300 هو العقدة الوحيدة التي تتفق مع متطلبات الأداء.
القرار بعدم الاعتماد على النطاق الرأسي للرفوف. فوق هذه الآلة، توجد أنظمة فئة GB200 وGB300، حيث تتقاسم 72 وحدة معالجة رسومية NVLink واحدة ضمن تبريد سائل وهندسة مرفق متطابقة. الحد الفاصل لم يتغير: إذا كانت عملية التدريب تتطلب أكثر من ثماني وحدات معالجة رسومية من نوع Blackwell Ultra ضمن نطاق متماسك واحد، فإن النطاق الرأسي هو الحل. بالنسبة لكل شيء يناسب ثماني وحدات معالجة رسومية من نوع Blackwell Ultra، والذي يشمل الآن استضافة أكبر النماذج المنتشرة، تقدم هذه العقدة الجيل بدون مشروع مرفق، وتقوّي من انتشارها عبر شبكتها المدمجة بسرعة 800G.
الامتثال للتصدير والطلب. تكون المسرعات من فئة Blackwell خاضعة لقيود التصدير الأمريكية، وتؤكد MillionMiner على أهلية الوجهة في كل عرض. يتم تكوين كل نظام حسب الطلب، ويتم اختباره وشحنه عالميًا DDP مع معالجة الضرائب والجمارك. تتوفر خدمة تخطيط النشر والاستضافة في مراكز بيانات MillionMiner الخاصة لفرق تفضل عدم تزويد طاقة الرفّ في الموقع على هذا النطاق.
تغيرت اقتصاديات الاستنتاج عندما بدأت النماذج في التفكير. فاستجابة سلسلة الأفكار تستهلك عشر إلى مئة مرة من الرموز مقارنة بالإجابة المباشرة، كل أثر للتفكير يزيد من مخزن KV، وخدمة ذلك بشكل مربح لم تعد مشكلة حسابية بل أصبحت مشكلة ذاكرة ودقة. جهاز Blackwell Ultra هو الجواب المباشر من NVIDIA، وهذه المنصة Supermicro تتوفر في شكلها ذو الـ 8-GPU. الحل المعتمد على الذاكرة: 288 جيجابايت من HBM3e لكل GPU، أكثر بنسبة 60 في المئة من 180 جيجابايت الموجودين في B200، مع تجميع 2.3 تيرابايت عبر العقدة. تلك القدرة الإضافية هي ما يسمح لنماذج المتحديّة بالوقوف جنبًا إلى جنب مع سجلات KV الطويلة التي تولدها عمليات التفكير ونوافذ السياق الموسعة، دون الاعتماد على التمرير الخارجي الذي يقتل زمن الاستجابة للخدمة. الحل الدقيق: NVIDIA يقيّم الـ B300 من حيث الكثافة في FP4 عند 1.5 ضعف الـ B200، مع معدل تمرير يركز بشكل مباشر على الاستنتاج عالي الحجم حيث يضمن تقديم الأربعة-bit مع التشدّد على المايكرو-تنصير دقة ويخفض التكلفة لكل رمز إلى النصف. الحل التصميمي: لوحة الأساس HGX B300 NVL8 تتضمن ثمانية منافذ OSFP بسرعة 800 Gb/s مباشرة، واحدة لكل GPU بسرعة مضاعفة مقارنة بالجيل السابق، ولهذا السبب يحتاج هذا الهيكل فقط إلى مَفَاتِيح توسعة PCIe اثنين، في حين أن أنظمة الـ B200 كانت بحاجة إلى اثني عشر. الشبكة العنقودية للربط لم تعد مجرد إضافة، بل أصبحت جزءًا من مجمع الـ GPU. المضيف من Supermicro يحافظ على النسب الصحيحة. معالجان AMD EPYC من السلسلة 9005 أو 9004 يصلان إلى 192 نواة لكل مقبس للخطوط المعالجة الثقيلة، و24 وحدة DDR5 بسرعة 6400 MT/s تصل إلى 6TB، وهو أعلى بكثير من تجمع الـ GPU البالغ 2.3TB، و8 حاويات NVMe قابلة للتبادل من الأمام E1.S تحافظ على مجموعات البيانات محلية. وتدعم ست وحدات إمداد طاقة Titanium بقدرة 6600W بشكل متزامن، مع مراعاة التكرار، وتحمل الحزمة. معروض حسب التكوين ويتم شحنها عالميًا DDP بواسطة MillionMiner.
يمكن لخبرائنا في التعدين مساعدتك في العثور على المُعدِّن المثالي لنظامك وميزانيتك.
أكبر مجموعة ذاكرة لعقدة واحدة في هذا الكتالوج: ثماني وحدات معالجة رسومات NVIDIA Blackwell Ultra B300 SXM بسعة 288 جيجابايت من HBM3e لكل منها، 2.3 تيرابايت لكل عقدة، مربوطة بواسطة NVLink من الجيل الخامس بسرعة 1.8 تيرابايت/ثانية لكل GPU عبر NVSwitch. تقيم NVIDIA كثافة FP4 لل B300 بأنها 1.5 مرة أكثر من B200، وتدمج لوحة الأساس HGX B300 NVL8 شبكتها الخاصة بسرعة 800 جيجابت/ثانية، وثمانية منافذ OSFP، بحيث لا تتطلب التجمّعات بطاقات إضافية. يستضيفها Supermicro بمعالجات AMD EPYC 9005 أو 9004 ثنائية مع سعة تصل إلى 6 تيرابايت من DDR5 6400، وثمانية حاويات NVMe E1.S، وستة مصادر طاقة Titanium بقوة 6600 واط في حاوية 8U. معروض ويشحن عالميًا وفقًا لنظام DDP من قبل MillionMiner.
ثمانية وحدات معالجة الرسوميات Blackwell Ultra B300 SXM بسعة 288 جيجابايت لكل منها، بزيادة 60 بالمائة عن B200. تتوافق ذاكرات الكاش ذات المقاييس وأوزان Frontier مع بعضها البعض.
تقيم NVIDIA كثافة FP4 بنسبة 1.5 ضعف B200. خدمات سلسلة الأفكار، والسياق الطويل، والاتصال العالي التزامن هي ما يحدد سعر هذه العقدة بشكل صحيح.
ثمانية منافذ OSFP مدمجة بسرعة 800 جيجابت/ثانية، واحدة لكل وحدة معالجة رسومات. يُصمم التجميع مدمجًا وليس مضافة، ويعمل النسيج بسرعة مضاعفة عن المعدل السابق.
HGX B300 NVL8 هو الركيزة الأساسية من NVIDIA التي تحتوي على ثمانية وحدات معالجة رسومات Blackwell Ultra: ثمانية وحدات SXM B300، ونسيج NVSwitch الذي يربطها بسرعة 1.8 تيرابايت/ثانيه لكل منها، ومنافذ شبكة مدمجة بسرعة 800 جيجابت/ثانية، تُورد لمصنعين مثل Supermicro. مقارنة بـ B200، ترتفع الذاكرة بنسبة 60 في المئة لتصل إلى 288 جيجابايت من HBM3e لكل وحدة، وتقييم NVIDIA للنفاذ الكثيف FP4 هو أعلى بمقدار 1.5 مرة، وتضاعف منافذ النسيج إلى 800 جيجابت/ثانية مع انتقالها إلى لوحة الأساس ذاتها.
2,304 جيجابايت من الHBM3e المجتمعة عبر ثمانية وحدات GPU، الجيل الخامس من NVLink بسرعة 1.8 تيرابايت/ثانيه لكل GPU عبر NVSwitch، قدرة عالية على المعالجة FP4 من NVIDIA تقدر بمقدار 1.5 مرة من HGX B200، وثمانية موانئ نسيج مدمجة بسرعة 800 جيجابت/ثانيه. من حيث عبء العمل: نماذج على مستوى الحدود تتوفر مع مساحة رأس كاملة للذاكرة المؤقتة KV، ونماذج فيها مئات المليارات من المعايير تتFine-tune بدقة كاملة في عقدة واحدة، وأسطول استنتاج يحمل حجم دفعات يمكن أن تنهار به مجموعات الذاكرة الصغيرة.
لأنها تضاعف عدد الرموز المشفرة. النموذج الذي يفكر قبل الإجابة يُولد سلاسل فكر داخلية، كل رمز منها يحتل ذاكرة التخزين المؤقت KV طوال مدة الاستجابة، وتوسعات السياقات الطويلة والتزامن العالي تضاعف الأثر بشكل أكبر. عندما تنفد ذاكرة GPU من التخزين المؤقت، يعود تقديم الخدمة إلى التحميل الخارجي أو الدفعات الأصغر، وتنخفض الاقتصادية الوحدوية معها. توجد ذاكرة 288 جيجابايت لكل GPU في البوكس B300 لتخزين الأوزان وذاكرات التخزين المؤقتة ذات نطاق التفكير في آنٍ واحد، وتقليل قيمة الارتفاع الكثيف FP4 يخفض تكلفة كل واحد من تلك الرموز الإضافية.
ثلاث حالات. أساطيل الاستنتاج التي تخدم مهام العمل ذات السياق الطويل أو عمليات التفكير حيث يحدد عمق ذاكرة التخزين المؤقت KV حجم الدفعة والهوامش. نماذج تطغى على 1.4 تيرابايت من عقدة B200. والمشغلون الذين ي standard على نسيج 800G المتكامل لنمو متعدد العقد. برامج التدريب وأساطيل الخدمة المريحة داخل 1.4 تيرابايت عادة ما تكون أفضل خدمة بواسطة نظام Gigabyte HGX B200، ونماذج MillionMiner كلاهما في الاقتباس.
لأن الشبكة انتقلت إلى لوحة الأساس الخاصة بوحدة معالجة الرسوميات. كانت أنظمة فئة B200 تحتوي على اثني عشر مَحَجَراً بشكل رئيسي لاستيعاب محول بسرعة 400 جيجابت/ثانية لكل وحدة معالجة رسوميات؛ تدمج وحدة HGX B300 NVL8 ثمانية موانئ OSFP بسرعة 800 جيجابت/ثانية مباشرة، لذا فإن الطوبولوجيا التي تتطلب منفذًا واحدًا لكل وحدة معالجة رسوميات والتي تسعى إليها GPUDirect RDMA مُدمجة بشكل افتراضي بسرعة مضاعفة. كما أن المَحَجَرَين المتبقيين من PCIe 5.0 يحملان التخزين وشبكة الإدارة، وهو كل ما تبقى لإضافته.
معالجات AMD EPYC 9005 أو 9004 ذات النطاق المزدوج، تصل إلى 192 نواة لكل مقبس على خط 9005، مع أربعة وعشرين وحدة DDR5 بسرعة 6400 MT/ثانية مُجهزة واحدة لكل قناة لتحقيق كامل عرض النطاق الترددي والتوسع إلى 6 تيرابايت، وهو أعلى بكثير من مجموعة GPU التي تبلغ 2.3 تيرابايت. التخزين يشمل ثمانية فتحات E1.S NVMe قابلة للاستبدال الساخن أمامية للبيانات المحلية. تتبع النسب قواعد التحديد التي يدرسها بقية هذا الكتالوج، مع هامش.
الحد هو نطاق NVLink. ينضم هذا العقدة إلى ثمانية وحدات GPU في نسيج متماسك واحد على بنية تحتية يمكن نشرها عبر الهواء؛ أنظمة المقياس الرفي تتصل بـ 72 وحدة تحت تبريد السائل ومشروع هندسة مرفق. إذا كانت التوازي في التدريب يتطلب حقًا أكثر من ثمانية وحدات GPU في نطاق واحد، فإن المقياس الرفي هو الحل. لخدمة حتى أكبر النماذج المنشورة وللتدريب الذي يتوافق مع ثمانية وحدات Blackwell Ultra GPU، تقدم هذه العقدة الجيل دون الالتزام بالمرفق وتتشكل خارجيًا عبر نسيجها المدمج بسرعة 800G.
على نسيج لوحة القاعدة نفسها: ثمانية منافذ OSFP بسرعة 800 جيجابت/ثانية، واحدة لكل وحدة معالجة رسومات، تعمل باستخدام GPUDirect RDMA بحيث تنتقل التدرجات والتنشيطات بين العقد دون لمس وحدة المعالجة المركزية. يتم إرسال الطوبولوجيا التي تم تجميعها من أنظمة حقبة B200 من خلال تصميم هنا. ينصح MillionMiner بشأن بنية المفاتيح والنسيج عندما يتعدى النشر جهازًا واحدًا.
ستة مزودات طاقة فائقة التكرار بقوة 6600 واط من مستوى التيتانيوم تحدد الإطار، مما يجعل هذا النظام في أعلى فئة العُقد المفردة القابلة للنشر جويًا وبوضوح ضمن منطقة مراكز البيانات. تؤكد MillionMiner الاستهلاك الدقيق وخطة الحرارة لتكوينك المحدد أثناء العرض، والتشغيل في منشآت MillionMiner الخاصة متاح للفرق التي تفضل عدم تخصيص طاقة الحامل بهذه السعة.
قدم تفاصيل عبء العمل، الحجم، ونشرة النشر الخاصة بك عبر نموذج الاقتباس. يؤكد متخصص من MillionMiner على التكوين، أهلية الوجهة وفقًا لضوابط التصدير الأمريكية التي تنطبق على معجلات Blackwell-class، وخطة التسليم. يتم اختبار كل نظام قبل الشحن ويتم التسليم عالميًا DDP مع التعامل مع الرسوم والجمارك. يتوفر إرشاد حول دمج الرف وبرمجة النشر المستضافة.