मिलियनमाइनर में प्री-बिल्ट GPU सर्वर और AI वर्कस्टेशन खरीदें, जो निर्दिष्ट किए गए मानकों के अनुसार असेंबल किए गए हैं, लोड-टेस्ट किए गए हैं और चलाने के लिए तैयार शिप किए गए हैं। उपलब्ध बिल्ड्स में एकल-GPU RTX 5090 वर्कस्टेशन से लेकर डुअल-GPU Threadripper PRO सिस्टम, जिनमें 128 PCIe 5.0 लेन हैं, तक और क्वाड और 8-GPU नोड्स शामिल हैं, जिसमें 8-GPU RTX 5090 नोड लगभग 838 TFLOPS FP32 प्रदान करता है।…
प्रत्येक सर्वर नए के साथ शिप किया जाता है जिसमें वारंटी और मुफ्त विश्वव्यापी DDP शामिल है, इसलिए चेकआउट मूल्य अंतिम लैंडिंग लागत है, और इसे छोड़ने से पहले स्थिरता मान्य कर दी जाती है। खुद चलाने के लिए खरीदें या हमारे यूएस होस्टिंग में दूरस्थ प्रबंधन के साथ तैनात करें। नीचे GPU सर्वर और AI वर्कस्टेशन का खरीदारी करें।
Supermicro SuperServer SYS-741GE-TNRT 4-GPU H100 AI सर्वर
अनुरोध पर
—
अनुरोध पर
Supermicro AS-4124GO-NART+ 8x A100 HGX AI सर्वर
अनुरोध पर
—
अनुरोध पर
NVIDIA DGX A100 डीप लर्निंग सिस्टम (8x A100, 640GB)
अनुरोध पर
—
अनुरोध पर
Exeton Quasar 640X 8x A100 AI सर्वर (640GB NVLink)
अनुरोध पर
—
अनुरोध पर
Lenovo NVIDIA HGX H200 141GB 700W 8-GPU सर्वर
अनुरोध पर
—
अनुरोध पर
Supermicro HGX H800 SuperServer SYS-821GE-TNHR
अनुरोध पर
—
अनुरोध पर
GIGABYTE G893-ZD1-AAX5 HGX B200 8-GPU सर्वर
अनुरोध पर
—
अनुरोध पर
गिगाबाइट G492-ZD0 HGX A100 8-GPU सर्वर, ड्यूल AMD EPYC 7742, 4U (प्रयोगशाला)
अनुरोध पर
—
अनुरोध पर
Supermicro GPU A+ सर्वर AS-8126GS-NB3RT NVIDIA HGX B300 NVL8
अनुरोध पर
—
अनुरोध पर
ASUS XA NB3I-E12 NVIDIA HGX B300 NVL8 GPU सर्वर
अनुरोध पर
—
अनुरोध पर
Supermicro SYS-111C-NR-G1 1U Rackmount X13 UP Gold Series CloudDC सुपरसर्वर
स्टॉक में है
—
$5,700.00
Supermicro SYS-521C-NR-G1 2U Rackmount X13 UP Gold Series CloudDC SuperServer
स्टॉक में है
—
$5,700.00
फैक्ट्री-ग्रेड सिस्टम
कॉन्फ़िगर, परीक्षण किया गया और गर्मी परीक्षण प्रमाणित
माल परिवहन
विश्वव्यापी बीमित पैलेट और एयर फ्रेट
क्रिप्टो स्वीकार किया गया
भुगतान करें BTC, ETH, USDT और अधिक के साथ
विशेषज्ञ समर्थन
एआई अवसंरचना वास्तुकार उपलब्ध हैं
एक AI सर्वर केवल GPU के साथ एक पीसी नहीं है। गंभीर AI अवसंरचना के लिए उद्देश्य-निर्मित प्लेटफ़ॉर्म की आवश्यकता होती है: GPU-से-GPU संचार के लिए उच्च-बैंडविड्थ NVSwitch फैब्रिक्स, उच्च क्षमता वाली DDR5 मेमोरी, प्रत्येक GPU को आपूर्ति करने के लिए उद्यम-श्रेणी CPUs जिनमें पर्याप्त PCIe लेन हों, तेज checkpoints के लिए NVMe स्टोरेज, और प्रति रैक यूनिट 10+ kW की शक्ति आपूर्ति प्रणाली। हम संपूर्ण AI सर्वर प्लेटफ़ॉर्म प्रदान करते हैं — शोध प्रयोगशालाओं के लिए 2-GPU टावर सिस्टम से लेकर NVIDIA HGX H100/H200 8-GPU नोड्स और नई GB200 NVL72 रैक-स्तर वास्तुकला — तुरंत स्थापित करने के लिए तैयार।
DGX H100 GPU की संख्या
8 × H100 SXM5
640 GB कुल HBM2e एनवी स्विच के माध्यम से
NVL72 GPU संख्या
72 GPUs
GB200 एकल रैक में — 1 तार्किक इकाई
DGX H100 AI प्रदर्शन
32 PFLOPS
FP8 sparse — संयुक्त 8 × H100
HGX H200 मेमोरी
1.1 TB HBM3e
8 × H200 SXM5 — 38,4 TB/s कुल बैकवर्ड क्षमता
8 × H100 SXM5, 640 GB
बॉक्स में पूर्ण AI सुपरकंप्यूटर। NVSwitch पूर्ण-मेश प्रत्येक GPU पर 900 GB/सैकंड। ड्यूल Xeon या AMD Epyc, 2 टीबी DDR5। उद्यम AI के लिए संदर्भ मंच।
8 × H200 SXM5, 1.1 TB
DGX H100 का उत्तराधिकारी। प्रति GPU 4,8 TB/s HBM3e। बड़े मॉडल इनफेरेंस के लिए वांछित बड़े पैमाने पर जहां स्मृति क्षमता महत्वपूर्ण हो।
OEM platform (8-GPU)
जीपीयू बोर्ड + NVSwitch कॉम्प्लेक्स OEM भागीदारों (Supermicro, Dell, HPE, Lenovo) को भेजा गया। कस्टम सर्वर चेसिस में समान जीपीयू फैब्रिक सक्षम करता है।
72 × GB200 GPUs
एकल रैक-स्केल प्रणाली। 36 Grace CPU + 72 Blackwell GPU मॉड्यूल। 1.44 ExaFLOPS FP4। NVLink 5 फेब्रिक — समग्र रैक एक GPU के रूप में कार्य करता है।
Up to 4 × 96 GB
अनुसंधान प्रयोगशालाओं और AI स्टार्टअप्स के लिए कार्यस्थल वर्ग सर्वर। ड्यूल-सॉकेट Xeon W9 या Threadripper Pro, 4 × RTX PRO 6000 BW एनवीलिंक ब्रिज पेयर्स के माध्यम से।
2 × 80 GB HBM2e
लागत-कुशल अनुमान नोड्स। मानक 2U चेसिस, द्वैध PCIe 5.0 स्लॉट। मानक रैक कोलोकेशन में फिट होता है बिना तरल शीतलन की आवश्यकता के।
4–8 × 24 GB PCIe
उच्च-घनत्व, कम-शक्ति अनुमान। 72 डब्ल्यू प्रत्येक के एकल-खिड़की L4 GPU। 1U में कुल मिलाकर 8 GPU तक, 600 डब्ल्यू से कम — को-लो एज PoP के लिए आदर्श।
मामूली उद्देश्य वाले सर्वर और AI सर्वर के बीच मुख्य अंतर GPU फैब्रिक है। एक मानक सर्वर में, GPU PCIe के माध्यम से संचार करते हैं — जो एक बस वास्तुकला है जिसकी रेटिंग लगभग 32–64 GB/स बिडायरेक्शनल प्रति स्लॉट है। NVSwitch-आधारित AI सर्वर में, प्रणाली में प्रत्येक GPU प्रत्येक अन्य GPU से एक साथ NVSwitch ASIC के माध्यम से जुड़ा होता है, हर GPU पर 900 GB/स (H100) या 1.8 TB/स (H200 / Blackwell) पर। यह किसी बॉटलनेक्स में सुधार नहीं है — यह एक गुणात्मक बदलाव है जो GPUs के बीच मॉडल समानांतरता को सक्षम बनाता है मानो वे एक बड़े उपकरण हों।
CPU और मेमोरी उपप्रणाली को GPU बैंडविड्थ आवश्यकताओं के साथ मेल खाना चाहिए। DGX H100 अपने 8-GPU NVSwitch फैब्रिक को डुअल Intel Xeon Platinum CPU और 2 TB DDR5 ECC RAM के साथ जोड़ता है — जो सिस्टम मेमोरी है जिससे प्रशिक्षण डेटासेट का स्टेजिंग, पूर्वप्रसंस्करण पाइपलाइनों का संचालन, और चेकपॉइंट I/O प्रबंधन बिना बॉटलनेक्स के किया जा सकता है। PCIe 5.0 लेन को इस तरह से सावधानीपूर्वक वितरित किया गया है कि प्रत्येक GPU का सीधा x16 कनेक्शन CPU फैब्रिक से हो।
पावर डिलीवरी अपने आप में एक अभियांत्रिक चुनौती है। एक पूरी तरह से लोडेड DGX H100 लगभग 10.2 kW खींचता है — जिसमें उत्तरी अमेरिका में 2 × 30A, 240V सर्किट या यूरोप में 3-फेज़ 32A की आवश्यकता होती है। कूलिंग भी समान रूप से मांगलिक है: NVIDIA का संदर्भ डिज़ाइन एक रियर-डोर हीट एक्सचेंजर या डायरेक्ट लिक्विड कूलिंग का उपयोग करता है GPU मॉड्यूल के लिए DGX कॉन्फ़ीगरेशन में। अपनी सुविधा की पावर और कूलिंग की योजना बनाना ऑर्डर करने से पहले अनिवार्य है — यह पहला कदम है।
GB200 NVL72 NVIDIA की अब तक की सबसे महत्वाकांक्षी सिस्टम वास्तुकला है। एक सिंगल रैक में 36 Grace CPU मॉड्यूल और 72 Blackwell GB200 GPU डाई होते हैं, सभी एक पांचवीं पीढ़ी के NVLink फेब्रिक के माध्यम से जुड़े होते हैं जो प्रत्येक GPU पर 1.8 TB/स में डेटा ट्रांसफ़र कर सकता है — जिससे पूरे रैक को एक ही तर्कसंगत अभिकल्पक के रूप में कार्य करने की अनुमति मिलती है। सभी 72 GPU के बीच संकलित FP4Sparse कंप्यूट 1.44 ExaFLOPS से अधिक है और कुल HBM3e मेमोरी 13.5 TB तक पहुंचती है।
प्रत्येक GB200 मॉड्यूल में एक Grace Arm CPU को दो Blackwell GPU डाइज़ के साथ NVLink-C2C के माध्यम से 900 GB/सैकंड की गति से जोड़ा गया है — जिससे CPU और GPU के बीच PCIe इंटरफ़ेस पूरी तरह से समाप्त हो जाता है। CPU एक उच्च-बैंडविड्थ मेमोरी नियंत्रक और ऑर्केस्ट्रेशन इंजन के रूप में कार्य करता है, न कि एक बॉटलनेक। यह डिज़ाइन NVL72 को ट्रिलियन-परामीटर मॉडल अनुमान के लिए अनन्य रूप से सक्षम बनाता है, कम विलंबता पर: पूरे मॉडल को रैक की मेमोरी में फिट किया जा सकता है, सभी-गुणा ऑपरेशन्स NVLink फैब्री के अंदर होते हैं, और सिंगल-मॉडल सर्विंग के लिए कोई इंटर-नोड नेटवर्क की आवश्यकता नहीं होती।
स्थापना के दृष्टिकोण से, NVL72 अधिकतम 120 kW खींचता है और सीधे तरल शीतलन की आवश्यकता है — एक समर्पित 3-फेज़ पावर फीड और सुविधा का तरल शीतलन अवसंरचना अनिवार्य हैं। हाईपरस्केल पर अर्थव्यवस्था प्रलोभनकारी हैं: एक NVL72 रैक पहले की तुलना में पूरी पंक्तियों में DGX H100 नोड्स की आवश्यकता को बदल देता है, जो समकक्ष inference थ्रूपुट प्रदान करता है।
प्रयोगशाला-स्तरीय परीक्षण से लेकर पूर्ण हाइपरस्केल परिनियोजन तक — अपने कार्यभार को सही प्लेटफ़ॉर्म स्तर से मेल खाएं।
मॉडल फ़ाइन-ट्यूनिंग, RAG विकास, स्थानीय अनुमान, अनुसंधान पुनरुत्पादन। डेस्क के नीचे या मानक रैक में फिट होता है। आमतौर पर कोई सुविधाओं का उन्नयन आवश्यक नहीं है।
13–70B मॉडलों का पूर्ण फाइन-ट्यूनिंग। AI मूल उत्पादों के लिए उत्पादन अभिप्रेक्षा। 3-फेज बिजली या ड्यूल 30A फीड की आवश्यकता। एयर कूलिंग रियर-दरवाज़ा HX के साथ संभव है।
70–400B मॉडल की पूर्ण-पैरामीटर प्रशिक्षण। बहुत बड़े मॉडलों के लिए कम विलंबता इनफ़ेरेंस। तरल शीतलन की सिफारिश की गई। गंभीर AI कार्यभार के लिए वर्तमान उद्योग मानक।
ट्रिलियन-पैरामीटर मॉडल प्री-ट्रेनिंग और बड़े-बैच इनफेरेंस। पूर्ण तरल शीतलन और समर्पित 3-फेज शक्ति अनिवार्य है। रैक-एज़-अ-सिंगल-GPU आर्किटेक्चर NVLink 5 के माध्यम से
अपर अपने संपूर्ण AI सर्वर प्लेटफार्म की रेंज देखें, जिसमें अनुसंधान-श्रेणी के 2-GPU नोड्स से लेकर DGX H200 और GB200 NVL72 रैक-स्केल सिस्टम शामिल हैं। हमारी टीम आपके लिए ऊर्जा, कूलिंग, नेटवर्किंग और लॉजिस्टिक की योजना बनाने में सहायता करेगी।