NVIDIA

Nvidia H200 NVL (141GB) AI और HPC GPU

मॉडल: H200 SXM

अपनी GPU क्लस्टर कोटेशन के लिए अनुरोध करें

अपनी तैनाती आवश्यकताओं के बारे में हमें बताएं। हमारे AI हार्डवेयर विशेषज्ञ 24 घंटे के भीतर ईमेल, व्हाट्सएप या कॉल के माध्यम से उत्तर देंगे।

क्यों GPUs परामर्श के द्वारा बेचे जाते हैं

GPU क्लस्टर AI और HPC वर्कलोड के लिए आपके निश्चित आवश्यकताओं के अनुसार कॉन्फ़िगर किए जाते हैं — मात्रा, इंटरकनेक्ट टोपोलॉजी, शक्ति खपत, और कूलिंग—all अंतिम कीमत को प्रभावित करते हैं। नीचे दिए गए फॉर्म को सबमिट करें और हमारी विशेषज्ञ टीम 24 घंटों के भीतर आपके परिनियोजन के लिए एक पूर्ण कोटेशन के साथ जवाब देगी।

आपके GPU ऑर्डर कैसे काम करता है

1

फ़ॉर्म जमा करें

हमें अपना उपयोग केसे और मात्रा बताएं

2

अपनी कीमत प्राप्त करें

पूर्ण कीमत 24 घंटे के भीतर

3

विशेषज्ञ के साथ समीक्षा

कॉन्फ़िग, इंटरकनेक्ट, कूलिंग के बारे में चर्चा करें

4

तैनात करें

हार्डवेयर भेज दिया गया है और चलाने के लिए तैयार है

मूल

परीक्षित हार्डवेयर

वैश्विक

वैश्विक शिपिंग

समर्थन

खनन विशेषज्ञ

एनवीडिया H200 NVL 141GB टेंसोर कोर GPU। होपर वास्तुकला जिसमें विश्व का पहला HBM3e मेमोरी है: 141GB 4,800 GB/s बैंडविड्थ के साथ, H100 SXM की तुलना में 76 प्रतिशत VRAM बढ़ोतरी और 43 प्रतिशत बैंडविड्थ सुधार। वही होपर गणना क्षमता जो H100: 16,896 CUDA कोर, 528 चौथे-जेन टेंसोर कोर FP8 ट्रांसफॉर्मर इंजन के साथ, 67 TFLOPS FP32, 3,958 TFLOPS FP8। PCIe फॉर्म फैक्टर, जो NVLink ब्रिजों के माध्यम से 4 GPU तक समर्थन करता है। अधिकतम 600W TDP कॉन्फ़िगर योग्य। मानक सर्वर चेसिस के लिए निष्क्रिय हवा शीतलन। 7 इंस्टेंस के लिए MIG, प्रत्येक 16.5GB। A100 और H100 PCIe अवसंरचना से ड्रॉप-इन अपग्रेड।

पूर्ण विनिर्देश

मॉडल H200 SXM

बिटकॉइन माइनर होस्टिंग कोटेशन का अनुरोध करें

नि: शुल्क कोटेशन, 24 घंटे में उत्तर। कोई बिक्री कॉल नहीं।

4.4
सितारा सितारा सितारा सितारा सितारा

Trustpilot पर 4.7 / 5

सत्यापित ग्राहक समीक्षाएं

30,000+ माइन्सर प्रदान किए गए

2020 से विश्वव्यापी रूप से भेजा गया

दुनिया भर में 1,200+ ग्राहक

50+ देशों में भरोसेमंद

आईएसओ जर्मनी में बना ट्रस्टपायलट
गूगल-रिव्यू

के लिए एक कोटेशन प्राप्त करें Nvidia H200 NVL (141GB) AI और HPC GPU

मूल्य निर्धारण, अग्रिम समय, और होस्टिंग विकल्प। हमारी बिक्री टीम से व्यक्तिगत सलाह।

उत्तर दें 24 घंटे के अंदर इसके माध्यम से ईमेल, व्हाट्सएप्प, या कॉल.

उत्पाद विवरण

NVIDIA H200 NVL 141GB HBM3e: LLM इनफ़ेरेंस, लंबी संदर्भ सेवा और H100 PCIe बेड़े विस्तार के लिए Hopper मेमोरी अपग्रेड

H200 कोई नई आर्किटेक्चर नहीं है। यह वही Hopper GH100 डाई है जो वही CUDA कोर, वही Tensor कोर, और वही Transformer इंजीनिया H100 के समान चला रहा है। NVIDIA ने जो बदलाव किया है वह मेमोरी सबसिस्टम में है: HBM3 को HBM3e से बदला गया है, क्षमता 80GB से बढ़ाकर 141GB कर दी गई है, बैंडविड्थ 3,350 GB/s से बढ़ाकर 4,800 GB/s कर दी गई है। हर अन्य विनिर्देशन समान ही रहता है। यह एक लक्षित मेमोरी उन्नयन है उन कार्यभार के लिए जहाँ H100 की 80GB सीमा बन गई थी। व्यावहारिक प्रभाव तीन श्रेणियों में आता है जो वास्तविक तैनाती निर्णयों से मेल खाते हैं। पूर्ण सटीकता पर LLM इन्फेरेंस। 70B पैरामीटर मॉडल FP16 में KV कैश ओवरहेड के साथ आवश्यक है लगभग 140GB से 160GB GPU मेमोरी, बैच आकार और अनुक्रम लंबाई पर निर्भर करता है। H100 80GB पर इसे फिट नहीं कर सकता बिना FP8 या INT8 में क्वांटाइज़ेशन के, जो मॉडल की सटीकता को कम कर देता है। H200 NVL 141GB FP16 पर 70B को एक ही GPU में फिट कर सकता है, पूरी सटीकता को सुरक्षित रखते हुए। जिन अनुप्रयोगों में क्वांटाइज़ेशन सटीकता हानि अस्वीकार्य है (चिकित्सा AI, कानूनी दस्तावेज विश्लेषण, वित्तीय मॉडलिंग), यह उन दोनों के बीच का फर्क है कि "संभव" और "उत्पादन के लिए तैयार"। लंबे संदर्भ इन्फेरेंस स्केलिंग। ट्रांसफ़ॉर्मर मॉडल KV कैश मेमोरी को संदर्भ विंडो लंबाई के अनुसार आवंटित करते हैं। H100 पर 128K टोकन संदर्भ विंडोज का सेवा देने वाला मॉडल अनुक्रम पूरा होने से पहले 80GB समाप्त कर सकता है। H200 की 141GB अधिकतम संदर्भ विंडो को बढ़ाती है ताकि एक ही GPU पर संभाल सकें लगभग 76 प्रतिशत तक, इससे पहले कि मेमोरी ऑफलोडिंग आवश्यक हो। RAG पाइपलाइनों, दस्तावेज़ प्रसंस्करण, और लंबी संवादात्मक एजेंसियों के साथ, यह सीधे लंबी संदर्भों का संकेत करता है बिना बुनियादी ढांचे की जटिलता के। मल्टी-टेनैंट डेंसिटी अधिक बड़े MIG भागों के माध्यम से। H200 पर प्रत्येक MIG इंस्टांस 16.5GB प्राप्त करता है जबकि H100 पर 10GB। यह 65 प्रतिशत प्रति-इंस्टेंस वृद्धि का अर्थ है कि प्रत्येक विभाजन बड़े इन्फेरेंस मॉडल सेवा कर सकता है। जहां H100 के 10GB MIG स्लाइसेस 3B से 7B मॉडल संभालते हैं, H200 के 16.5GB स्लाइस प्रति विभाजन 7B से 13B मॉडल संभालते हैं। एक ही H200 GPU पर सात समानांतर 7B मॉडल इंस्टांस एक व्यावहारिक मल्टी-टेनैंट इन्फेरेंस कॉन्फ़िगरेशन है। NVL PCIe फॉर्म फैक्टर विवरण। एक सर्वर में NVLink ब्रिज के माध्यम से जुड़े 4 GPUs तक। एयर-कूलिंग के अनुकूल 600W TDP तक कॉन्फ़िगर किया जा सकता है (H200 SXM पर 700W की तुलना में जो तरल शीतलन आवश्यक हैं)। PCIe Gen 5 x16 इंटरफ़ेस। निष्क्रिय हीटसिंक जो सर्वर चेसिस एयरफ्लो पर निर्भर है। A100 PCIe या H100 PCIe कार्ड के साथ चल रहे समान सर्वर प्लेटफ़ॉर्म में फिट होता है, इसे एक ड्रॉप-इन उन्नयन बनाता है। Lenovo, Supermicro, Dell, और HPE सभी मौजूदा सर्वर लाइनों पर H200 NVL अनुकूलता का दस्तावेज़ प्रस्तुत करते हैं। बैंडविड्थ टोकन जेनरेशन गति के लिए महत्वपूर्ण है। ऑटोरेग्रेसिव डिकोडिंग में LLM इन्फेरेंस टोकन जेनरेशन मेमोरी-बैंडविड्थ-सीमित है: प्रत्येक नया टोकन मॉडल वेट्स को HBM से पढ़ने की आवश्यकता करता है। 4,800 GB/s बनाम H100 के 3,350 GB/s पर, H200 बैंडविड्थ-सीमित कार्यभारों पर लगभग 43 प्रतिशत तेज टोकन जेनरेट करता है। RunPod बेंचमार्क इस बात की पुष्टि करते हैं कि यह बड़े भाषा मॉडल पर वास्तविक दुनिया की इन्फेरेंस थ्रूपुट में 1.5x से 1.9x तक वृद्धि करता है। H200 NVL बनाम H200 SXM निर्णय H100 लाइनअप की तरह है। SXM: 700W TDP, तरल शीतलन, HGX बेसबोर्ड, NVSwitch फेब्रिक जो 8 GPUs को 900 GB/s प्रत्येक पर जोड़ता है, वितरित प्रशिक्षण के लिए अनुकूलित। NVL: 600W तक, एयर कूलिंग, मानक PCIe सर्वर, 4-GPU तक NVLink, इन्फेरेंस और लचीले परिनियोजन के लिए अनुकूलित। प्रशिक्षण क्लस्टर्स के लिए SXM। इन्फेरेंस सर्वरों और मौजूदा अवसंरचना उन्नतियों के लिए NVL। H100 के समान निर्यात नियंत्रण। US की उन्नत AI हार्डवेयर पर प्रतिबंधों के अधीन।

NVIDIA H200 NVL 141GB: उसी Hopper कॉम्प्यूट आर्किटेक्चर पर H100 से 76% अधिक VRAM

H200 NVL एक विशिष्ट प्रश्न का उत्तर देता है जो H100 ने छोड़ दिया था: क्या होता है जब 80GB VRAM पर्याप्त नहीं होता है लेकिन आप Blackwell मूल्य निर्धारण पर नहीं जाना चाहते हैं? 141GB HBM3e की मेमोरी, 4,800 GB/s बैंडविड्थ के साथ, वही Hopper GH100 डाई पर है जो H100 को शक्ति प्रदान करता है। वही 16,896 CUDA कोर। वही 528 चौथे-जेन tensor कोर। वही FP8 ट्रांसफॉर्मर इंजन 3,958 TFLOPS पर। वही MIG, वही गोपनीय कंप्यूटिंग, वही CUDA सॉफ्टवेयर स्टैक। एकमात्र परिवर्तन मेमोरी है: तेज HBM3e बस पर 76 प्रतिशत अधिक क्षमता (141GB बनाम 80GB) और 43 प्रतिशत अधिक बैंडविड्थ (4,800 बनाम 3,350 GB/s)। उस मेमोरी उन्नयन के तीन व्यावहारिक प्रभाव हैं। पहली, FP16 पर 70B पैरामीटर मॉडल बिना क्वांटाइजेशन के एक ही GPU पर फिट हो जाते हैं। H100 80GB पर 70B मॉडल के लिए FP8 या INT8 क्वांटाइजेशन की आवश्यकता होती है, जो कुछ शुद्धता को छोड़ देता है। H200 NVL 141GB पर इन्हें पूरी FP16 परफेक्शन में चलाता है। दूसरी, बड़े KV कैश के साथ लंबी-प्रासंगिकता इनफेरेंस सीमाओं से पहले ही अधिक स्केल कर सकती है। H100 पर 80GB का कॉन्टेक्स्ट विंडो 76 प्रतिशत अधिक हेडरूम के साथ H200 पर है। तीसरी, MIG इंस्टेंस प्रत्येक 10GB से बढ़कर 16.5GB हो जाते हैं, जिससे प्रत्येक पृथक खंड बड़े इनफेरेंस मॉडल के लिए उपयोगी हो जाते हैं, 특히 मल्टी-टेनेंट परिनियोजन में। NVL नामकरण का अर्थ PCIe फॉर्म फैक्टर है जिसमें NVLink ब्रिज समर्थन है, जो प्रति सर्वर 4 GPUs तक हो सकता है। एयर-कूलिंग के साथ संगत, TDP तक 600W। वर्तमान में A100 या H100 PCIe कार्ड चलाने वाले मानक सर्वर प्लेटफ़ॉर्म में फिट होता है। कोई HGX बेसबोर्ड आवश्यक नहीं है। यह उन्नयन मार्ग उन ऑपरेटरों के लिए है जो अपने सर्वर संरचना को बदलें बिना H200 मेमोरी क्षमता चाहते हैं।

क्या आप मदद चाहते हैं चुनने में?

हमारे माइनिंग विशेषज्ञ आपकी सेटअप और बजट के लिए बेहतरीन miner खोजने में मदद कर सकते हैं।

NVIDIA H200 NVL 141GB HBM3e PCIe Tensor Core GPU

पहली GPU जिसमें HBM3e मेमोरी है। 141GB at 4.800 GB/s बैंडविड्थ: H100 SXM से 76 प्रतिशत अधिक VRAM और 43 प्रतिशत तेज मेमोरी। वही Hopper गणना (16,896 CUDA कोर, 3,958 TFLOPS FP8 ट्रांसफार्मर इंजन)। PCIe फॉर्म फैक्टर के साथ 4-GPU NVLink स्केलिंग तक। H100 और A100 PCIe स्लॉट के लिए ड्रॉप-इन प्रतिस्थापन। 7 इंस्टांसेस के लिए MIG, प्रत्येक 16.5GB। निष्क्रिय वायु ठंडक up to 600W कन्फिगर किए गए TDP के साथ। LLM इनफरेन्स के लिए बनाई गई, जहां मॉडल आकार और KV कैश की मांग 80GB प्रति GPU से अधिक हो।

141GB HBM3e: H100 से 76% अधिक

पहला GPU HBM3e मेमोरी के साथ। 4,800 GB/s बैंडविड्थ। बिना क्वांटाइजेशन के एकल GPU पर पूर्ण FP16 सटीकता के साथ 70B मॉडल चलाएँ।

उसी हॉपर कंप्यूट, बड़ा मेमोरी

वहीं 16,896 CUDA कोर और 3,958 TFLOPS FP8 ट्रांसफॉर्मर इंजन जैसी H100। वही सॉफ्टवेयर स्टैक। केवल मेमोरी बदली गई।

H100 और A100 से ड्रॉप-इन PCIe अपग्रेड

मौजूदा सर्वर अवसंरचना के साथ उचित। NVLink ब्रिज के माध्यम से 4 GPU तक। एयर कूलिंग के अनुकूल। कोई HGX बेसबोर्ड आवश्यक नहीं।

सामान्य प्रश्न (FAQ)

अक्सर पूछे जाने वाले प्रश्न

1.128GB (1.1TB) सम्मिलित HBM3e मेमोरी। 38,400 GB/s संयुक्त बैंडविड्थ। 32 पीटाFLOPS से अधिक FP8 गणना। NVSwitch फैब्रिक के पार 7,200 GB/s NVLink बैंडविड्थ। DGX H200 कुल सिस्टम शक्ति लगभग 8,500W।

SXM: 700W TDP, हॉटगिंग बेसबोर्ड और तरल शीतलक की आवश्यकता, NVSwitch 8 GPU को 900 GB/s पर हर एक से जोड़ता है, लगभग 18 प्रतिशत अधिक थ्रूपुट, वितरित प्रशिक्षण के लिए अनुकूलित। NVL: 600W TDP, एयर कूलिंग, मानक PCIe सर्वर, NVLink ब्रिजों के माध्यम से बिना NVSwitch के 4 GPU तक, अनुमानित इनफेरेंस के लिए अनुकूलित। दोनों में समान 141GB HBM3e है जो 4,800 GB/s पर है और वही Hopper गणना प्रदान करता है।

同 GH100 die, 同 CUDA cores, 同 Tensor Cores, 同計算 TFLOPS। H200 ने मेमोरी को 80GB HBM3 से 3,350 GB/s पर उठाकर 141GB HBM3e से 4,800 GB/s कर दिया है। प्रति नोड: 1.1TB बनाम 640GB, 38,400 बनाम 26,800 GB/s। NVIDIA बेंचमार्क से पता चलता है कि Llama2 70B inference थ्रूपुट H200 पर H100 की तुलना में लगभग दोगुना है उसी बैच कॉन्फ़िगरेशन पर।

फ्रंटियर LLMs (70B से 175B+ पैरामीटर) प्रशिक्षण के दौरान टेंसोर समानांतरता के साथ। विशेषज्ञ-रूटिंग से लाभ प्राप्त करने वाले मिक्स्ट्रल, डीपसीक V3 जैसी मिश्रित-विशेषज्ञ आर्किटेक्चर। लंबी संदर्भ इनफ़ेरेंस जहां KV कैश H100 की 80GB मेमोरी को समाप्त कर देता है। कोई भी कार्यभार जहां H100 की स्मृति क्षमता या बैंडविड्थ बाधा थी।

NVIDIA HGX H200 बेसबोर्ड या DGX H200 सिस्टम। प्रत्येक GPU की 700W TDP (8 GPU के लिए 5,600W) अधिकांश विन्यासों में तरल शीतलन की आवश्यकता होती है। HGX प्लेटफार्में सुपरमाइक्रो, डेल, HPE, और लेनोवो से उपलब्ध हैं। DGX H200 NVIDIA का टर्नकी 8-GPU सिस्टम है। डेटा केंद्र सुविधा जिसमें उपयुक्त शक्ति, शीतलन, और नेटवर्किंग अवसंरचना हो।

NVSwitch पूर्ण-जाल सभी-से-सभी GPU जुड़ाव बनाता है। कोई भी GPU किसी भी अन्य GPU के साथ 900 GB/s की गति से संचार करता है बिना CPU या PCIe की भागीदारी के। वितरित प्रशिक्षण के दौरान ग्रेडिएंट समन्वयन माइक्रोसेकंड में पूरा हो जाता है, जिससे ओवरहेड कंप्यूटिंग समय का 10 प्रतिशत से कम रहता है। NVSwitch के बिना, 4 या अधिक GPU पर प्रशिक्षण दक्षता काफी घट जाती है क्योंकि PCIe 128 GB/s पर ग्रेडिएंट आदान-प्रदान आवश्यकताओं को पूरा नहीं कर सकता।

B200 उच्च गणना TFLOPS, नई Tensor Core पीढ़ी, और वास्तुशिल्प सुधारों के साथ Blackwell वास्तुकला में स्थानांतरित हो जाता है। H200 SXM स्थापनाप्राप्त Hopper पारिस्थितिकी तंत्र परिपक्वता प्रदान करता है, जिसमें स्थापित ड्राइवर स्थिरता, सॉफ्टवेयर स्टैक समर्थन, और वर्षों की उत्पादन तैनाती दस्तावेज़ीकरण शामिल है। सुनिश्चित हार्डवेयर पर त्वरित तैनाती के लिए, H200 SXM सबसे मजबूत विकल्प है। अगली पीढ़ी के प्रदर्शन के लिए, Blackwell भविष्य का प्लेटफ़ॉर्म है।

प्रत्येक 16.5GB के 7 हार्डवेयर-आइसोलेट इंस्टेंस तक (H100 SXM पर 10GB के मुकाबले)। प्रत्येक इंस्टेंस की 65 प्रतिशत अधिक मेमोरी प्रति-इंस्टेंस 7 बिलियन से 13 बिलियन मॉडल तक सेविंग करने का समर्थन करती है हर MIG भाग में। प्रत्येक इंस्टेंस को समर्पित CUDA कोर, टेंसर कोर, L2 कैश, और HBM के साथ हार्डवेयर-सम्मिलित आइसोलेशन प्राप्त होता है।

हाँ। हार्डवेयर-आधारित ट्रस्टेड एग्जीक्यूशन एनवायरनमेंट (TEE) GPU प्रोसेसिंग के दौरान डेटा और मॉडल वेट्स की सुरक्षा करता है। स्वास्थ्य सेवा (HIPAA), वित्त (SOC 2), और सरकारी (FedRAMP) वातावरण में अनुपालन-संवेदनशील AI तैनाती के लिए आवश्यक है, जहां प्रोसेसिंग के दौरान डेटा गोपनीयता अनिवार्य है।

H100 के समान अमेरिका निर्यात नियंत्रण। यह चीन, हांगकांग, और मकाऊ में उपलब्ध नहीं है। NVIDIA ने प्रतिबंधित बाजारों के लिए बैंडविड्थ-सीमित संस्करण बनाए हैं। अपने डिलीवरी गंतव्य के लिए निर्यात योग्यता की पुष्टि के लिए MillionMiner से संपर्क करें।