Kupte si předmontované GPU servery a AI pracovní stanice v MillionMiner, sestavené na míru, load-testované a připravené k provozu. Dostupné sestavy sahají od pracovních stanic s jedním GPU RTX 5090 přes systémy s dvojitým GPU Threadripper PRO s 128 PCIe 5.0 linkami až po čtyřnásobné a osmigrafové uzly, přičemž osmigrafový uzel RTX 5090 nabízí přibližně 838 TFLOPS FP32.
Každý server je dodáván nový s zárukou a bezplatným celosvětovým DDP, takže cena na pokladně je konečná cena za přistání s, přičemž stabilita je před odjezdem ověřena. Kupte si ho pro vlastní provoz nebo jej nasadte do našeho US Rechenzentrums s dálkovým řízením. Níže zakoupíte GPU servery a AI pracovní stanice.
Systémy tovární kvality
Nakonfigurováno, otestováno a ověřeno při zátěži
Nákladní logistika
Pojištěná paleta a letecká přeprava po celém světě
Krypto přijato
Plaťte BTC, ETH, USDT a další
Odborná podpora
Architekti AI infrastruktury k dispozici
AI server není pouhým PC s přidaným GPU. Seriózní infrastruktura pro AI vyžaduje účelově navržené platformy: vysokorychlostní NVSwitch sítě pro komunikaci GPU s GPU, vysokokapacitní DDR5 paměť, podnikové procesory s dostatečným počtem PCIe linek pro každý GPU, NVMe úložiště pro rychlou vstupně-výstupní operaci checkpointů a systémy napájení s výkonem přes 10 kW na rackovou jednotku. Nabízíme kompletní platformy pro AI server — od 2-GPU tower systémů pro výzkumné laboratoře, přes NVIDIA HGX H100/H200 8-GPU uzly až po novou GB200 NVL72 architekturu v rackové škále — připravené k okamžitému nasazení.
Počet GPU DGX H100
8 × H100 SXM5
Celkových 640 GB HBM2e přes NVSwitch
Počet GPU NVL72
72 GPUs
GB200 v jednom stojanu — 1 logická jednotka
DGX H100 AI Výkon
32 PFLOPS
FP8 sparse — kombinovaný 8 × H100
HGX H200 paměť
1.1 TB HBM3e
8 × H200 SXM5 — 38,4 TB/s celková přenosová šířka pásma
8 × H100 SXM5, 640 GB
Kompletní AI superpočítač v jednom boxu. NVSwitch plná síťová topologie s 900 GB/s na GPU. Dvojitý Xeon nebo AMD Epyc, 2 TB DDR5. Referenční platforma pro podniková AI.
8 × H200 SXM5, 1.1 TB
Náhrada za DGX H100. 4,8 TB/s HBM3e na GPU. Preferováno pro inference velkých modelů v rozsahu, kde je kritická kapacita paměti.
OEM platform (8-GPU)
Grafická karta + komplex NVSwitch dodaný partnerským OEM (Supermicro, Dell, HPE, Lenovo). Umožňuje stejnou GPU strukturu v zakázkových serverových skříních.
72 × GB200 GPUs
Jednoduchý systém na úrovni jednoho racku. 36 procesorů Grace + 72 moduly GPU Blackwell. 1,44 ExaFLOPS FP4. NVLink 5 fabric — celý rack funguje jako jedno GPU.
Up to 4 × 96 GB
Server třídy Workstation pro výzkumná pracoviště a startupy v oblasti AI. Dual-socket Xeon W9 nebo Threadripper Pro, 4 × RTX PRO 6000 BW přes páry NVLink Bridge.
2 × 80 GB HBM2e
Nízkonákladové inference uzly. Standardní skříň 2U, dvojité sloty PCIe 5.0. Vhodné pro standardní rackovou kolokaci bez nutnosti kapalného chlazení.
4–8 × 24 GB PCIe
Vysoko hustotní, nízkoenergetická inference. Jednotlivé sloty GPU L4 s výkonem 72 W každý. Až 8 GPU v 1U při celkovém příkonu méně než 600 W — ideální pro colocation edge PoPs.
Základní rozdíl mezi běžným serverem a AI serverem spočívá ve struktuře GPU. U standardního serveru komunikují GPU přes PCIe — sběrnicovou architekturu s přenosovou rychlostí přibližně 32–64 GB/s obousměrně na slot. U AI serveru založeného na NVSwitch se každý GPU v systému současně připojuje ke všem ostatním GPU prostřednictvím ASIC NVSwitch rychlostí 900 GB/s na GPU (H100) nebo 1,8 TB/s na GPU (H200 / Blackwell). Nejde o zlepšení ve formě úzkého místa — jedná se o kvalitativní změnu, která umožňuje paralelní zpracování modelů přes GPU, jako by šlo o jedno větší zařízení.
Systém CPU a paměť musí odpovídat požadavkům na šířku pásma GPU. DGX H100 kombinuje své 8-GPU NVSwitch sběrnici s dvojicí procesorů Intel Xeon Platinum a 2 TB DDR5 ECC RAM — dostatek systémové paměti k načítání trénovacích dat, spuštění předzpracovatelských pipeline a správě checkpoint I/O bez toho, aby se stala úzkým hrdlem. Linky PCIe 5.0 jsou pečlivě rozděleny tak, aby měla každá GPU přímé připojení x16 k sběrnici CPU.
Přenos energie je sám o sobě inženýrskou výzvou. Plně zatížený DGX H100 odebírá přibližně 10,2 kW — vyžaduje 2 × 30A, 240V obvody v Severní Americe nebo třífázový 32A obvod v Evropě. Chlazení je stejně náročné: referenční návrh NVIDIA využívá výměník tepla na zadních dveřích nebo přímé kapalné chlazení GPU modulu v konfiguracích DGX. Plánování napájení a chlazení vašeho zařízení před objednáním není volitelné — je to první krok.
GB200 NVL72 je zatím nejambicióznější systémová architektura od NVIDIA. Jeden rack obsahuje 36 modulů Grace CPU a 72 čipů Blackwell GB200 GPU, všechny propojené přes pátou generaci NVLink fabric s rychlostí 1,8 TB/s na GPU — což umožňuje celému racku chovat se jako jeden logický akcelerátor. Celkový FP4 řídicí výkon ve sparsním režimu napříč všemi 72 GPU přesahuje 1,44 ExaFLOPS a celková paměť HBM3e dosahuje 13,5 TB.
Každý modul GB200 spojuje CPU Grace Arm s dvěma čipy GPU Blackwell prostřednictvím NVLink-C2C při 900 GB/s — úplně eliminuje rozhraní PCIe mezi CPU a GPU. CPU slouží jako řadič vysokorychlostní paměti a orchestrátor, nikoliv jako překážka. Tento design činí NVL72 jedinečně schopným pro inferenci modelů s bilionem parametrů za nízkou latenci: celý model se vejde do paměti racku, operace all-reduce probíhají uvnitř NVLink fabric, a není zapotřebí síťové připojení mezi uzly pro obsluhu jednoho modelu.
Ze scenárního hlediska NVL72 čerpá až 120 kW a vyžaduje přímé kapalné chlazení — nezbytné jsou samostatné trojfázové napájení a infrastruktura kapalného chlazení v areálu. Ekonomicky je to přesvědčivé při vysokém objemu: jeden Rack NVL72 nahrazuje dříve celé řady uzlů DGX H100 pro ekvivalentní výkon inference.
Od laboratorního experimentování po plné nasazení v rozsahu hyperscale — přizpůsobte zatížení správné úrovni platformy.
Ladění modelu, vývoj RAG, místní inference, reprodukovatelnost výzkumu. Vejde se pod stůl nebo do standardního racku. Obvykle není potřeba žádná vylepšení zařízení.
Plné doladění modelů 13–70B. Inference v produkčním prostředí pro produkty AI-native. Vyžaduje třífázové připojení nebo dvojitý přívod 30A. Chlazení vzduchem možné s chladičem na zadních dveřích.
Plné parametrové trénování modelů 70–400B. Nízkonákladové inference pro velmi velké modely. Doporučeno kapalinové chlazení. Současný průmyslový standard pro vážné AI úlohy.
Předtrénování modelu s trilionem parametrů a inference s velkými dávkami. Vyžaduje se plné kapalné chlazení a dedikovaná třífázová elektřina. Architektura racku jako jednoho GPU prostřednictvím NVLink 5.
Prohlédněte si náš úplný sortiment AI serverových platforem výše, od výzkumných uzlů s 2 GPU po systémy rackového měřítka DGX H200 a GB200 NVL72. Náš tým vám pomůže s plánováním napájení, chlazení, síťování a logistiky od začátku až do konce.