GPU szerverek és AI munkaállomások vásárlása: előre összeszerelt, tesztelt, készen áll a működésre

Vásároljon előre összeszerelt GPU szervereket és AI munkaállomásokat a MillionMiner-nél, egyedi igény szerint összeszerelve, terheléspróbázva és kész szállításra. A rendelkezésre álló konfigurációk egyetlen GPU-s RTX 5090 munkaállomásoktól kezdődnek, amelyek dual-GPU Threadripper PRO rendszerek 128 PCIe 5.0 sávval, egészen a négy- és nyolc-GPU node-okig, ahol egy nyolc-GPU RTX 5090 node körülbelül 838 TFLOPS FP32 teljesítményt nyújt.

Minden szerver új állapotban, garanciával és ingyenes világszerte DDP szállítással kerül kiszállításra, így a fizetési ár a végleges szállítási költség, melyet a hagyományos üzembe helyezés előtt megerősítünk. Vásárolja meg saját használatra, vagy telepítse a mi USA-beli hosting szolgáltatásunkba távoli irányítással. Vásároljon GPU szervert és AI munkaállomást alább.

5.0
csillag csillag csillag csillag csillag
4.97
csillag csillag csillag csillag csillag
4.5
csillag csillag csillag csillag csillag
méhsejt-rács méhsejt-rács
Szűrő & Rendezés

Gyártósori minők

Konfigurálva, tesztelve és üzempróba-ellenőrizve

Szállítási logisztika

Biztosított raklap és légi szállítás világszerte

Elfogadott kriptó

Fizessen BTC, ETH, USDT és másképp

Szakértői Támogatás

AI infrastruktúrát tervező szakemberek rendelkezésre állnak

AI szerver rendszerek

Multi-GPU AI szerverek: 2-GPU munkaállomástól az 8-GPU HGX csomópontokig

Egy AI szerver nem csupán egy PC GPU-val kiegészítve. A komoly AI infrastruktúrához célzott platformokra van szükség: magas sávszélességű NVSwitch szövetek GPU-GPU kommunikációhoz, nagy kapacitású DDR5 memória, vállalati szintű CPU-k, amelyek elegendő PCIe sávval rendelkeznek minden GPU-hoz, NVMe tárolás gyors checkpoint I/O-hoz, és 10+ kW teljesítményellátó rendszerek rackegységenként. Teljes AI szerver platformokat kínálunk — a kutatólaboratóriumi 2-GPU torony rendszerektől az NVIDIA HGX H100/H200 8-GPU csomópontokig és az új GB200 NVL72 rack-skálájú architektúráig — készenállnak az azonnali telepítésre.

DGX H100 GPU száma

8 × H100 SXM5

640 GB összes HBM2e NVSwitch-eken keresztül

NVL72 GPU darabszám

72 GPUs

GB200 egyetlen rackben — 1 logikai egység

DGX H100 AI Teljesítmény

32 PFLOPS

FP8 sparsített — 8 × H100 egyben

HGX H200 memória

1.1 TB HBM3e

8 × H200 SXM5 — 38,4 TB/s összesített sávszélesség


AI szerver platform összehasonlítása

Fő platformok, amelyeket biztosítunk

NVIDIA DGX H100

8 × H100 SXM5, 640 GB

Teljes AI szuperszámítógép dobozban. NVSwitch teljes hálózat 900 GB/s-ig GPU-ként. Dual Xeon vagy AMD Epyc, 2 TB DDR5. Referencia platform vállalati AI-hoz.

NVIDIA DGX H200

8 × H200 SXM5, 1.1 TB

A DGX H100 utódja. 4,8 TB/s HBM3e GPU-ként. Előnyös nagy méretű modell előrejelzésekhez nagy léptékben, ahol a memória kapacitása kritikus szerepet játszik.

NVIDIA HGX H100/H200

OEM platform (8-GPU)

A GPU tábla + NVSwitch komplexum OEM-partnerekhez (Supermicro, Dell, HPE, Lenovo) kerül szállításra. Lehetővé teszi az azonos GPU-hálózat kialakítását egy egyedi szerverkasztniban.

NVIDIA GB200 NVL72

72 × GB200 GPUs

Egyszerű rack-kategóriás rendszer. 36 Grace CPU + 72 Blackwell GPU modul. 1,44 ExaFLOPS FP4. NVLink 5 szövet — az egész rack egy GPU-ként működik.

4-GPU Tower / Rack (RTX PRO 6000)

Up to 4 × 96 GB

Munkaállomás osztályú szerver kutató laborok és AI startupok számára. Dual-nyák Xeon W9 vagy Threadripper Pro, 4 × RTX PRO 6000 BW NVLink Bridge párokon keresztül.

2-GPU Inference Server (A100 / H100 PCIe)

2 × 80 GB HBM2e

Költséghatékony inferencia csomópontok. Standard 2U ház, két PCIe 5.0 foglalattal. Illeszkedik a szabványos rack colokációhoz, folyadékhűtés nélkül.

1U Edge Inference (L4 / A2)

4–8 × 24 GB PCIe

Magas sűrűségű, alacsony energiafogyasztású inferencia. Egysoros L4 GPU-k, mindegyik 72 W. Egy 1U-ban akár 8 GPU kevesebb mint 600 W teljesítménnyel — ideális kollokációs szakadék színpadokhoz.

Az AI szerverek mögötti architektúra

Miért különböznek alapvetően az AI szerverek a standard szerverektől

A általános célú szerver és az AI szerver közötti alapvető különbség a GPU hálózatban rejlik. Egy szokványos szerverben a GPU-k PCIe-n keresztül kommunikálnak — egy körülbelül 32–64 GB/s kétirányú buseszerkezet minden foglalathoz. Egy NVSwitch-alapú AI szerverben minden GPU a rendszerben egyszerre csatlakozik minden más GPU-hoz az NVSwitch ASIC-en keresztül, 900 GB/s sebességgel GPU-nként (H100) vagy 1,8 TB/s GPU-nként (H200 / Blackwell). Ez nem egy szűk keresztmetszet javítása — ez egy minőségi változás, amely lehetővé teszi a modell paralelizmust a GPU-k között, mintha azok egyetlen nagyobb eszköz lenne.

A CPU és a memória alrendszernek meg kell felelnie a GPU sávszélesség igényeinek. A DGX H100 az 8-GPU NVSwitch szövettel párosítva két Intel Xeon Platinum processzort és 2 TB DDR5 ECC RAM-ot tartalmaz — ez elég rendszer memória a képzési adatkészletek tárolására, az előfeldolgozási pipeline-ok futtatására, valamint a checkpoint I/O kezelésére anélkül, hogy szűk keresztmetszetté válna. A PCIe 5.0 csatornákat gondosan osztják el, hogy minden GPU közvetlen x16 kapcsolatban legyen a CPU szövettel.

Az áramellátás mérnöki kihívást jelent önmagában. Egy teljesen feltöltött DGX H100 körülbelül 10,2 kW-at fogyaszt — Észak-Amerikában 2 × 30A, 240V-os körök, Európában pedig háromfázisú 32A szükséges hozzá. A hűtés ugyanolyan igényes: az NVIDIA referenciamodellje hátsó oldalú hőcserélőt vagy közvetlen liquid cooling-ot használ a GPU modul számára DGX konfigurációkban. A létesítmény áramellátásának és hűtésének megtervezése a rendelés előtt nem opció — ez az első lépés.


Rack-Scale AI

NVIDIA GB200 NVL72: 72 GPU egy logikai gyorsítóként

A GB200 NVL72 NVIDIA eddigi legambíciózusabb rendszerarchitektúrája. Egyetlen rackben 36 Grace CPU-modul és 72 Blackwell GB200 GPU-darab található, mindezt az ötödik generációs NVLink fabric köti össze, 1,8 TB/s sebességgel GPU-ként — lehetővé téve, hogy az egész rack egyetlen logikai gyorsítóként működjön. Az összes GPU által biztosított FP4 ritkított számítási kapacitás meghaladja az 1,44 ExaFLOPS-t, és a teljes HBM3e memória eléri a 13,5 TB-t.

Minden GB200 modul egy Grace Arm CPU-t kombinál két Blackwell GPU-gyűrűvel NVLink-C2C-n keresztül, 900 GB/s sebességgel — teljesen kiküszöbölve a PCIe interfészt a CPU és a GPU között. A CPU magas sávszélességű memória vezérlőként és irányítási egységként működik, nem jelent szűk keresztmetszetet. Ez a kialakítás teszi az NVL72-t egyedülállóan alkalmassá trillió paraméteres modellek inferenciájára alacsony késleltetés mellett: az egész modell a rack memóriai között helyezkedik el, az összesített műveletek az NVLink hálózaton belül történnek, és nincs szükség külön hálózatra az egyes modell kiszolgálásához.

Az intézményi szempontból az NVL72 akár 120 kW energiát is fogyaszt, és közvetlen folyadékhűtést igényel — egy dedikált háromfázisú táplálás és az intézményi folyadékhűtési infrastruktúra kötelező. A gazdaságosság rendkívül meggyőző a hyperskálánál: egy NVL72 rack helyettesít egy egész sor DGX H100 csomópontot azonos inferencia kapacitás eléréséhez.

GB200 NVL72 Adatok

Teljes állvány specifikációs adatlap

GPU meghal 72 × Blackwell GB200
CPU modulok 36 × Grace Arm (72 cores each)
GPU memória 13.5 TB HBM3e total
GPU memória sávszélesség 345.6 TB/s aggregate
AI Teljesítmény 1.44 ExaFLOPS FP4 sparse
GPU összeköttetés NVLink 5.0 — 1.8 TB/s per GPU
CPU-GPU kapcsolat NVLink-C2C — 900 GB/s bidirectional
Rendszer memória Up to 13.5 TB LPDDR5X
Áramfelvétel Up to 120 kW per rack
Hűtés Direct Liquid Cooling (mandatory)
Hálózatépítés 8 × 400 GbE / InfiniBand per rack

Vásárlói útmutató

Melyik AI szerver felel meg leginkább az Ön használati esetének?

A laboratóriumi szintű kísérletezéstől a teljes hyperscale telepítésig — illessze munkaterhelését a megfelelő platform szinthez.

Kutatás / Labor

2–4 GPU Tower or 2U Rack

GPU-kàrtyák A100 80GB / RTX PRO 6000
GPU memória 160–384 GB GPU VRAM
Teljesítmény 2–4 kW total draw

Model finomhangolás, RAG fejlesztés, helyi inferencia, kutatási reprodukálhatóság. Egy íróasztal alá vagy egy szabványos rackbe illik. Általában nincs szükség létesítményfejlesztésre.

Indítás / KKV

HGX H100 OEM 8-GPU

GPU-kàrtyák 8 × H100 SXM5 80GB
GPU memória 640 GB HBM2e
Teljesítmény ~10 kW draw

Teljes finomhangolás 13–70B modellekhez. Gyártási inferencia AI-native termékekhez. Háromfázisú áramellátást vagy dupla 30A-erősségű táplálást igényel. Levegős hűtés lehetséges hátsó ajtós HX-szel.

Vállalat

DGX H200 / HGX H200

GPU-kàrtyák 8 × H200 SXM5 141GB
GPU memória 1.1 TB HBM3e
Teljesítmény ~11 kW draw

Teljes paraméteres képzés 70–400B modelleken. Alacsony késleltetésű inferencia nagyon nagy modelleknél. Lihid hűtés javasolt. Az ipar jelenlegi szabványa komoly AI terhelésekhez.

Hyperscale

GB200 NVL72

GPU-kàrtyák 72 × Blackwell GB200
GPU memória 13.5 TB HBM3e
Teljesítmény Up to 120 kW

Trillió-paraméteres modell előképzése és nagy tételben történő következtetés. Teljes folyékony hűtés és különálló háromfázisú áram vételező kötelező. Rack-méretű GPU-kat magában foglaló architektúra NVLink 5 segítségével.


GYIK

Gyakran Ismételt Kérdések

A DGX (Data Centre GPU) NVIDIA saját márkázású teljes rendszer — GPU tábla, NVSwitch, CPU, memória, tároló, hálózat, BMC és ház minden egyes eleme az NVIDIA összeállítása és tesztelése révén készült. Az HGX az OEM platform: az NVIDIA a GPU alaplapot NVSwitch-szel és GPU modulokkal szállítja partnereknek, mint például a Supermicro, Dell EMC, HPE és Lenovo, akik saját teljes szerverházaikat építik köré. Az HGX rendszerek nagyobb rugalmasságot kínálnak a ház választásában, a hálózati lehetőségekben és a tárolási konfigurációkban; a DGX rendszerek referencia-ellenőrzöttek és NVIDIA Base Command szoftverrel érkeznek.

A DGX H100 akár 10,2 kW-ot is fogyaszthat. Két C19/C20 csatlakozást igényel különálló, 30A, 240V-os áramkörökről Észak-Amerikában, vagy egy háromfázisú, 32A ellátást Európában. Egy szabványos, 20A, 120V-os lakossági áramkör teljesen alkalmatlan. Tervezzen külön PDU-kat vagy közvetlen panelvezetéket, és ellenőrizze az UPS kapacitását az megrendelés előtt.

Az entry és középkategóriás AI szerverek (2–8 GPU PCIe konfigurációk) magas légáramlású levegőhűtést alkalmazhatnak, bár a magas ventilátor zaj és a 10 kW+ kifúvási hő miatt erősen ajánlott az hátsó ajtós hőcserélők használata. A SXM formátumú DGX H100 és HGX H100/H200 rendszerek lég hűtésre vannak tervezve rendszer szinten, de jelentős hőt generálnak rack szinten — folyadékhűtés gyakorlatilag szükségessé válik 20–30 kW feletti rackenként. A GB200 NVL72 120 kW rackenként közvetlen folyadékhűtést igényel, levegő csak lehetőség nincs.

FP16 módban egy 175B modell körülbelül 350 GB VRAM-ot igényel — több mint a DGX H100 640 GB-os kapacitása, figyelembe véve az inference KV cache overhead-et. Gyakorlatban az INT8 kvantálás meg approximately megfelezi ezt a követelményt, kb. 175 GB-ra, így kényelmesen elfér. A DGX H200 (1,1 TB HBM3e) képes futtatni 175B modelleket FP16-ban, tartalék hely mellett. Egy GB200 NVL72 (13,5 TB) több példányban is képes futtatni egyidejűleg több 175B modellt.

A többcsomópontos képzéshez elengedhetetlen a magas sávszélességű RDMA hálózat. Az NVIDIA InfiniBand HDR (200 Gb/s) vagy NDR (400 Gb/s) az általánosan elfogadott szabvány a DGX/HGX klaszter hálózatokhoz. Alternatív megoldásként a RoCEv2 (RDMA a Converged Etherneten keresztül) 400 GbE ConnectX-7 NIC-kkel költséghatékonyabb lehet az inference klaszterek számára. Az összesítés (AllReduce) operációk a képzés során rendkívül érzékenyek a csomópontok közötti sávszélességre és késleltetésre — a közönséges 25/100 GbE kapcsolók egyenetlen akadályokat okoznak a nagyszabású képzések során.

Igen. Nagy AI szerverrendelések esetén tudunk gyári konfigurációt, próbaüzemet és logisztikát szervezni az Ön adatközpontjába vagy colocation létesítményébe. Vegye fel a kapcsolatot értékesítési csapatunkkal a telepítési ütemterv és a létesítmény követelményeinek egyeztetése érdekében. Európában, az Egyesült Arab Emirátusokban és Észak-Amerikában működő colocation szolgáltatókkal dolgozunk együtt.

Csapatunk 24/7 rendelkezésre áll WhatsApp (+49 176 777 888 33), e-mail és telefonon keresztül. Az AI szerver vásárlások általában egyedi konfigurációkat és mennyiségi kedvezményeket foglalnak magukban — hozzáigazítjuk az Ön munkaterhelési igényeit a megfelelő platformhoz, és részletes árajánlatot nyújtunk, beleértve a logisztikát.

Kész az AI-infrastruktúrája telepítésére?

Tekintse meg teljes AI szerver platform kínálatunkat, a kutatási szintű 2-GPU csomópontoktól a DGX H200 és GB200 NVL72 rack-szintű rendszerekig. Csapatunk segít Önnek a teljes körű áramellátás, hűtés, hálózatépítés és logisztika megtervezésében.