Supermicro

Supermicro Server GPU A+ AS-8126GS-NB3RT NVIDIA HGX B300 NVL8

Model: AS-8126GS-NB3RT

Solicitați cotația pentru serverul dumneavoastră

Spune-ne munca ta și nevoile de implementare. specialistul nostru răspunde în 24 de ore prin e-mail, WhatsApp sau telefon.

De ce acest server este inclus în ofertă doar la comandă

Acești servere sunt configurați și estimați la comandă. Configurația ta, stocarea, rețeaua, garanția și integrarea în rack determină prețul final, iar destinația de livrare setează costurile de transport și vamă. Trimite formularul de mai jos, iar specialistul nostru îți va răspunde în 24 de ore cu o ofertă completă care include hardware, garanție și livrare DDP la nivel mondial.

Cum funcționează comanda ta de server

1

Trimite formularul

Partajați distribuția muncii și detaliile despre implementare

2

Solicită o ofertă

Prețuri complete în 24 de ore

3

Recenzie cu specialistul

Finalizează configurarea și livrarea

4

Livrare

Expediat și gata pentru implementare

Autentic

Hardware testat

La nivel mondial

Expediție globală

Asistență

Experți în minerit

Platforma Supermicro de 8U A+ pentru placa de bază NVIDIA HGX B300 NVL8: opt GPU Blackwell Ultra B300 SXM cu 288 GB de HBM3e fiecare, pooling 2,3 TB de memorie GPU pe nod în spatele NVLink și NVSwitch de a cincea generație, cu porturi de rețea de 800 Gb/s integrate direct pe placa de bază. Două procesoare AMD EPYC din seriile 9005 sau 9004, până la 6TB de DDR5 6400, opt locașuri NVMe E1.S și six surse de alimentare Titanium de 6600W le susțin. Nodul de inferență și antrenare din era reasoning, cotat și livrat global DDP de MillionMiner.

Specificații complete

Model AS-8126GS-NB3RT
Factorul de formă 8U Rackmount
GPU-uri 8x NVIDIA B300 (Blackwell Ultra) SXM, 288GB HBM3e each
Memorie totală GPU 2.3TB HBM3e (2,304GB pooled)
Interconectare NVIDIA NVLink 5 and NVSwitch, 1.8 TB/s per GPU
Processatoare Dual AMD EPYC™ 9005/9004 Series
Suport pentru memorie Up to 6TB DDR5, 6400 MT/s
Sloturi DIMM 24
Interfețe de rețea 8x OSFP 800 Gb/s (integrated on baseboard)
Sloturi PCIe 2x PCIe 5.0 x16 FHHL
Bay-uri pentru unități 8x front hot-swap E1.S NVMe
Surse de alimentare 6x 6600W Redundant Titanium Level

Solicitați o ofertă pentru găzduirea unui Bitcoin Miner

Estimare gratuită, răspunde în 24h. Fără apel de vânzări.

4.4
stea stea stea stea stea

4.7 / 5 pe Trustpilot

Revisii de la clienți verificați

Peste 30.000 de mineri livrați

Expediat în întreaga lume din 2020

1.200+ clienți la nivel global

Aferent în peste 50 de țări

ISO fabricat în Germania Trustpilot
recenzie-google

Solicită o ofertă pentru a cumpăra Supermicro Server GPU A+ AS-8126GS-NB3RT NVIDIA HGX B300 NVL8

Prețuri, timp de livrare și opțiuni de găzduire. sfaturi personale de la echipa noastră de vânzări.

Răspunde în 24h via email, WhatsApp, sau apel.

Detalii despre produs

Supermicro AS-8126GS-NB3RT HGX B300 NVL8: Blackwell Ultra în Detaliu, Matematica Nodului de 2,3TB, Rețeaua Fabric Integrată de 800G și Decizia Împotriva B200 și Sistemelor la Scară Rack

Blackwell Ultra este prima generație de GPU-uri concepută după ce industria a înțeles costurile modelelor de reasoning pentru a fi oferite. B200 a răspuns la întrebarea despre antrenament; B300 răspunde întrebării din era inferenței care a urmat, iar modificările sunt specifice, nu cosmetice. Această platformă Supermicro A+ este nodul cu 8 GPU-uri în care se livrează aceste schimbări. Complexul GPU. Opt NVIDIA Blackwell Ultra B300 SXM GPU-uri montează pe placa de bază HGX B300 NVL8, fiecare având 288GB de HBM3e, cu 60% mai mult decât B200, combinând 2.304GB în întregul nod. NVLink de a cincea generație conectează fiecare GPU la 1,8 TB/s prin NVSwitch într-un topologie completă de tip mesh. NVIDIA evaluează capacitatea de throughput dens FP4 a B300 la de 1,5 ori cea a B200, o creștere concentrată exact acolo unde se află volum mare de servire, iar scalarea micro-tensorului În cadrul Transformer Engine de a doua generație este ceea ce face ca inferența de patru biți să păstreze acuratețea de producție. Lățimea de bandă a memoriei per GPU rămâne în clasa de 8 TB/s; capacitatea este capul de afiș, pentru că aceasta este ceea ce epuizează cel mai repede workload-urile de reasoning. De ce capacitatea definește era reasoning. Un model care gândește înainte de a răspunde generează token-uri interne, iar fiecare dintre ele ocupă cache KV pentru durata răspunsului. Trasările lungi de reasoning, ferestre de context extinse și servirea cu multiple concurențe multiplică acel amprentă împreună. Pe noduri mai mici, rezultatul este externalizare, colapsul dimensiunii batch sau ambele, iar marjele de servire scad odată cu ele. Un nod de 2,3TB păstrează greutățile la scară de frontieră și cache-urile pe care le generează simultan, ceea ce face diferența între un model care se potrivește și o implementare profitabilă. Textile-ul integrat și ce schimbă despre carcasie. Placa de bază HGX B300 NVL8 are propria rețea: opt porturi OSFP la 800 Gb/s, câte unul per GPU, dublu față de rata pe port a adaptorilor de adăugare de generație anterioară. De aceea, specificațiile arată doar două sloturi PCIe 5.0 pentru extindere, în timp ce sistemele de clasă B200 aveau un duzină; cele douăzeci și patru de sloturi existau pentru NIC-uri, iar aceste NIC-uri acum sunt pe placă de bază. Pentru implementări multi-nod, consecința este o construcție mai curată, o rețea mai rapidă și topologie GPUDirect RDMA garantată prin proiect, nu asamblată la comandă. Cele două sloturi rămase suportă stocare și rețea de management. Hoster-ul Supermicro. Două procesoare AMD EPYC 9005 sau 9004, până la 192 de nuclee pe socket pentru linia 9005, susțin preprocesarea, tokenizarea și încărcarea datelor necesare pentru cele opt GPU-uri de acest tip. Douăzeci și patru module DDR5 la 6400 MT/s sunt distribuite câte unul pe canal, pe cele doisprezece canale ale fiecărui procesor, și scalează până la 6TB, păstrând adaosul de bandă largă, fiind plasate departe de piscina GPU, regula de dimensionare pe care o predă acest catalog, asigurată cu spațiu de rezervă. Opt bay-uri NVMe frontale hot-swap E1.S mențin seturile de date local, iar șase surse de alimentare Titanium de 6600W în aranjament redundant definesc un pachet de alimentare clar, care indică această mașină ca fiind un sistem de nivel data centre la vârful clasei de nod unic cu răcire aer. Decizia împotriva HGX B200 din acest catalog. Nodul Gigabyte B200 oferă 1,4TB și aceeași generație NVLink, și pentru programele de antrenament și flotele de servire care operează în limita memoriei respective, rămâne achiziția racională Blackwell. B300 își câștigă poziția în trei situații: flote pentru reasonning și inferență în context lung, unde adâncimea cache-ului KV decide dimensiunea batch-ului și, implicit, economia unităților, implementări care servesc modele de scară frontieră care depășesc 1,4TB, și operatori ce standardizează pe textile-ul integrat de 800G pentru creșterea multi-nod. Sub acești parametri, B200 câștigă în economia costurilor; în aceste condiții, B300 este singurul nod care se potrivește. Decizia împotriva rack-scale. Deasupra acestei mașini se află sistemele de clasa GB200 și GB300, unde 72 GPU-uri împart un domeniu NVLink sub răcire lichid și inginerie de faciliteiten pentru a se potrivi. Granița rămâne aceeași: dacă paralelismul de antrenament are nevoie cu adevărat de mai mult de opt GPU-uri într-un singur domeniu coerent, rack-scale este soluția. Pentru toate sistemele care pot găzdui opt Blackwell Ultra GPU-uri, inclusiv cele care rulează cele mai mari modele implementate, acest nod oferă generația fără proiect de facilitate și se scalează în afară, pe rețeaua încorporată de 800G. Conformitatea de export și comanda. Acceleratoarele Blackwell sunt supuse controlului exporturilor SUA, iar MillionMiner confirmă eligibilitatea destinației ca parte din fiecare ofertă. Fiecare sistem este configurat la comandă, testat și livrat la nivel global DDP, cu taxe și vamă incluse. Planificarea implementării și hosting-ul în propriile centre de date ale MillionMiner sunt disponibile pentru echipele care preferă să nu asigure electricitatea rack-ului la această scară pe site.

Supermicro HGX B300 NVL8: Nodul construit pentru modele care gândesc înainte de a răspunde

Economia inferenței s-a schimbat când modelele au început să raționeze. Un răspuns de tip chain-of-thought consumă de zece până la o sută de ori mai multe tokens decât un răspuns direct, fiecare urmă de raționament inflamează cache-ul KV, iar furnizarea acestuia în mod profitabil a încetat să mai fie o problemă de calcul și s-a transformat într-o problemă de memorie și precizie. Blackwell Ultra este răspunsul direct al NVIDIA, iar această platformă Supermicro este forma de 8-GPU în care este livrată. Răspunsul legat de memorie: 288GB de HBM3e pe GPU, cu 60 la sută mai mult decât B200-ul de 180GB, pooling de 2,3TB pe întreaga nod, ceea ce permite menținerea modelelor frontier și a cache-urilor KV lungi generate de trace-uri de raționament și ferestre extinse de context, fără externalizare care ar afecta latența de servire. Răspunsul legat de precizie: NVIDIA estimează FP4 dens al B300 la 1,5 ori mai mult decât B200, throughput-ul fiind orientat direct spre inferența în volum mare, unde servirea pe patru biți cu scalare micro-tensor menține acuratețea și reduce costul per token la jumătate. Răspunsul legat de fabrică: baza HGX B300 NVL8 integrează direct opt porturi OSFP de 800 Gb/s, câte unul per GPU, la de două ori viteza generației anterioare, motiv pentru care acest chassis necesită doar două sloturi PCIe de expansiune, în timp ce sistemele B200 necesitau doisprezece. Rețeaua cluster-ului nu mai este o adiție, ci face parte din complexul GPU-ului. Hoster-ul Supermicro menține proporțiile corecte. Două procesoare AMD EPYC din seria 9005 sau 9004 ating 192 de nuclee pe socket pentru pipeline-uri intensive în preprocesare, douăzeci și patru module DDR5 la 6400 MT/s extind până la 6TB, foarte peste pool-ul GPU de 2,3TB, iar cele opt bay-uri frontale hot-swap NVMe E1.S păstrează seturile de date locale. Șase surse Titanium de 6600W, în aranjament redundant, suportă această configurație. Prețuirea pentru configurație și livrare în DDP global de către MillionMiner.

Ai nevoie de ajutor pentru alegere?

Specialiștii noștri în minerit vă pot ajuta să găsiți minerul perfect pentru configurația și bugetul dumneavoastră.

Supermicro HGX B300 NVL8: 2,3TB de Blackwell Ultra

Cel mai mare pool de memorie cu un singur nod din acest catalog: opt GPU-uri NVIDIA Blackwell Ultra B300 SXM cu 288GB de HBM3e fiecare, 2,3TB pe nod, unite prin NVLink de a cincea generație la 1,8 TB/s pe GPU prin NVSwitch. NVIDIA estimează că densitatea FP4 a B300 este de 1,5 ori cea a B200, iar placa de bază HGX B300 NVL8 integrează propriul său fabric de 800 Gb/s, opt porturi OSFP, astfel încât clusterizarea nu necesită plăci de extensie. Supermicro o găzduiește pe aceasta cu procesoare duale AMD EPYC 9005 sau 9004, cu până la 6TB de DDR5 6400, opt bay-uri E1.S NVMe și șase surse de alimentare Titanium de 6600W în 8U. Se oferă la nivel mondial, DDP, de către MillionMiner.

2,3TB de HBM3e într-un singur nod

Optimită Blackwell Ultra B300 SXM GPU-uri la 288GB fiecare, cu 60% mai mult decât B200. Greutățile Frontier și scale-ul de raționament KV se potrivesc împreună.

Construite pentru Era Raționamentului

NVIDIA evaluează dense FP4 la 1,5x B200. Servirea în lanț, context lung și concurență ridicată sunt aspectele pentru care acest nod prețuiește corect.

Fabric de 800G pe placa de bază

Opt8 porturi OSFP integrate la 800 Gb/s, câte unul pentru fiecare GPU. Clusterizarea este proiectată în mod nativ și nu adăugată ulterior, iar rețeaua funcționează la de două ori viteza precedentă.

Întrebări frecvente

Întrebări frecvente

HGX B300 NVL8 este blocul de bază cu 8 GPU-uri Blackwell Ultra de la NVIDIA: opt GPU-uri B300 SXM, țesătura NVSwitch care le conectează la 1,8 TB/s fiecare, și porturi de rețea integrate de 800 Gb/s, furnizate producătorilor precum Supermicro. Față de B200, memoria crește cu 60 la sută, ajungând la 288 GB de HBM3e pe GPU, NVIDIA estimează o performanță densă FP4 de 1,5 ori mai mare, iar porturile țesăturii se dublează la 800 Gb/s în timp ce se mută pe placa de bază.

2,304GB de HBM3e poolate pe opt GPU-uri, NVLink de generație a cincea la 1,8 TB/s per GPU prin NVSwitch, throughput dens FP4 NVIDIA evaluat la 1,5 ori HGX B200, și opt porturi de rețea integrate de 800 Gb/s. În termeni de sarcină de lucru: modelele de scară frontieră funcționează cu spațiu complet pentru cache-ul KV, modelele de sute de miliarde de parametri se ajustează cu precizie completă într-un nod, iar flotele de raționament mențin dimensiuni de batch pe care le colapsează pool-urile de memorie mai mici.

Pentru că acestea multiplică numărul de tokeni. Un model care ia decizii înainte de a răspunde generează lanțuri interne de gândire, fiecare token ocupând cache-ul KV pe durata răspunsului, iar contexte lungi și concurența ridicată multiplică și mai mult amprenta. Când memoria GPU a cache-ului se epuizează, serviciul recurge la transferuri către disc sau loturi mai mici, iar economia unităților scade odată cu acestea. Cele 288 GB pe GPU ale B300 există pentru a păstra simultan ponderile și cache-urile de scară de raționament, iar creșterea densității FP4 reduce costul fiecărui token în plus.

Trei situații. Flote de inferență care susțin sarcini de raționament sau conținut lung, unde adâncimea cache-ului KV stabilește dimensiunea batch-ului și marja. Modele care presează peste cei 1,4 TB ai nodului B200. Și operatori care standardizează pe o rețea fabrică integrată de 800G pentru creștere multi-nod. Programele de antrenament și flotele de servire confortabile în interiorul a 1,4 TB sunt de obicei mai bine servite de sistemul Gigabyte HGX B200, iar modelele MillionMiner fiind incluse în citat.

Deoarece rețeaua a fost mutată pe placa de bază GPU. Sistemele din clasa B200 aveau o duzină de sloturi, în principal pentru a găzdui un adaptor de 400 Gb/s pe fiecare GPU; HGX B300 NVL8 integrează direct opt porturi OSFP de 800 Gb/s, astfel încât topologia cu un port pe GPU pe care o dorește GPUDirect RDMA este implementată la de două ori viteza. Cele două sloturi PCIe 5.0 rămase transportă stocare și rețea de gestionare, ceea ce este tot ce mai trebuie adăugat.

Procesoare Dual AMD EPYC serie 9005 sau 9004, atingând 192 de nuclee pe fractură pe seria 9005, cu douăzeci și patru module DDR5 la 6400 MT/s populate unul pe canal pentru lățime de bandă completă și scalare până la 6TB, mult peste piscina de GPU de 2,3TB. Stocarea utilizează opt locații frontale hot-swap E1.S NVMe pentru seturi de date locale. Proporțiile respectă principiile de dimensionare improve de restul catalogului, cu marjă.

Granița este domeniul NVLink. Acest nod conectează opt GPU într-un singur ansamblu coerent pe infrastructură dezvoltată pentru implementare în aer; sistemele la scară rack conectează 72 sub răcire pe lichid și un proiect de inginerie al facilității. Dacă paralelismul de antrenament are cu adevărat nevoie de mai mult de opt GPU într-un singur domeniu, scară rack este soluția. Pentru servirea chiar și a celor mai mari modele implementate și pentru antrenamentul compatibil cu opt GPU Blackwell Ultra, acest nod oferă generația fără angajament de facilități și se extinde în clusteruri peste rețeaua sa integrată de 800G.

Pe propriul sistem de bază al plăcii: opt porturi OSFP de 800 Gb/s, câte unul pentru fiecare GPU, rulând GPUDirect RDMA astfel încât gradientele și activările să se deplaseze între noduri fără a afecta CPU-ul. Topologia pe care o sistem B200-era o asamblează din plăci adăugate se livrează aici conform proiectului. MillionMiner oferă consultanță privind arhitectura switch-urilor și a rețelei atunci când o implementare depășește o singură mașină.

șase surse redundante Titanium de 6600W definesc limitele, plasând acest echipament în partea de vârf a clasei de nod unic transportabil aerian și clar în domeniul datacenter-urilor. MillionMiner confirmă consumul exact și planul termic al configurației specificate în ofertă, iar hosting-ul în propriile facilități ale MillionMiner este disponibil pentru echipele care preferă să nu furnizeze energie pentru rack la această scară.

Trimiteți detaliile privind sarcina de lucru, scalarea și implementarea prin formularul de ofertă. Un specialist MillionMiner confirmă configurația, eligibilitatea destinației conform reglementărilor de export din SUA aplicabile acceleratoarelor de tip Blackwell și planul de livrare. Fiecare sistem este testat înainte de expediere și livrat la nivel mondial DDP, cu taxele și vamele gestionate. Ghidajul pentru integrarea în rack și implementarea găzduită sunt ambele disponibile.