Supermicro
Μοντέλο: AS-8126GS-NB3RT
Η πλατφόρμα Supermicro 8U A+ για το ακροδέκτη NVIDIA HGX B300 NVL8: οκτώ GPU Blackwell Ultra B300 SXM με 288GB HBM3e η κάθε μία, που διαμοιράζουν 2,3TB GPU μνήμης ανά κόμβο πίσω από την πέμπτη γενιά NVLink και NVSwitch,… με ενσωματωμένες θύρες fabric 800 Gb/s στο ίδιο το ακροδέκτη. Διπλοί επεξεργαστές AMD EPYC 9005 ή 9004 σειράς, έως 6TB DDR5 6400, οκτώ θύρες E1.S NVMe, και έξι τροφοδοτικά Titanium των 6600W το στηρίζουν. Ο κόμβος inference και εκπαίδευσης της εποχής reasoning, προ quotation και αποστολή παγκοσμίως DDP από την MillionMiner.
Ζητήστε την προσφορά για τον διακομιστή σας
Πείτε μας τις ανάγκες φορτίου εργασίας και υλοποίησης. Ο ειδικός μας απαντά εντός 24 ωρών μέσω email, WhatsApp ή τηλεφώνου.
Γιατί αυτός ο διακομιστής αναφέρεται για παραγγελία
Αυτοί οι διακομιστές έχουν διαμορφωθεί και προσφερόμενοι κατόπιν παραγγελίας.Η διαμόρφωσή σας, ο αποθηκευτικός χώρος, το δίκτυο, η εγγύηση και η ενσωμάτωση σε rack καθορίζουν την τελική τιμή, ενώ ο προορισμός παράδοσης σας καθορίζει τα έξοδα αποστολής και τελωνείου.Υποβάλετε την παρακάτω φόρμα και ο ειδικός μας θα απαντήσει εντός 24 ωρών με πλήρη προσφορά που περιλαμβάνει υλικό, εγγύηση και παγκόσμια παράδοση DDP.
Ευχαριστούμε! Ο ειδικός μας θα απαντήσει εντός 24 ωρών με την προσαρμοσμένη προσφορά σας.
Οι τιμές και η διαθεσιμότητα μεταβάλλονται με την αγορά. Επιβεβαιώνουμε και τα δύο μαζί σας πριν η παραγγελία σας γίνει δεσμευτική. Έλεγχος τιμής και διαθεσιμότητας
Πώς λειτουργεί η παραγγελία του διακομιστή σας
Υποβάλετε τη φόρμα
Μοιραστείτε λεπτομέρειες φόρτου εργασίας & ανάπτυξης
Λάβετε την προσφορά σας
Ολοκληρωμένη τιμολόγηση εντός 24 ωρών
Ανασκόπηση με ειδικό
Ολοκλήρωση ρύθμισης και παράδοσης
Παράδοση
Αποσταλεί και έτοιμο για ανάπτυξη
Αυθεντικό
Δοκιμασμένο υλικό
Παγκοσμίως
Παγκόσμια αποστολή
Υποστήριξη
Ειδικοί στην εξόρυξη
Η πλατφόρμα Supermicro 8U A+ για το ακροδέκτη NVIDIA HGX B300 NVL8: οκτώ GPU Blackwell Ultra B300 SXM με 288GB HBM3e η κάθε μία, που διαμοιράζουν 2,3TB GPU μνήμης ανά κόμβο πίσω από την πέμπτη γενιά NVLink και NVSwitch,… με ενσωματωμένες θύρες fabric 800 Gb/s στο ίδιο το ακροδέκτη. Διπλοί επεξεργαστές AMD EPYC 9005 ή 9004 σειράς, έως 6TB DDR5 6400, οκτώ θύρες E1.S NVMe, και έξι τροφοδοτικά Titanium των 6600W το στηρίζουν. Ο κόμβος inference και εκπαίδευσης της εποχής reasoning, προ quotation και αποστολή παγκοσμίως DDP από την MillionMiner.
Τιμές, χρόνος παράδοσης και επιλογές hosting. Προσωπικές συμβουλές από την ομάδα πωλήσεών μας.
Τιμές, χρόνος παράδοσης και επιλογές hosting. Προσωπικές συμβουλές από την ομάδα πωλήσεών μας.
Το Blackwell Ultra είναι η πρώτη γενιά GPU σχεδιασμένη μετά την εκμάθηση από τη βιομηχανία σχετικά με το κόστος εξυπηρέτησης των μοντέλων reasoning. Το B200 απάντησε στο ερώτημα εκπαίδευσης· το B300 απαντά στο ερώτημα εποχής inference που ακολούθησε, και οι αλλαγές είναι συγκεκριμένες και όχι επιφανειακές. Αυτή η πλατφόρμα Supermicro A+ είναι ο κόμβος 8-GPU που ενσωματώνει αυτές τις αλλαγές. <br> Το GPU complex. Οκτώ NVIDIA Blackwell Ultra B300 SXM GPUs τοποθετούνται στην βάση HGX B300 NVL8, κάθε ένα με 288GB HBM3e, 60 τοις εκατό περισσότερα από το B200, συγκεντρώνοντας 2.304GB σε ολόκληρο τον κόμβο. Το πέμπτης γενιάς NVLink ενώνει κάθε GPU με 1,8 TB/s μέσω NVSwitch σε πλήρη mesh. Η NVIDIA… αξιολογεί το πυκνό throughput FP4 του B300 στα 1,5 φορές το B200, μια αύξηση που εστιάζεται ακριβώς εκεί όπου η υψηλή όγκου εξυπηρέτηση ζει, και το micro-tensor scaling του δεύτερης γενιάς Transformer Engine είναι αυτό που κάνει την inference τεσσάρων bits να διατηρεί την παραγωγική ακρίβεια. Η μνήμη bandwidth ανά GPU παραμένει στην κατηγορία των 8 TB/s· η χωρητικότητα είναι το βασικό σημείο, καθώς η χωρητικότητα είναι αυτό που εξαντλεί πρώτα τα workloads reasoning. <br> Γιατί η χωρητικότητα ορίζει την εποχή reasoning. Ένα μοντέλο που σκέφτεται πριν απαντήσει παράγει εσωτερικούς tokens, και κάθε ένα από αυτά καταλαμβάνει KV cache για τη διάρκειά της απάντησης. Εκτεταμένα ίχνη reasoning, μεγάλα παραθυρόθυρα συμφραζομένων, και υψηλός συγχρονισμός εξυπηρέτησης πολλαπλασιάζουν αυτό το αποτύπωμα. Σε μικρότερους κόμβους, το αποτέλεσμα είναι offloading, κατάρρευση batch-size, ή και τα δύο, και τα περιθώρια εξυπηρέτησης συρρικνώνονται. Ένας κόμβος 2,3TB διαθέτει βάρη frontier-scale και τις caches που παράγονται ταυτόχρονα, που είναι η διαφορά μεταξύ ενός μοντέλου που ταιριάζει και μιας ανάπτυξης που κερδίζει. <br> Η ενσωματωμένη υποδομή, και το τι αλλάζει σχετικά με το chassis. Η βάση HGX B300 NVL8 μεταφέρει τις δικές της δικτυακές συνδέσεις: οκτώ ports OSFP στα 800 Gb/s, ένα ανά GPU, διπλάσιο από το ρυθμό ανά θύρα των προηγούμενων γενεών add-in adapters. Αυτός είναι ο λόγος που ο πίνακας προδιαγραφών δείχνει μόνο δύο PCIe 5.0 slots επέκτασης, όπου συστήματα κατηγορίας B200 είχαν δώδεκα· οι δώδεκα υποδοχές υπήρχαν για NICs, και αυτά τώρα βρίσκονται στην baseboard. Για ανάπτυξη πολλαπλών κόμβων, το αποτέλεσμα είναι μια πιο καθαρή κατασκευή, ένας ταχύτερος fabric, και το topology GPUDirect RDMA που εγγυάται ο σχεδιασμός αντί να συναρμολογείται κατά παραγγελία. Τα δύο υπολειπόμενα slots μεταφέρουν αποθήκευση και διαχείριση δικτύου. <br> Ο host Supermicro. Διπλοί επεξεργαστές AMD EPYC 9005 ή 9004, έως 192 πυρήνες ανά socket στη γραμμή 9005, τροφοδοτούν την προεπεξεργασία, το tokenization και το φόρτωμα δεδομένων που απαιτούν οκτώ GPUs αυτής της κατηγορίας. Τεσσαράντα τέσσερα DDR5 modules στα 6400 MT/s γεμίζουν ένα ανά κανάλι σε δώδεκα κανάλια ανά επεξεργαστή και scalable μέχρι 6TB, διατηρώντας το layout πλήρους bandwidth ενώ βρίσκονται πολύ πάνω από την ομάδα GPU, σύμφωνα με τον κανόνα μεγέθους που διδάσκει αυτός ο κατάλογος, με αρκετό περιθώριο. Οκτώ μπροστινά hot-swap E1.S NVMe bays διατηρούν δεδομένα στην κόμη, και έξι τροφοδοτικά 6600W Titanium σε μια redundant διαμόρφωση ορίζει μια ενεργειακή έκταση που δεν αφήνει αμφιβολίες σχετικά με το τι είναι: μια μηχανή data center στην κορυφή της κατηγορίας single-node με αερόψυξη. <br> Η απόφαση κατά του HGX B200 σε αυτόν τον κατάλογο. Ο κόμβος Gigabyte B200 παρέχει 1,4TB και την ίδια γενιά NVLink, και για προγράμματα εκπαίδευσης και στόλους εξυπηρέτησης που λειτουργούν εντός αυτού του περιβάλλοντος μνήμης, παραμένει η λογική αγορά Blackwell. Το B300 κατακτά τη θέση του σε τρεις περιπτώσεις: στόλοι reasoning και inference με μεγάλη διάρκεια συμφραζομένων όπου το βάθος του KV cache καθορίζει το batch size και άρα την οικονομία μονάδας, αναπτύξεις που καλύπτουν frontier-scale μοντέλα που ξεπερνούν το 1,4TB, και χειριστές που τυποποιούν το ενσωματωμένο fabric 800G για ανάπτυξη πολλαπλών κόμβων. Κάτω από αυτά τα όρια, το B200 κερδίζει σε οικονομία· σε αυτά, το B300 είναι ο μόνος κόμβος που ταιριάζει. <br> Η απόφαση κατά του rack-scale. Πάνω σε αυτή τη μηχανή βρίσκονται τα συστήματα GB200 και GB300, όπου 72 GPUs μοιράζονται ένα domain NVLink υπό υγρό ψύξη και εγκαταστάσεις μηχανικού. Η γραμμή ορίου παραμένει σταθερή: αν η παράλληλη εκπαίδευση ταιριάζει πραγματικά περισσότερο από οκτώ GPUs σε ένα ενιαίο συνεκτικό domain, η rack-scale είναι η λύση. Για όλα όσα ταιριάζουν με οκτώ Blackwell Ultra GPUs, το οποίο τώρα περιλαμβάνει την εξυπηρέτηση των μεγαλύτερων αναπτυγμένων μοντέλων, αυτός ο κόμβος παρέχει τη γενιά χωρίς το project εγκατάστασης και scalable έξω μέσω του ενσωματωμένου fabric 800G. <br> Εξαγωγική συμμόρφωση και παραγγελίες. Οι Blackwell-class επιταχυντές υπάγονται στον ελέγχο εξαγωγής των ΗΠΑ, και η MillionMiner επιβεβαιώνει την επιλεξιμότητα προορισμού ως μέρος κάθε προσφοράς. Κάθε σύστημα διαμορφώνεται κατόπιν παραγγελίας, δοκιμάζεται και αποστέλλεται παγκοσμίως DDP με τελωνεία και δασμούς χειρισμένα. Ο προγραμματισμός ανάπτυξης και η φιλοξενία στα δικά τους data centers της MillionMiner είναι διαθέσιμα για ομάδες που προτιμούν να μην επωμιστούν την παροχή ρεύματος rack σε αυτήν την κλίμακα επί τόπου.
Τα οικονομικά της inference άλλαξαν όταν άρχισαν οι μοντέλα να συλλογίζονται. Μια απάντηση με αλυσίδα σκέψης καίει δέκα έως εκατό φορές τα tokens μιας άμεσης απάντησης, κάθε ίχνος συλλογισμού αυξάνει την KV cache και η παροχή αυτής με κερδοφόρο τρόπο σταμάτησε να είναι πρόβλημα υπολογιστικής ισχύος και έγινε πρόβλημα μνήμης και ακρίβειας. Το Blackwell Ultra είναι η άμεση απάντηση της NVIDIA, και αυτή η πλατφόρμα Supermicro είναι η μορφή με 8-GPU που διατίθεται. Η απάντηση στη μνήμη: 288GB HBM3e ανά GPU, 60 τοις εκατό περισσότερο από τα 180GB… του B200, συγκεντρώνοντας 2,3TB σε ολόκληρο το κόμβο. Αυτό το περιθώριο είναι αυτό που στηρίζει τα frontier μοντέλα μαζί με τις μακριές KV caches που παράγουν τα ίχνη συλλογισμού και τα Extended Context Windows, χωρίς την offloading που σκοτώνει την latency παροχής. Η απάντηση στην ακρίβεια: η dense FP4 του NVIDIA B300 αποδίδει 1,5 φορές περισσότερο από το B200, με throughput στόχο άμεσα τα inference υψηλής όγκου όπου η σερβίρισμα με τέσσερις bits και micro-tensor scaling διατηρεί την ακρίβεια και μειώνει το κόστος ανά token. Η απάντηση στη Fabric: η βάση HGX B300 NVL8 ενσωματώνει άμεσα οκτώ ports OSFP 800 Gb/s, έναν ανά GPU με διπλάσιο ρυθμό από την προηγούμενη γενιά, γι' αυτό το πλαίσιο αυτό χρειάζεται μόνο δύο PCIe expansion slots όπου τα συστήματα B200 χρειάζονταν δώδεκα. Το cluster networking δεν είναι πλέον πρόσθετο, είναι μέρος του GPU complex. Ο Host της Supermicro διατηρεί τις αναλογίες σωστές. Διπλοί επεξεργαστές AMD EPYC 9005 ή 9004 σειράς φτάνουν τους 192 πυρήνες ανά socket για pipeline με πολλά preprocessing, είκοσι τέσσερα DDR5 modules στα 6400 MT/s φτάνουν τα 6TB, πολύ πάνω από το 2,3TB pool GPU, και οκτώ front hot-swap E1.S NVMe bays διατηρούν τα datasets τοπικά. Έξι τροφοδοτικά Titanium 6600W σε εφεδρική διάταξη μεταφέρουν την κάλυψη. Αναφερθείς στην διαμόρφωση και αποστολή σε όλο τον κόσμο DDP από την MillionMiner.
Οι ειδικοί μας στον mining μπορούν να σας βοηθήσουν να βρείτε τον ιδανικό miner για την εγκατάστασή σας και τον προϋπολογισμό σας.
Ο μεγαλύτερος μεμονωμένος χώρος μνήμης σε αυτόν τον κατάλογο: οκτώ GPU NVIDIA Blackwell Ultra B300 SXM με 288GB HBM3e η καθεμία, 2,3TB ανά κόμβο, ενωμένοι μέσω πέμπτης γενιάς NVLink στα 1,8 TB/s ανά GPU μέσω NVSwitch. Η NVIDIA αξιολογεί την πυκνή FP4 του B300 σε 1,5 φορές τον B200, και η βάση HGX B300 NVL8 ενσωματώνει το δικό της fabric 800 Gb/s, οκτώ θύρες OSFP, οπότε η ομαδοποίηση δεν χρειάζεται πρόσθετες κάρτες. Ο Host Microsupermicro το φιλοξενεί σε διπύρηνους επεξεργαστές AMD EPYC 9005 ή 9004 με μέχρι 6TB DDR5 6400, οκτώ θύρες E1.S NVMe… και έξι τροφοδοτικά Titanium 6600W σε 8U. Αναφορά και αποστολή παγκοσμίως DDP από την MillionMiner.
Οκτώ γραφικά Ultra B300 SXM Blackwell με 288GB το καθένα, 60 τοις εκατό περισσότερο από το B200. Τα βάρη Frontier και οι KV caches λόγου κλίμακας ταιριάζουν μεταξύ τους.
Η NVIDIA αποτιμά το dense FP4 στα 1,5x του B200. Η εξυπηρέτηση chain-of-thought, το μεγάλο μήκος του πλαισίου και η υψηλή σύγχρονη συνεργασία είναι αυτά που αυτή η κόμβος τιμολογεί σωστά.
Οκτώ ενσωματωμένες θύρες OSFP στα 800 Gb/s, μία ανά GPU. Ο ομαδοποιητής σχεδιάζεται από την αρχή, όχι προσθέτοντας, και η δομή λειτουργεί στη διπλάσια ταχύτητα από πριν.
HGX B300 NVL8 είναι το δομικό στοιχείο των 8-GPU Blackwell Ultra της NVIDIA: οκτώ GPUs B300 SXM, το δίκτυο NVSwitch που τα ενώνει στα 1,8 TB/s το καθένα και ενσωματωμένες θύρες δικτύου 800 Gb/s, προμηθεύονται σε κατασκευαστές όπως η Supermicro. Σε σύγκριση με το B200, η μνήμη αυξάνεται κατά 60% στα 288GB HBM3e ανά GPU, η πυκνή ροή FP4 της NVIDIA αξιολογείται κατά 1,5 φορές υψηλότερη και οι θύρες fabric διπλασιάζονται στα 800 Gb/s ενώ μεταφέρονται στην ίδια την πλακέτα.
2,304GB συλλογικής HBM3e σε οκτώ GPU, πέμπτης γενιάς NVLink στα 1,8 TB/s ανά GPU μέσω NVSwitch, πυκνή διαφορά FP4 σύμφωνα με την NVIDIA κατά 1,5 φορές το HGX B200, και οκτώ ενσωματωμένες θύρες διασύνδεσης 800 Gb/s. Σε όρους φόρτου εργασίας: τα μοντέλα κλίμακας frontier εξυπηρετούν με πλήρη χώρο κεφαλίδας KV cache, μοντέλα εκατοντάδων δισεκατομμυρίων παραμέτρων προσαρμόζονται με πλήρη ακρίβεια σε ένα κόμβο, και στόλοι λογικής διατηρούν μεγέθη παρτίδων που συρρικνώνονται σε μικρότερες μνήμες.
Επειδή πολλαπλασιάζουν τον αριθμό των tokens. Ένα μοντέλο που σκέφτεται πριν απαντήσει δημιουργεί εσωτερικές αλυσίδες σκέψης, κάθε token από τις οποίες καταλαμβάνει την cache KV κατά τη διάρκεια της απάντησης, και τα μεγάλα πλαίσια και η υψηλή ταυτοχρονία πολλαπλασιάζουν περαιτέρω το αποτύπωμα. Όταν η cache εξαντλεί τη μνήμη GPU, η παροχή υπηρεσιών πέφτει στην εκφόρτωση ή σε μικρότερες παρτίδες, και η οικονομική αποδοτικότητα μειώνεται. Τα 288GB ανά GPU του B300 υπάρχουν για να φιλοξενούν τα βάρη και τις caches μεγάλης κλίμακας σκέψης ταυτόχρονα, και η πυκνή αύξηση FP4 μειώνει το κόστος κάθε ενός από αυτά τα επιπλέον tokens.
Τρεις καταστάσεις. Συστάδες συμπερασμάτων που εξυπηρετούν εργασίες λογικής ή μεγάλου περιεχομένου όπου το βάθος cache KV καθορίζει το μέγεθος παρτίδας και το περιθώριο. Μοντέλα που πιέζουν πέρα από τον κόμβο B200 με 1,4ΤΒ. Και χειριστές που τυποποιούν σε ενσωματωμένο fabric 800G για πολλαπλή ανάπτυξη κόμβων. Τα προγράμματα εκπαίδευσης και οι συστάδες παροχής που είναι άνετοι μέσα στα 1,4ΤΒ συνήθως εξυπηρετούνται καλύτερα από το σύστημα Gigabyte HGX B200, και μοντέλα MillionMiner τόσο στην προσφορά.
Καθώς το δίκτυο μεταφέρθηκε στη βάση GPU. Τα συστήματα κλάσης B200 έχουν περίπου ένα ντουζίνα υποδοχές κυρίως για να φιλοξενήσουν μια κάρτα 400 Gb/s ανά GPU· τα HGX B300 NVL8 ενσωματώνουν απευθείας οκτώ θύρες OSFP των 800 Gb/s, έτσι η τοπολογία μία θύρα ανά GPU που επιδιώκει το GPUDirect RDMA είναι ενσωματωμένη με διπλάσιο ρυθμό. Οι δύο υπόλοιπες υποδοχές PCIe 5.0 χρησιμοποιούνται για αποθηκευτικό χώρο και δίκτυα διαχείρισης, που είναι όλα όσα απομένουν να προστεθούν.
Διπλοί επεξεργαστές AMD EPYC 9005 ή 9004 σειράς, που φτάνουν τους 192 πυρήνες ανά υποδοχή στη γραμμή 9005, με είκοσι τέσσερα DDR5 module στα 6400 MT/s, τοποθετημένα ένα ανά κανάλι για πλήρη εύρος ζώνης και κλιμάκωση έως 6TB, πολύ πάνω από την pool GPU των 2,3TB. Ο αποθηκευτικός χώρος διαθέτει οκτώ μπροστινά E1.S NVMe bays με hot-swap για τοπικά δεδομένα. Οι αναλογίες ακολουθούν τους κανόνες μεγέθους που διδάσκει το υπόλοιπο αυτού του καταλόγου, με περιθώριο.
Το όριο είναι το πεδίο NVLink. Αυτός ο κόμβος ενώνει οκτώ GPU σε ένα συνεκτικό υφαντό σε υποδομή που διατίθεται εύκολα στον αέρα· συστήματα σε διαστάσεις rack ενώνουν 72 υπό υδάτινη ψύξη και ένα έργο μηχανολογίας εγκαταστάσεων. Εάν ο παραλληλισμός εκπαίδευσης πραγματικά χρειάζεται περισσότερα από οκτώ GPU σε ένα πεδίο, η διαστάσεις rack είναι η λύση. Για την παροχή υπηρεσιών ακόμη και των μεγαλύτερων αναπτυγμένων μοντέλων και για εκπαίδευση που ταιριάζει σε οκτώ Blackwell Ultra GPU, αυτός ο κόμβος παρέχει την γενεά χωρίς την δέσμευση εγκαταστάσεων και δίκτυα προς τα έξω μέσω του ενσωματωμένου δικτύου 800G.
Επάνω στο ίδιο το υλικό της βάσης: οκτώ θύρες OSFP 800 Gb/s, μία ανά GPU,που τρέχουν GPUDirect RDMA έτσι ώστε τα gradients και οι ενεργοποιήσεις να μετακινούνται μεταξύ των κόμβων χωρίς την παρέμβαση της CPU. Η τοπολογία που οι συστήματα της εποχής B200 συγκροτούν από πρόσθετες κάρτες διανομέα αποστέλλεται εδώ κατά σχεδιασμό. Η MillionMiner συμβουλεύει σχετικά με τη διαμόρφωση switch και fabric όταν μια εγκατάσταση μεγαλώνει πέραν από μία μηχανή.
Έξι εφεδρικές τροφοδοσίες Titanium επιπέδου 6600W ορίζουν το πεδίο, το οποίο το κατατάσσει στην κορυφή της κατηγορίας αέρα-εγκαταστάσιμου μοναδικού κόμβου και σαφώς στον χώρο των data center. Η MillionMiner επιβεβαιώνει την ακριβή κατανάλωση και το θερμικό σχέδιο της συγκεκριμένης διαμόρφωσης κατά τη διάρκεια της προσφοράς, και η φιλοξενία στις δικές της εγκαταστάσεις της MillionMiner είναι διαθέσιμη για ομάδες που προτιμούν να μην απαιτούν τροφοδοσία ράφια σε αυτή την κλίμακα.
Υποβάλετε τις λεπτομέρειες φόρτου εργασίας, κλίμακας και ανάπτυξης μέσω της φόρμας προσφοράς. Ένας ειδικός της MillionMiner επιβεβαιώνει τη διαμόρφωση, την επιλεξιμότητα προορισμού σύμφωνα με τους αμερικανικούς ελέγχους εξαγωγών που ισχύουν για τους Blackwell-class επιταχυντές και το σχέδιο παράδοσης. Κάθε σύστημα δοκιμάζεται πριν από την αποστολή και παραδίδεται παγκοσμίως DDP με τις εισφορές και τους δασμούς να καλύπτονται. Οδηγίες ολοκλήρωσης rack και ανάπτυξη φιλοξενίας είναι διαθέσιμες και οι δύο.