Supermicro
Mẫu: SYS-821GE-TNHR
Yêu cầu Báo giá Máy chủ của bạn
Hãy告诉 chúng tôi về khối lượng công việc và nhu cầu triển khai của bạn. Chuyên gia của chúng tôi sẽ phản hồi trong vòng 24 giờ qua email, WhatsApp hoặc cuộc gọi.
Tại sao máy chủ này lại được báo giá theo đơn hàng
Các máy chủ này được cấu hình và báo giá theo đơn đặt hàng. Việc xây dựng, lưu trữ, mạng, bảo hành và tích hợp rack của bạn sẽ xác định mức giá cuối cùng, và địa điểm giao hàng của bạn sẽ quyết định phí vận chuyển và thuế nhập khẩu. Gửi biểu mẫu bên dưới và chuyên gia của chúng tôi sẽ phản hồi trong vòng 24 giờ với báo giá đầy đủ bao gồm phần cứng, bảo hành và giao hàng toàn cầu DDP.
Cảm ơn bạn! Chuyên gia của chúng tôi sẽ phản hồi trong vòng 24 giờ với báo giá tùy chỉnh của bạn.
Cách hoạt động đặt hàng máy chủ của bạn
Gửi biểu mẫu
Chia sẻ chi tiết về phân chia công việc & triển khai
Nhận báo giá của bạn
Hoàn tất giá trong vòng 24 giờ
Đánh giá cùng chuyên gia
Hoàn thiện cấu hình và bàn giao
Giao hàng
Đã vận chuyển và sẵn sàng để triển khai
Chính hãng
Phần cứng đã được kiểm tra
Toàn cầu
Vận chuyển toàn cầu
Hỗ trợ
Chuyên gia khai thác
Supermicro's 8U SuperServer được xây dựng dựa trên bo mạch chủ NVIDIA HGX H800 8-GPU: tám GPU H800 SXM với 640GB RAM HBM3 kết hợp, hiệu suất Transformer Engine Hopper FP8 đầy đủ, và liên kết NVSwitch, được host bởi hai bộ xử lý Intel Xeon Scalable với bộ nhớ DDR5 lên đến 8TB. Bộ xử lý Hopper thế hệ này đã đào tạo các mô hình tiên phong, trên nền tảng Supermicro với hệ thống làm mát không khí hoặc làm mát chất lỏng tùy chọn. Báo giá và vận chuyển toàn cầu DDP bởi MillionMiner.
Giá cả, thời gian dẫn đầu và các lựa chọn lưu trữ. Tư vấn cá nhân từ đội ngũ bán hàng của chúng tôi.
Giá cả, thời gian dẫn đầu và các lựa chọn lưu trữ. Tư vấn cá nhân từ đội ngũ bán hàng của chúng tôi.
Báo giá miễn phí, phản hồi trong 24h. Không gọi bán hàng.
4.7 / 5 trên Trustpilot
Đánh giá khách hàng đã xác minh
Hơn 30.000 trình khai thác đã được bàn giao
Đã vận chuyển toàn cầu kể từ năm 2020
Hơn 1.200 khách hàng trên toàn cầu
Được tin tưởng tại hơn 50 quốc gia
Hầu hết những gì người mua đọc về H800 đều mang tính miệt thị hoặc né tránh. Phiên bản chính xác hơn sẽ hữu ích hơn: H800 là phiên bản phù hợp với quy định xuất khẩu của H100, được xây dựng trên cùng một bộ vi xử lý Hopper, và câu trả lời rõ ràng về việc nó có phù hợp với triển khai của quý vị hay không khi quý vị biết được hai thông số kỹ thuật nào đã được thay đổi và liệu công việc của quý vị có liên quan đến chúng hay không. Điều gì giống hệt với H100. Bề mặt GPU, 80GB bộ nhớ HBM3 hoạt động ở băng thông đầy đủ, Tensor Cores thế hệ thứ tư, và toàn bộ đẳng cấp chính xác mà công việc AI thực tế sử dụng: FP8 qua Transformer Engine, BF16, FP16 và TF32. Một nút chứa tám GPU cung cấp 640GB bộ nhớ HBM3 hợp nhất, băng thông bộ nhớ tổng cộng trên 26 TB/s, và throughput FP8 nằm cùng phân khúc với nút H100, vượt quá 30 petaFLOPS. Phân vùng MIG vẫn còn nguyên, tối đa bảy phiên bản riêng biệt trên mỗi GPU, giúp một máy chủ có thể trình diễn hơn năm mươi phần của phần cứng phân chia cho nhiều khách thuê để thực hiện suy luận đa người thuê. Những gì đã bị giảm, và khi nó quan trọng. Đầu tiên, NVLink: 400 GB/s trên mỗi GPU thay vì 900. Trong một nút đơn, NVSwitch vẫn kết nối tất cả tám GPU theo kiểu mạng đầy đủ, và 400 GB/s vẫn hơn ba lần băng thông PCIe Gen 5, do đó quá trình huấn luyện, tinh chỉnh và suy luận trên một nút hầu như không bị ảnh hưởng. Việc giảm này ảnh hưởng đến quy mô biên giới nhiều nút, nơi việc đồng bộ hóa gradient trên hàng chục nút dựa vào từng gigabyte băng thông của mạng lưới. Thứ hai, FP64: giảm mạnh, điều này loại trừ H800 khỏi các mô phỏng khoa học chính xác kép. Đào tạo AI không sử dụng FP64. Nếu công việc của quý vị liên quan đến động lực học chất lỏng tính toán hoặc mô phỏng khí hậu, hãy mua hệ thống H100; nếu nó là các mô hình ngôn ngữ, thị giác hoặc đề xuất, thì việc giảm này không liên quan gì đến quý vị. Điểm chứng minh, trên hồ sơ. DeepSeek đã huấn luyện mô hình V3 và R1 trên các nhóm H800 và công bố các kết quả kỹ thuật. Chiến lược song song có kỷ luật trên GPU này đã tạo ra các mô hình cạnh tranh hàng đầu thế giới. Điều đó không khiến giảm NVLink biến mất; nó chứng tỏ rằng khả năng tính toán, bộ nhớ và throughput FP8 của H800 thực sự thuộc loại tiên phong, và hạn chế đó là một vấn đề kỹ thuật chứ không phải giới hạn tối đa. Máy chủ Supermicro. Đây là một SuperServer 8U với hai bộ xử lý Intel Xeon Scalable trên LGA-4677, lên đến 64 lõi và 128 luồng trên mỗi socket. Bộ nhớ mở rộng đến 8TB ECC DDR5 qua 32 khe DIMM, vượt qua quy tắc hệ thống bộ nhớ trên GPU nhiều lần và còn dư không gian cho tiền xử lý trong bộ nhớ mà các tuyến dữ liệu lớn cần. Lưu trữ gồm mười hai khay NVMe nóng-swaps và ba khay SATA cho dung lượng, với hai khe M.2 giúp hệ điều hành tránh khỏi đường dẫn dữ liệu tập hợp. Mạng lưới đi kèm hai cổng 10GbE tích hợp và tùy chọn 25GbE, cùng khả năng mở rộng PCIe để thêm adapter mạng lưới cho GPUDirect RDMA khi triển khai vượt quá một nút. Nguồn cung cấp là sáu bộ nguồn dự phòng 3000W; làm mát gồm mười quạt công nghiệp lớn chạy bằng khí, với khả năng làm mát bằng chất lỏng trực tiếp như một tùy chọn dành cho các địa điểm có mật độ nút cao. Hệ thống quản lý của Supermicro, SuperCloud Composer và Supermicro Server Manager, xử lý vận hành đội xe, cùng TPM 2.0 và Silicon Root of Trust phía dưới. Nó nằm ở vị trí nào trong danh mục này. So sánh với ba hệ thống A100, DGX A100, Supermicro AS-4124GO-NART+ và Exeton Quasar 640X, nút này tiên phong một thế hệ ở những điểm quan trọng: throughput của FP8 Transformer Engine mà thế hệ Ampere chưa có, HBM3 so với HBM2e, và cùng 640GB trên mỗi nút. So với các hệ thống H100 và H200, nền tảng Lenovo và ASUS HGX, H800 là vị trí giá trị trong thế hệ Hopper: hiệu năng một nút trong cùng phân khúc, với các giảm về NVLink và FP64 đã được tính giá. Người mua phù hợp với hệ này thực hiện huấn luyện, tinh chỉnh hoặc suy luận ở quy mô một đến vài nút và muốn kinh tế Hopper phản ánh điều đó. Người mua không phù hợp thực hiện mô phỏng FP64 hoặc huấn luyện đa nút ở quy mô cluster, và MillionMiner sẽ nói rõ điều đó trong cuộc trò chuyện báo giá chứ không phải sau khi giao hàng. ghi chú về quy định xuất khẩu: H800 chịu sự kiểm soát xuất khẩu của Hoa Kỳ, và MillionMiner xác nhận đủ điều kiện điểm đến trong mỗi báo giá. Mỗi hệ thống được cấu hình theo đơn đặt hàng, thử nghiệm và vận chuyển toàn cầu DDP gồm thuế và hải quan được xử lý. Dịch vụ hosting tại Rechenzentrum của MillionMiner cũng sẵn có cho các nhóm không muốn tự trang bị quá nhiều công suất rack tại chỗ.
H800 xứng đáng có một giới thiệu chân thành hơn những gì nó thường nhận được. Nó không phải là phiên bản thu gọn sau cùng. Đó là silicon H100: cùng kiến trúc Hopper, cùng 80GB HBM3 với băng thông bộ nhớ đầy đủ, cùng các Tensor Cores thế hệ thứ tư và Bộ xử lý Transformer FP8 định nghĩa thế hệ GPU này. Hai điều đã bị giảm để phù hợp với quy định xuất khẩu là băng thông NVLink, từ 900 xuống còn 400 GB/s mỗi GPU, và thông lượng FP64, điều này quan trọng cho mô phỏng khoa học và hầu như không ảnh hưởng đến AI. Mọi thứ mà một phiên chạy huấn luyện hoặc một đội dự đoán thực tế vận hành, bao gồm tính toán FP8, BF16, TF32 và băng thông HBM3, vẫn còn nguyên vẹn. Bằng chứng là công khai. DeepSeek đã huấn luyện V3 và R1, các mô hình đã thay đổi hướng đi của cuộc trò chuyện AI toàn cầu, trên các cluster của chính xác loại GPU này. Việc giảm NVLink là thực, và điều này thể hiện rõ trong quá trình đồng bộ gradient giữa các nút trong quy mô cluster lớn. Trong một nút duy nhất, nơi NVSwitch vẫn kết nối tất cả tám GPU trong một lưới hoàn chỉnh, việc tinh chỉnh, huấn luyện và dự đoán đều hoạt động theo tốc độ Hopper. Nền tảng Supermicro xung quanh bo mạch chủ được thiết kế rộng rãi. Hai bộ xử lý Intel Xeon Scalable với tối đa 64 lõi mỗi bộ xử lý đảm nhiệm xử lý sơ bộ và tải dữ liệu. 32 khe DIMM mở rộng tới 8TB ECC DDR5, cao hơn gấp một bậc so với 640GB GPU pool và vượt xa quy tắc kích thước mà những host thiếu dung lượng vi phạm. 12 khe NVMe cùng 3 khe SATA giữ các bộ dữ liệu cục bộ, 2 khe M.2 tách biệt đường khởi động, và 6 nguồn dự phòng 3000W cung cấp năng lượng cho khoảng 10 kilowatt tổng mức tiêu thụ. 10 quạt công nghiệp xử lý mát mẻ trong hệ thống, với hệ thống làm mát bằng chất lỏng sẵn có cho các triển khai chồng dày trong rack. Báo giá theo cấu hình và vận chuyển toàn cầu DDP bởi MillionMiner.
Các chuyên gia khai thác của chúng tôi có thể giúp bạn tìm ra miner phù hợp nhất cho cấu hình và ngân sách của bạn.
H800 là GPU đã chứng minh một quan điểm: DeepSeek đã đào tạo các mô hình tiền đề V3 và R1 của mình trên các cụm H800, sử dụng cùng silicon Hopper, 80GB HBM3 và FP8 Transformer Engine như H100. Supermicro SuperServer 8U này chứa tám chiếc trên bo mạch cơ sở NVSwitch, 640GB bộ nhớ GPU trên mỗi nút, đặt sau hai bộ xử lý Intel Xeon Scalable, lên tới 8TB DDR5 qua 32 khe DIMM, mười hai khe NVMe và sáu nguồn điện dự phòng 3000W. Mười quạt công nghiệp làm mát bằng không khí, làm mát bằng chất lỏng tùy chọn. Đào tạo và suy luận cấp Hopper, báo giá và vận chuyển toàn cầu DDP bởi MillionMiner.
Các cụm H800 đã được đào tạo DeepSeek V3 và R1. Cùng loại silicon Hopper, 80GB HBM3 và Processor Transformer FP8 như H100, đã được chứng minh tiên phong.
Tám GPU H800 SXM trên NVSwitch cung cấp hơn 30 petaFLOPS FP8 và 26 TB/s băng thông bộ nhớ tổng hợp. MIG chia mỗi GPU thành bảy phần.
Lên đến 8TB DDR5 qua 32 DIMMs, mười hai khe NVMe, sáu nguồn dự phòng 3000W, mười quạt làm mát bằng không khí với tùy chọn làm mát bằng chất lỏng.
NVIDIA
Liên hệ để biết giá cả
Supermicro
Liên hệ để biết giá cả
Gigabyte
Liên hệ để biết giá cả
Lenovo
Liên hệ để biết giá cả
H800 là phiên bản phù hợp với tiêu chuẩn xuất khẩu của H100, được xây dựng dựa trên cùng bộ silicon Hopper với 80GB HBM3 tốc độ đầy đủ và cùng với FP8 Transformer Engine. Hai thông số kỹ thuật đã được rút ngắn: băng thông NVLink, 400 GB/s mỗi GPU thay vì 900, và khả năng xử lý FP64, được sử dụng trong mô phỏng khoa học thay vì AI. Đối với đào tạo, tinh chỉnh và suy luận, khả năng tính toán và bộ nhớ bạn thực hiện phù hợp với H100.
Hồ sơ công khai trả lời điều này. DeepSeek đã huấn luyện V3 và R1, các mô hình tiên phong theo mọi tiêu chí, trên các cụm H800 và công bố kỹ thuật phía sau chúng. Tốc độ xử lý FP8 của GPU, băng thông HBM3 và kiến trúc Tensor Core đều thuộc loại H100 vì chúng là cùng loại silicon. Việc giảm NVLink là một yếu tố kỹ thuật ở quy mô đa nút, không phải là giới hạn về hiệu suất.
Ở quy mô cụm đa nút. Trong một máy chủ, NVSwitch vẫn kết nối tất cả tám GPU trong một mạng lưới đầy đủ với tốc độ 400 GB/s mỗi cái, hơn gấp ba lần PCIe Gen 5, do đó huấn luyện và tinh chỉnh đơn nút hầu như không bị ảnh hưởng. Đồng bộ hoá gradient qua hàng chục nút là nơi khoảng cách so với mạng lưới H100 900 GB/s mở rộng hơn. Người mua chạy một hoặc vài nút hiếm khi cảm nhận rõ; người mua lập kế hoạch cho các cụm lớn nên cân nhắc các hệ thống H100 và H200 trong danh mục này, và MillionMiner sẽ mô hình cả hai trong báo giá.
Không phải nếu công việc yêu cầu độ chính xác kép. Năng suất FP64 của H800 đã bị giảm đáng kể do quy định xuất khẩu, điều này khiến nó không phù hợp cho mô phỏng dòng chảy số, mô hình khí hậu và các công việc FP64 tương tự. Đối với những nhiệm vụ này, các hệ thống H100 và H200 trong danh mục này vẫn duy trì hiệu suất Tensor FP64 đầy đủ. Đối với đào tạo và suy luận AI, sử dụng FP8, BF16 và TF32, việc giảm hiệu suất là không liên quan.
Tám GPU H800 SXM với bộ nhớ HBM3 tổng hợp 640GB, băng thông bộ nhớ tổng hợp trên 26 TB/s, khả năng xử lý FP8 Transformer Engine vượt quá 30 petaFLOPS và kết nối NVSwitch dạng lưới đầy đủ. Mỗi GPU phân chia thành tối đa bảy phiên bản MIG, do đó nút có thể cung cấp hơn năm mươi phần GPU được cách ly phần cứng để phục vụ dự đoán đa khách thuê.
Hai bộ xử lý Intel Xeon Scalable trên LGA-4677, tối đa 64 lõi và 128 luồng mỗi socket, với 32 khe DIMM mở rộng lên tới 8TB DDR5 ECC. Lưu trữ gồm mười hai khe NVMe nóng-swappable và ba khe SATA, với hai khe M.2 giữ đường khởi động riêng biệt khỏi I/O của bộ dataset. Mạng tích hợp hai cổng 10GbE, tùy chọn 25GbE, và mở rộng PCIe cho card mạng Fabric. Supermicro's SuperCloud Composer và Server Manager quản lý đội ngũ, đi kèm TPM 2.0 và Silicon Root of Trust để đảm bảo an ninh nền tảng.
Không. Mười quạt công suất lớn làm mát nút trên không khí của trung tâm dữ liệu tiêu chuẩn, giúp triển khai bên trong các cơ sở bình thường. Làm mát bằng chất lỏng trực tiếp có sẵn như một tùy chọn cho các địa điểm xếp các nút với mật độ cao trong giá đỡ, và MillionMiner tư vấn về cấu hình phù hợp với cơ sở của quý vị trong báo giá.
Chỉ số công nghệ của AI đã tiến một bước vượt xa trước đây. Bộ xử lý Hopper FP8 Transformer Engine làm tăng gần gấp đôi hiệu suất đào tạo hiệu quả so với Ampere cùng bộ nhớ node, HBM3 vượt xa HBM2e của A100, và băng thông NVSwitch trên mỗi GPU tương đương với băng thông 600 GB/s của A100. Cả hai đều cung cấp 640GB mỗi node. Các đội nhóm lựa chọn giữa chúng đang cân nhắc giữa hiệu quả kinh tế của Ampere và khả năng xử lý của Hopper, và MillionMiner trình bày trung thực về cả hai.
Hiệu suất đơn nút nằm trong cùng phân loại với hệ thống H100, vì silicon, bộ nhớ và băng thông FP8 phù hợp. Nền tảng H100 và H200 chứng minh vị trí của chúng với NVLink đầy đủ 900 GB/s cho quy mô nhiều nút, FP64 đầy đủ cho HPC, và trong trường hợp H200 là 141GB HBM3e cho mỗi GPU. H800 là vị trí giá trị trong thế hệ Hopper dành cho các triển khai AI một hoặc vài nút. Nếu vượt qua nó, lộ trình nâng cấp đã có trong danh mục này.
Vui lòng gửi chi tiết công việc và triển khai của quý khách qua mẫu báo giá, và một chuyên gia của MillionMiner sẽ xác nhận cấu hình, khả năng đủ điều kiện của địa điểm theo quy định xuất khẩu của Mỹ áp dụng cho H800, cũng như kế hoạch giao hàng. Mỗi hệ thống đều được kiểm tra trước khi vận chuyển và giao hàng toàn cầu DDP, bao gồm các khoản thuế và thủ tục hải quan. Dịch vụ thuê chỗ trong các trung tâm dữ liệu của MillionMiner sẵn có như một phương án thay thế cho triển khai tại chỗ.