Mua các máy chủ GPU đã lắp ráp sẵn và trạm làm việc AI tại MillionMiner, được lắp đặt theo cấu hình, thử tải và vận chuyển sẵn sàng hoạt động. Các cấu hình có sẵn từ các trạm làm việc RTX 5090 đơn GPU chạy hệ thống với một GPU đến các hệ thống Threadripper PRO dual-GPU với 128 lane PCIe 5.0, đến các nút quad và 8-GPU, với một nút RTX 5090 8-GPU mang lại khoảng 838 TFLOPS FP32.…
Mỗi máy chủ mới được giao đi kèm bảo hành và DDP miễn phí toàn cầu, vì vậy giá thanh toán là tổng số tiền cuối cùng đã bao gồm thuế, với độ ổn định đã được xác nhận trước khi rời khỏi chúng tôi. Mua để tự vận hành hoặc triển khai vào Rechenzentrum của chúng tôi tại Mỹ với quản lý từ xa. Mua các máy chủ GPU và trạm làm việc AI dưới đây.
Supermicro SuperServer SYS-741GE-TNRT Máy chủ AI H100 4-GPU
Theo yêu cầu
—
Theo yêu cầu
Supermicro AS-4124GO-NART+ 8x A100 HGX AI Server
Theo yêu cầu
—
Theo yêu cầu
Hệ thống Deep Learning NVIDIA DGX A100 (8x A100, 640GB)
Theo yêu cầu
—
Theo yêu cầu
Exeton Quasar 640X 8x A100 Máy chủ AI (640GB NVLink)
Theo yêu cầu
—
Theo yêu cầu
Lenovo NVIDIA HGX H200 141GB 700W 8-GPU Máy chủ
Theo yêu cầu
—
Theo yêu cầu
Supermicro HGX H800 SuperServer SYS-821GE-TNHR
Theo yêu cầu
—
Theo yêu cầu
Máy chủ GIGABYTE G893-ZD1-AAX5 HGX B200 8-GPU
Theo yêu cầu
—
Theo yêu cầu
Máy chủ Gigabyte G492-ZD0 HGX A100 8-GPU, Dual AMD EPYC 7742, 4U (Đã qua sử dụng)
Theo yêu cầu
—
Theo yêu cầu
Supermicro GPU A+ Server AS-8126GS-NB3RT NVIDIA HGX B300 NVL8
Theo yêu cầu
—
Theo yêu cầu
Máy chủ GPU ASUS XA NB3I-E12 NVIDIA HGX B300 NVL8
Theo yêu cầu
—
Theo yêu cầu
Supermicro SYS-111C-NR-G1 1U Rackmount X13 UP Gold Series CloudDC SiêuMáy Chủ
Có hàng
—
$5,700.00
Supermicro SYS-521C-NR-G1 2U Đứng Rack X13 UP Bộ Series CloudDC SuperServer
Có hàng
—
$5,700.00
Hệ thống đạt tiêu chuẩn nhà máy
Đã cấu hình, kiểm tra và xác nhận chạy thử nghiệm ban đầu
Logistics vận chuyển hàng hóa
Bảo hiểm pallet và vận chuyển hàng không toàn cầu
Chấp nhận Crypto
Thanh toán bằng BTC, ETH, USDT và nhiều hơn nữa
Hỗ trợ Chuyên nghiệp
Kiến trúc sư hạ tầng AI sẵn sàng hỗ trợ
Một máy chủ AI không đơn thuần chỉ là một máy tính cá nhân có thêm GPU. Cơ sở hạ tầng AI nghiêm túc yêu cầu các nền tảng được thiết kế riêng: mạng lưới NVSwitch băng thông cao cho truyền thông GPU-to-GPU, bộ nhớ DDR5 dung lượng lớn, CPU chuẩn doanh nghiệp với đủ làn PCIe để cung cấp năng lượng cho từng GPU, lưu trữ NVMe cho I/O checkpoint nhanh, và hệ thống cấp nguồnRated cho hơn 10 kW mỗi đơn vị rack. Chúng tôi cung cấp các nền tảng máy chủ AI hoàn chỉnh — từ hệ thống tower 2-GPU dành cho phòng thí nghiệm nghiên cứu đến các nút GPU 8-GPU NVIDIA HGX H100/H200 và kiến trúc GB200 NVL72 quy mô rack mới — sẵn sàng triển khai ngay lập tức.
Số lượng GPU DGX H100
8 × H100 SXM5
Tổng cộng 640 GB HBM2e qua NVSwitch
Số lượng GPU NVL72
72 GPUs
GB200 trong một giá đỡ đơn — 1 đơn vị logic
DGX H100 Hiệu suất AI
32 PFLOPS
FP8 rỗng — kết hợp 8 × H100
Bộ nhớ HGX H200
1.1 TB HBM3e
8 × H200 SXM5 — tổng băng thông kết hợp 38,4 TB/s
8 × H100 SXM5, 640 GB
Siêu máy tính AI hoàn chỉnh trong một hộp. Mạng lưới NVSwitch đầy đủ với tốc độ 900 GB/s mỗi GPU. Dual Xeon hoặc AMD Epyc, 2 TB DDR5. Nền tảng tham chiếu cho AI doanh nghiệp.
8 × H200 SXM5, 1.1 TB
Người kế nhiệm của DGX H100. 4,8 TB/s HBM3e trên mỗi GPU. Ưu tiên cho suy luận mô hình lớn quy mô lớn nơi dung lượng bộ nhớ là yếu tố then chốt.
OEM platform (8-GPU)
Bảng GPU + phức hợp NVSwitch đã được gửi đến các đối tác OEM (Supermicro, Dell, HPE, Lenovo). Cho phép cấu trúc GPU giống hệt nhau trong khung máy chủ tùy chỉnh.
72 × GB200 GPUs
Hệ thống dạng khung đơn. 36 Bộ xử lý Grace CPU + 72 mô-đun GPU Blackwell. 1,44 ExaFLOPS FP4. Mạng NVLink 5 sợi—toàn bộ khung hoạt động như một GPU.
Up to 4 × 96 GB
Máy chủ dạng Workstation dành cho phòng nghiên cứu và các startup AI. Bộ xử lý Xeon W9 hoặc Threadripper Pro hai sừng, 4 × RTX PRO 6000 BW qua cặp Bridge NVLink.
2 × 80 GB HBM2e
Các nút suy luận tiết kiệm chi phí. Vỏ 2U tiêu chuẩn, khe PCIe 5.0 đôi. Phù hợp với colocate trong rack tiêu chuẩn mà không cần làm mát bằng chất lỏng.
4–8 × 24 GB PCIe
Phân tích dữ liệu mật độ cao, tiêu thụ điện năng thấp. GPU L4 cho phép single-slot công suất 72 W mỗi cái. Tối đa 8 GPU trong 1U với tổng công suất dưới 600 W — lý tưởng cho các PoPs cạnh co-lô.
Sự khác biệt cốt lõi giữa một máy chủ đa dụng và một máy chủ AI là trong cấu trúc GPU. Trong một máy chủ tiêu chuẩn, GPU giao tiếp qua PCIe — một kiến trúc bus có mức độ truyền dữ liệu khoảng 32–64 GB/s hai chiều mỗi khe cắm. Trong một máy chủ AI dựa trên NVSwitch, mỗi GPU trong hệ thống kết nối với tất cả các GPU khác cùng lúc qua NVSwitch ASIC với tốc độ 900 GB/s mỗi GPU (H100) hoặc 1,8 TB/s mỗi GPU (H200 / Blackwell). Đây không phải là một cải tiến gợi hạn chế — đó là một thay đổi chất lượng cho phép phân chia mô hình trên các GPU như thể chúng là một thiết bị lớn hơn duy nhất.
Hệ thống CPU và bộ nhớ phải phù hợp với yêu cầu băng thông của GPU. DGX H100 kết hợp công nghệ NVSwitch của 8 GPU với hai CPU Intel Xeon Platinum và 2 TB RAM ECC DDR5 — đủ bộ nhớ hệ thống để sắp xếp dữ liệu tập huấn, chạy quy trình tiền xử lý và quản lý I/O điểm kiểm tra mà không gây trở ngại. Các làn PCIe 5.0 được phân bổ cẩn thận để mỗi GPU có kết nối trực tiếp x16 với mạng CPU.
Cung cấp điện là một thách thức kỹ thuật riêng biệt. Một DGX H100 đầy tải tiêu thụ khoảng 10,2 kW — yêu cầu các mạch 2 × 30A, 240V tại Bắc Mỹ hoặc 3 pha 32A tại châu Âu. Hệ thống làm mát cũng đòi hỏi không kém: thiết kế tham khảo của NVIDIA sử dụng bộ trao đổi nhiệt phía sau hoặc làm mát bằng chất lỏng trực tiếp cho mô-đun GPU trong các cấu hình DGX. Lập kế hoạch nguồn điện và hệ thống làm mát cho cơ sở của bạn trước khi đặt hàng không phải là tùy chọn — đó là bước đi đầu tiên.
GB200 NVL72 là kiến trúc hệ thống tham vọng nhất của NVIDIA cho đến nay. Một rack duy nhất chứa 36 mô-đun CPU Grace và 72 chip GPU Blackwell GB200, tất cả kết nối qua mạng NVLink thế hệ thứ năm ở tốc độ 1,8 TB/giây trên mỗi GPU — cho phép toàn bộ rack hoạt động như một bộ gia tốc hợp lý duy nhất. Tổng khả năng tính toán sparse FP4 trên tất cả 72 GPU vượt quá 1,44 ExaFLOPS và bộ nhớ HBM3e tổng cộng đạt 13,5 TB.
Mỗi mô-đun GB200 kết hợp một CPU Grace Arm với hai chip GPU Blackwell qua NVLink-C2C ở tốc độ 900 GB/s — loại bỏ hoàn toàn giao diện PCIe giữa CPU và GPU. CPU đóng vai trò là bộ điều khiển bộ nhớ băng thông cao và bộ điều phối, không gây trở ngại. Thiết kế này làm cho NVL72 trở nên đặc biệt phù hợp cho suy luận mô hình trillion-parameter với độ trễ thấp: toàn bộ mô hình nằm trong bộ nhớ của rack, các phép tính tổng hợp tất cả diễn ra bên trong mạng NVLink, và không cần mạng liên nút để phục vụ mô hình đơn.
Về mặt cơ sở vật chất, NVL72 tiêu thụ tối đa 120 kW và yêu cầu làm mát bằng chất lỏng trực tiếp — hệ thống cấp nguồn ba pha chuyên dụng và hạ tầng làm mát bằng chất lỏng của cơ sở là bắt buộc. Kinh tế học rất hấp dẫn ở quy mô lớn: một rack NVL72 thay thế cho những gì trước đây yêu cầu hàng rào toàn bộ các nút DGX H100 cho cùng mức throughput suy luận tương đương.
Từ thí nghiệm quy mô phòng thí nghiệm đến triển khai quy mô lớn hyperscale — phù hợp tải công việc của bạn với cấp độ nền tảng phù hợp.
Tinh chỉnh mô hình, phát triển RAG, suy luận cục bộ, khả năng lặp lại nghiên cứu. Thích hợp để đặt dưới bàn hoặc trong giá tiêu chuẩn. Thường không cần nâng cấp cơ sở hạ tầng.
Điều chỉnh hoàn chỉnh các mô hình từ 13–70B. Phân tích dự liệu sản xuất cho các sản phẩm gốc AI. Yêu cầu nguồn điện 3 pha hoặc cấp nguồn kép 30A. Làm mát bằng không khí có thể thực hiện với bộ trao đổi nhiệt sau cửa.
Đào tạo đầy đủ tham số cho các mô hình 70–400B. Phân tích dữ liệu với độ trễ thấp cho các mô hình cực lớn. Gợi ý làm mát chất lỏng. Tiêu chuẩn ngành hiện tại cho các công việc AI nghiêm túc.
Tiền đào tạo mô hình trillion tham số và suy luận hàng loạt lớn. Làm mát lỏng toàn bộ và nguồn điện ba pha riêng biệt bắt buộc. Kiến trúc rack như một GPU thông qua NVLink 5.
Duyệt qua phạm vi đầy đủ các nền tảng máy chủ AI của chúng tôi ở trên, từ các nút 2-GPU loại nghiên cứu đến hệ thống dạng rack DGX H200 và GB200 NVL72. Đội ngũ của chúng tôi sẽ giúp bạn lập kế hoạch về nguồn điện, làm mát, mạng lưới và logistics từ đầu đến cuối.