Million Miner Logo

Mua Máy chủ GPU và Máy trạm AI: Đã lắp ráp, Được kiểm tra, Sẵn sàng vận hành

Mua các máy chủ GPU đã lắp ráp sẵn và trạm làm việc AI tại MillionMiner, được lắp đặt theo cấu hình, thử tải và vận chuyển sẵn sàng hoạt động. Các cấu hình có sẵn từ các trạm làm việc RTX 5090 đơn GPU chạy hệ thống với một GPU đến các hệ thống Threadripper PRO dual-GPU với 128 lane PCIe 5.0, đến các nút quad và 8-GPU, với một nút RTX 5090 8-GPU mang lại khoảng 838 TFLOPS FP32.

Mỗi máy chủ mới được giao đi kèm bảo hành và DDP miễn phí toàn cầu, vì vậy giá thanh toán là tổng số tiền cuối cùng đã bao gồm thuế, với độ ổn định đã được xác nhận trước khi rời khỏi chúng tôi. Mua để tự vận hành hoặc triển khai vào Rechenzentrum của chúng tôi tại Mỹ với quản lý từ xa. Mua các máy chủ GPU và trạm làm việc AI dưới đây.

47 sản phẩm
Theo yêu cầu
Supermicro SuperServer SYS-741GE-TNRT 4-GPU H100 AI Server
Supermicro

Supermicro SuperServer SYS-741GE-TNRT Máy chủ AI H100 4-GPU

Giá cả Theo yêu cầu
Xem sản phẩm
Theo yêu cầu
SUPERMICRO 8x A100 AI AS-4124GO-NART+ Server
Supermicro

Supermicro AS-4124GO-NART+ 8x A100 HGX AI Server

Giá cả Theo yêu cầu
Xem sản phẩm
Theo yêu cầu
NVIDIA DGX A100 Deep Learning System (8x A100, 640GB)
NVIDIA

Hệ thống Deep Learning NVIDIA DGX A100 (8x A100, 640GB)

Giá cả Theo yêu cầu
Xem sản phẩm
Theo yêu cầu
Exeton Quasar 640X AI Server

Exeton Quasar 640X 8x A100 Máy chủ AI (640GB NVLink)

Giá cả Theo yêu cầu
Xem sản phẩm
Theo yêu cầu
Lenovo NVIDIA HGX H200 141GB 700W 8-GPU Server
Lenovo

Lenovo NVIDIA HGX H200 141GB 700W 8-GPU Máy chủ

Giá cả Theo yêu cầu
Xem sản phẩm
Theo yêu cầu
Supermicro HGX H800 SuperServer SYS-821GE-TNHR
Supermicro

Supermicro HGX H800 SuperServer SYS-821GE-TNHR

Giá cả Theo yêu cầu
Xem sản phẩm
Theo yêu cầu
GIGABYTE G893-ZD1-AAX5 HGX™ B200 8-GPU SERVER
Gigabyte

Máy chủ GIGABYTE G893-ZD1-AAX5 HGX B200 8-GPU

Giá cả Theo yêu cầu
Xem sản phẩm
Theo yêu cầu
Gigabyte G492-ZD0 HPC/AI Server – AMD EPYC™ 7742 – 4U DP HGX™ A100 8-GPU (USED)
Gigabyte

Máy chủ Gigabyte G492-ZD0 HGX A100 8-GPU, Dual AMD EPYC 7742, 4U (Đã qua sử dụng)

Giá cả Theo yêu cầu
Xem sản phẩm
Theo yêu cầu
Supermicro GPU A+ Server AS-8126GS-NB3RT NVIDIA HGX B300 NVL8
Supermicro

Supermicro GPU A+ Server AS-8126GS-NB3RT NVIDIA HGX B300 NVL8

Giá cả Theo yêu cầu
Xem sản phẩm
Theo yêu cầu
ASUS XA NB3I-E12 GPU Server
ASUS

Máy chủ GPU ASUS XA NB3I-E12 NVIDIA HGX B300 NVL8

Giá cả Theo yêu cầu
Xem sản phẩm
Có hàng
Supermicro SYS-111C-NR-G1 1U Rackmount X13 UP Gold Series CloudDC SuperServer
Supermicro

Supermicro SYS-111C-NR-G1 1U Rackmount X13 UP Gold Series CloudDC SiêuMáy Chủ

Giá cả $5,700.00
Xem sản phẩm
Có hàng
Supermicro SYS-521C-NR-G1 2U Rackmount X13 UP Gold Series CloudDC SuperServer
Supermicro

Supermicro SYS-521C-NR-G1 2U Đứng Rack X13 UP Bộ Series CloudDC SuperServer

Giá cả $5,700.00
Xem sản phẩm
Đang hiển thị 12 trong 47

Hệ thống đạt tiêu chuẩn nhà máy

Đã cấu hình, kiểm tra và xác nhận chạy thử nghiệm ban đầu

Logistics vận chuyển hàng hóa

Bảo hiểm pallet và vận chuyển hàng không toàn cầu

Chấp nhận Crypto

Thanh toán bằng BTC, ETH, USDT và nhiều hơn nữa

Hỗ trợ Chuyên nghiệp

Kiến trúc sư hạ tầng AI sẵn sàng hỗ trợ

Hệ thống Máy chủ AI

Máy chủ AI đa GPU: Từ trạm làm việc 2 GPU đến nút HGX 8 GPU

Một máy chủ AI không đơn thuần chỉ là một máy tính cá nhân có thêm GPU. Cơ sở hạ tầng AI nghiêm túc yêu cầu các nền tảng được thiết kế riêng: mạng lưới NVSwitch băng thông cao cho truyền thông GPU-to-GPU, bộ nhớ DDR5 dung lượng lớn, CPU chuẩn doanh nghiệp với đủ làn PCIe để cung cấp năng lượng cho từng GPU, lưu trữ NVMe cho I/O checkpoint nhanh, và hệ thống cấp nguồnRated cho hơn 10 kW mỗi đơn vị rack. Chúng tôi cung cấp các nền tảng máy chủ AI hoàn chỉnh — từ hệ thống tower 2-GPU dành cho phòng thí nghiệm nghiên cứu đến các nút GPU 8-GPU NVIDIA HGX H100/H200 và kiến trúc GB200 NVL72 quy mô rack mới — sẵn sàng triển khai ngay lập tức.

Số lượng GPU DGX H100

8 × H100 SXM5

Tổng cộng 640 GB HBM2e qua NVSwitch

Số lượng GPU NVL72

72 GPUs

GB200 trong một giá đỡ đơn — 1 đơn vị logic

DGX H100 Hiệu suất AI

32 PFLOPS

FP8 rỗng — kết hợp 8 × H100

Bộ nhớ HGX H200

1.1 TB HBM3e

8 × H200 SXM5 — tổng băng thông kết hợp 38,4 TB/s


So sánh nền tảng máy chủ AI

Các nền tảng chính chúng tôi cung cấp

NVIDIA DGX H100

8 × H100 SXM5, 640 GB

Siêu máy tính AI hoàn chỉnh trong một hộp. Mạng lưới NVSwitch đầy đủ với tốc độ 900 GB/s mỗi GPU. Dual Xeon hoặc AMD Epyc, 2 TB DDR5. Nền tảng tham chiếu cho AI doanh nghiệp.

NVIDIA DGX H200

8 × H200 SXM5, 1.1 TB

Người kế nhiệm của DGX H100. 4,8 TB/s HBM3e trên mỗi GPU. Ưu tiên cho suy luận mô hình lớn quy mô lớn nơi dung lượng bộ nhớ là yếu tố then chốt.

NVIDIA HGX H100/H200

OEM platform (8-GPU)

Bảng GPU + phức hợp NVSwitch đã được gửi đến các đối tác OEM (Supermicro, Dell, HPE, Lenovo). Cho phép cấu trúc GPU giống hệt nhau trong khung máy chủ tùy chỉnh.

NVIDIA GB200 NVL72

72 × GB200 GPUs

Hệ thống dạng khung đơn. 36 Bộ xử lý Grace CPU + 72 mô-đun GPU Blackwell. 1,44 ExaFLOPS FP4. Mạng NVLink 5 sợi—toàn bộ khung hoạt động như một GPU.

4-GPU Tower / Rack (RTX PRO 6000)

Up to 4 × 96 GB

Máy chủ dạng Workstation dành cho phòng nghiên cứu và các startup AI. Bộ xử lý Xeon W9 hoặc Threadripper Pro hai sừng, 4 × RTX PRO 6000 BW qua cặp Bridge NVLink.

2-GPU Inference Server (A100 / H100 PCIe)

2 × 80 GB HBM2e

Các nút suy luận tiết kiệm chi phí. Vỏ 2U tiêu chuẩn, khe PCIe 5.0 đôi. Phù hợp với colocate trong rack tiêu chuẩn mà không cần làm mát bằng chất lỏng.

1U Edge Inference (L4 / A2)

4–8 × 24 GB PCIe

Phân tích dữ liệu mật độ cao, tiêu thụ điện năng thấp. GPU L4 cho phép single-slot công suất 72 W mỗi cái. Tối đa 8 GPU trong 1U với tổng công suất dưới 600 W — lý tưởng cho các PoPs cạnh co-lô.

Kiến trúc đằng sau các máy Chủ AI

Tại sao Máy Chủ AI Về Cơ Bản Khác Với Máy Chủ Tiêu Chuẩn

Sự khác biệt cốt lõi giữa một máy chủ đa dụng và một máy chủ AI là trong cấu trúc GPU. Trong một máy chủ tiêu chuẩn, GPU giao tiếp qua PCIe — một kiến trúc bus có mức độ truyền dữ liệu khoảng 32–64 GB/s hai chiều mỗi khe cắm. Trong một máy chủ AI dựa trên NVSwitch, mỗi GPU trong hệ thống kết nối với tất cả các GPU khác cùng lúc qua NVSwitch ASIC với tốc độ 900 GB/s mỗi GPU (H100) hoặc 1,8 TB/s mỗi GPU (H200 / Blackwell). Đây không phải là một cải tiến gợi hạn chế — đó là một thay đổi chất lượng cho phép phân chia mô hình trên các GPU như thể chúng là một thiết bị lớn hơn duy nhất.

Hệ thống CPU và bộ nhớ phải phù hợp với yêu cầu băng thông của GPU. DGX H100 kết hợp công nghệ NVSwitch của 8 GPU với hai CPU Intel Xeon Platinum và 2 TB RAM ECC DDR5 — đủ bộ nhớ hệ thống để sắp xếp dữ liệu tập huấn, chạy quy trình tiền xử lý và quản lý I/O điểm kiểm tra mà không gây trở ngại. Các làn PCIe 5.0 được phân bổ cẩn thận để mỗi GPU có kết nối trực tiếp x16 với mạng CPU.

Cung cấp điện là một thách thức kỹ thuật riêng biệt. Một DGX H100 đầy tải tiêu thụ khoảng 10,2 kW — yêu cầu các mạch 2 × 30A, 240V tại Bắc Mỹ hoặc 3 pha 32A tại châu Âu. Hệ thống làm mát cũng đòi hỏi không kém: thiết kế tham khảo của NVIDIA sử dụng bộ trao đổi nhiệt phía sau hoặc làm mát bằng chất lỏng trực tiếp cho mô-đun GPU trong các cấu hình DGX. Lập kế hoạch nguồn điện và hệ thống làm mát cho cơ sở của bạn trước khi đặt hàng không phải là tùy chọn — đó là bước đi đầu tiên.


AI quy mô rack

NVIDIA GB200 NVL72: 72 GPU như Một Bộ Tăng Tốc Logic

GB200 NVL72 là kiến trúc hệ thống tham vọng nhất của NVIDIA cho đến nay. Một rack duy nhất chứa 36 mô-đun CPU Grace và 72 chip GPU Blackwell GB200, tất cả kết nối qua mạng NVLink thế hệ thứ năm ở tốc độ 1,8 TB/giây trên mỗi GPU — cho phép toàn bộ rack hoạt động như một bộ gia tốc hợp lý duy nhất. Tổng khả năng tính toán sparse FP4 trên tất cả 72 GPU vượt quá 1,44 ExaFLOPS và bộ nhớ HBM3e tổng cộng đạt 13,5 TB.

Mỗi mô-đun GB200 kết hợp một CPU Grace Arm với hai chip GPU Blackwell qua NVLink-C2C ở tốc độ 900 GB/s — loại bỏ hoàn toàn giao diện PCIe giữa CPU và GPU. CPU đóng vai trò là bộ điều khiển bộ nhớ băng thông cao và bộ điều phối, không gây trở ngại. Thiết kế này làm cho NVL72 trở nên đặc biệt phù hợp cho suy luận mô hình trillion-parameter với độ trễ thấp: toàn bộ mô hình nằm trong bộ nhớ của rack, các phép tính tổng hợp tất cả diễn ra bên trong mạng NVLink, và không cần mạng liên nút để phục vụ mô hình đơn.

Về mặt cơ sở vật chất, NVL72 tiêu thụ tối đa 120 kW và yêu cầu làm mát bằng chất lỏng trực tiếp — hệ thống cấp nguồn ba pha chuyên dụng và hạ tầng làm mát bằng chất lỏng của cơ sở là bắt buộc. Kinh tế học rất hấp dẫn ở quy mô lớn: một rack NVL72 thay thế cho những gì trước đây yêu cầu hàng rào toàn bộ các nút DGX H100 cho cùng mức throughput suy luận tương đương.

Thông số kỹ thuật GB200 NVL72

Bảng thông số kỹ thuật toàn bộ khung rack

GPU chết 72 × Blackwell GB200
Mô-đun CPU 36 × Grace Arm (72 cores each)
Bộ nhớ GPU 13.5 TB HBM3e total
Băng thông bộ nhớ GPU 345.6 TB/s aggregate
Hiệu quả của AI 1.44 ExaFLOPS FP4 sparse
Truyền kết nối GPU NVLink 5.0 — 1.8 TB/s per GPU
Liên kết CPU-GPU NVLink-C2C — 900 GB/s bidirectional
Bộ nhớ hệ thống Up to 13.5 TB LPDDR5X
Tiêu thụ năng lượng Up to 120 kW per rack
Hệ thống làm mát Direct Liquid Cooling (mandatory)
Mạng lưới 8 × 400 GbE / InfiniBand per rack

Hướng dẫn mua hàng

Máy chủ AI nào phù hợp với trường hợp sử dụng của Quý vị?

Từ thí nghiệm quy mô phòng thí nghiệm đến triển khai quy mô lớn hyperscale — phù hợp tải công việc của bạn với cấp độ nền tảng phù hợp.

Nghiên cứu / Phòng thí nghiệm

2–4 GPU Tower or 2U Rack

GPU A100 80GB / RTX PRO 6000
Bộ nhớ GPU 160–384 GB GPU VRAM
Điện năng 2–4 kW total draw

Tinh chỉnh mô hình, phát triển RAG, suy luận cục bộ, khả năng lặp lại nghiên cứu. Thích hợp để đặt dưới bàn hoặc trong giá tiêu chuẩn. Thường không cần nâng cấp cơ sở hạ tầng.

Khởi nghiệp / Doanh nghiệp vừa và nhỏ

HGX H100 OEM 8-GPU

GPU 8 × H100 SXM5 80GB
Bộ nhớ GPU 640 GB HBM2e
Điện năng ~10 kW draw

Điều chỉnh hoàn chỉnh các mô hình từ 13–70B. Phân tích dự liệu sản xuất cho các sản phẩm gốc AI. Yêu cầu nguồn điện 3 pha hoặc cấp nguồn kép 30A. Làm mát bằng không khí có thể thực hiện với bộ trao đổi nhiệt sau cửa.

Doanh nghiệp

DGX H200 / HGX H200

GPU 8 × H200 SXM5 141GB
Bộ nhớ GPU 1.1 TB HBM3e
Điện năng ~11 kW draw

Đào tạo đầy đủ tham số cho các mô hình 70–400B. Phân tích dữ liệu với độ trễ thấp cho các mô hình cực lớn. Gợi ý làm mát chất lỏng. Tiêu chuẩn ngành hiện tại cho các công việc AI nghiêm túc.

Hyperscale

GB200 NVL72

GPU 72 × Blackwell GB200
Bộ nhớ GPU 13.5 TB HBM3e
Điện năng Up to 120 kW

Tiền đào tạo mô hình trillion tham số và suy luận hàng loạt lớn. Làm mát lỏng toàn bộ và nguồn điện ba pha riêng biệt bắt buộc. Kiến trúc rack như một GPU thông qua NVLink 5.


Câu hỏi thường gặp

Các câu hỏi thường gặp

DGX (Data Centre GPU) là hệ thống hoàn chỉnh thương hiệu riêng của NVIDIA — bo mạch GPU, NVSwitch, CPU, bộ nhớ, lưu trữ, mạng, BMC và khung chassis đều được NVIDIA lắp ráp và xác nhận. HGX là nền tảng OEM: NVIDIA cung cấp bo mạch GPU cơ bản với NVSwitch và các module GPU cho các đối tác như Supermicro, Dell EMC, HPE và Lenovo để họ tự xây dựng khung máy chủ hoàn chỉnh xung quanh. Các hệ thống HGX mang lại nhiều sự linh hoạt hơn trong lựa chọn chassis, tùy chọn mạng và cấu hình lưu trữ; các hệ thống DGX được xác nhận theo chuẩn tham khảo và đi kèm phần mềm NVIDIA Base Command.

DGX H100 tiêu thụ tối đa 10,2 kW. Nó yêu cầu hai kết nối C19/C20 từ hai mạch 30A, 240V riêng biệt tại Bắc Mỹ, hoặc nguồn 3 pha 32A tại châu Âu. Mạch điện sinh hoạt tiêu chuẩn 20A, 120V là hoàn toàn không phù hợp. Xin vui lòng lên kế hoạch cho các PDU riêng biệt hoặc nguồn cấp trực tiếp từ bảng điện, và kiểm tra công suất UPS của quý khách trước khi đặt hàng.

Máy chủ AI nhập cảnh và trung cấp (cấu hình GPU PCIe 2–8) có thể sử dụng hệ thống làm mát bằng không khí thông gió cao, mặc dù tiếng ồn quạt tốc độ cao và nhiệt khí thải ở mức 10 kW+ khiến các bộ trao đổi nhiệt cửa sau trở nên cực kỳ cần thiết. DGX H100 và HGX H100/H200 dạng SXM được thiết kế để làm mát bằng không khí ở cấp hệ thống nhưng tạo ra nhiệt đáng kể ở cấp rack — làm mát bằng chất lỏng gần như bắt buộc khi công suất vượt quá 20–30 kW mỗi rack. GB200 NVL72 công suất 120 kW mỗi rack yêu cầu làm mát bằng chất lỏng trực tiếp và không có tùy chọn làm mát chỉ bằng không khí.

Ở FP16, một mô hình 175B yêu cầu khoảng 350 GB VRAM — nhiều hơn so với 640 GB trong DGX H100 có thể chứa sau khi trừ đi chi phí tồn kho inference KV. Trong thực tế, lượng lượng quantisation INT8 giảm một nửa yêu cầu này xuống còn khoảng 175 GB, phù hợp một cách thoải mái. DGX H200 (1,1 TB HBM3e) có thể chạy các mô hình 175B ở FP16 với khoảng dư thừa. GB200 NVL72 (13,5 TB) có thể chạy nhiều phiên bản của các mô hình 175B đồng thời.

Đối với quá trình đào tạo trên nhiều nút, kết cấu RDMA tốc độ cao là thiết yếu. InfiniBand HDR của NVIDIA (200 Gb/s) hoặc NDR (400 Gb/s) là tiêu chuẩn cho mạng lưới clustering DGX/HGX. Ngoài ra, RoCEv2 (RDMA qua Ethernet hội tụ) với NIC ConnectX-7 400 GbE là một lựa chọn có chi phí thấp hơn cho clustering suy luận. Các hoạt động tập thể tất cả các nút (AllReduce) trong quá trình đào tạo cực kỳ nhạy cảm với băng thông và độ trễ giữa các nút — bộ chuyển đổi 25/100 GbE thương mại gây ra các trễ không thể chấp nhận được trong đào tạo quy mô lớn.

Có. Đối với các đơn hàng máy chủ AI lớn, chúng tôi có thể sắp xếp cấu hình tại nhà máy, kiểm tra burn-in và logistics tới dữ liệu trung tâm hoặc cơ sở colocation của quý vị. Vui lòng liên hệ đội ngũ bán hàng của chúng tôi để thảo luận về thời gian triển khai và yêu cầu cơ sở của quý vị. Chúng tôi hợp tác với các nhà cung cấp colocation trên khắp Châu Âu, Các Tiểu vương quốc Ả Rập Thống nhất và Bắc Mỹ.

Đội ngũ của chúng tôi có mặt 24/7 qua WhatsApp (+49 176 777 888 33), email và điện thoại. Việc mua máy chủ AI thường liên quan đến cấu hình tùy chỉnh và giá theo số lượng — chúng tôi sẽ phù hợp yêu cầu công việc của quý vị với nền tảng phù hợp và cung cấp báo giá chi tiết bao gồm logistics.

Sẵn sàng triển khai hạ tầng AI của Quý vị?

Duyệt qua phạm vi đầy đủ các nền tảng máy chủ AI của chúng tôi ở trên, từ các nút 2-GPU loại nghiên cứu đến hệ thống dạng rack DGX H200 và GB200 NVL72. Đội ngũ của chúng tôi sẽ giúp bạn lập kế hoạch về nguồn điện, làm mát, mạng lưới và logistics từ đầu đến cuối.