Beli GPU NVIDIA di MillionMiner, dari Blackwell konsumen hingga kelas data-center, untuk beban kerja AI dan profesional. Kartu yang tersedia termasuk RTX 5090 32GB dan RTX 4090 24GB dalam varian blower, RTX PRO 6000 Blackwell 96GB, serta GPU Tensor Core A100 dan H100. Baru dengan garansi pabrik kecuali jika daftar menunjukkan sebaliknya.
Setiap GPU dikirim gratis ke seluruh dunia DDP, sehingga harga di checkout adalah biaya terakhir yang sampai di tempat. Untuk build multi-kartu, lihat server GPU pra-bangun kami, atau minta kartu tersebut dipasang ke dalam hosting US kami dengan daya dan pendinginan yang sudah disediakan. Belanja seluruh rangkaian GPU di bawah ini.
Stok Terverifikasi
Setiap GPU diuji dan diperiksa sebelum pengiriman
Pengiriman Cepat
Pengiriman dalam 1–3 hari kerja
Krypto Diterima
Bayar dengan BTC, ETH, USDT & lainnya
Dukungan Ahli
Spesialis infrastruktur AI & GPU siap membantu
Revolusi AI didukung oleh seperangkat chip silikon yang sangat kecil. Rangkaian GPU data center NVIDIA, dari GPU Tensor Core H100 dan H200 hingga RTX PRO 6000 Blackwell dan RTX 5090, merupakan substrat komputasi tempat model bahasa besar, model difusi, simulasi ilmiah, dan pipeline inferensi berkecepatan tinggi dijalankan. Kami menyediakan seluruh rangkaian profesional NVIDIA — akselerator data centre, GPU workstation, dan kartu visualisasi profesional — untuk pembeli perusahaan, laboratorium riset, startup AI, dan operator infrastruktur cloud.
H200 Memori BW
4.8 TB/s
HBM3e @ kapasitas 141 GB
Kinerja AI H100
3.9 PFLOPS
Operasi tensor sparse FP8
RTX PRO 6000 VRAM
96 GB
ECC GDDR7 — arsitektur Blackwell
VRAM RTX 5090
32 GB GDDR7
Blackwell GB202 — 3352 GB/s BW
80 GB HBM2e
Mesin andalan untuk pelatihan AI perusahaan. 3,35 TFLOPS FP64, NVLink 900 GB/s. Varian SXM lebih disukai untuk jaringan NVSwitch multi-GPU dalam sistem DGX H100.
141 GB HBM3e
Pengganti H100. Sama Hopper GPU die tetapi dengan 1,76× lebih banyak memori dan bandwidth 4,8 TB/s — sangat penting untuk inferensi LLM dengan jendela konteks yang panjang.
40 GB / 80 GB HBM2e
Mesin pekerjaan generasi sebelumnya masih digunakan secara intensif. 312 TFLOPS FP16 Tensor Core. Tersedia secara luas dalam konfigurasi PCIe asli dan kustom.
96 GB GDDR7 ECC
GPU Workstation paling unggul yang pernah dibuat. Form factor PCIe lengkap, dukungan NVLink bridge, Tensor Cores generasi ke-4. Ideal untuk inferensi LLM lokal dan rendering.
32 GB GDDR7
Produk unggulan konsumen NVIDIA berbasis arsitektur Blackwell. 21.760 inti CUDA, lebar pita memori 3.352 GB/s. GPU tunggal terbaik untuk beban kerja campuran dan inferensi.
24 GB GDDR6X
Generasi Ada sebelumnya. 16.384 core CUDA, 1008 GB/s BW. Masih menjadi Perform in yang kuat dan titik harga yang lebih terjangkau untuk kluster inferensi.
8 GB GDDR6
GPU profesional profil rendah untuk inferensi tepi dan beban kerja tampilan keluar. Konsumsi daya minimal, operasi diam, penyebaran padat rak.
16 / 24 GB GDDR6
GPU PCIe Ada dan Ampere yang dioptimalkan untuk inferensi. Dirancang untuk slot server dengan batas daya terbatas — TDP 72 W — dengan throughput INT8 yang kuat untuk penerapan skala besar.
NVIDIA telah mengirimkan tiga arsitektur mikro GPU utama sejak ledakan AI dimulai. Arsitektur Hopper (H100, H200) memperkenalkan Transformer Engine — sebuah blok perangkat keras yang secara dinamis mengalihkan presisi antara FP8 dan FP16 dalam satu kali lintasan lapisan untuk memaksimalkan throughput tanpa kehilangan akurasi yang berarti. Ini adalah terobosan desain yang membuat pelatihan model dengan lebih dari 70 miliar parameter menjadi layak secara komersial.
Ada Lovelace (RTX 4090, L4, L40S) membawa Tensor Core generasi ke-4 ke pasar profesional dan prosumer, bersama hardware ray tracing yang telah ditingkatkan secara signifikan. Kartu Ada menempati posisi yang ideal antara aksesibilitas untuk konsumen dan kemampuan profesional, menjadikannya pilihan utama untuk penerapan inferensi butik dan workstation AI kreatif.
Blackwell (RTX 5090, RTX PRO 6000, GB200 NVL72) adalah generasi terbaru. Blackwell memperkenalkan desain GPU dual-die untuk bagian data centre andalan, NVLink 5.0 dengan bandwidth die-ke-die sebesar 1,8 TB/s, dan Tensor Cores generasi kelima dengan dukungan FP4. RTX PRO 6000 Blackwell membawa memori ECC 96 GB ke tingkat workstation — kapasitas yang lebih besar daripada H100 PCIe — memungkinkan beban kerja yang sebelumnya eksklusif di cloud berjalan secara lokal.
Ketiga GPU yang mendefinisikan infrastruktur AI modern di tingkat workstation dan server node tunggal.
Standar emas untuk pelatihan terdistribusi. Varian SXM yang terhubung dengan NVSwitch wajib untuk node kelas DGX dengan 8-GPU. Varian PCIe cocok untuk server standar.
GPU Hopper yang sama dengan H100 tetapi dengan kapasitas memori hampir dua kali lipat dan bandwidth yang jauh lebih besar. Sangat ideal untuk melayani model lebih dari 70B parameter secara besar-besaran dengan panjang konteks yang panjang.
Lebih banyak VRAM daripada H100 dalam slot PCIe standar. Cocok untuk semua workstation atau server tower. Menjalankan model 70B secara lokal. RTX PRO 6000 Server Edition menghapus output tampilan untuk penerapan yang dioptimalkan untuk rak.
GPU yang digunakan untuk melatih model tidak selalu merupakan GPU terbaik untuk menjalankannya. Pelatihan membutuhkan FLOPS maksimum dan memori besar untuk menyimpan parameter, gradien, dan status optimiser secara bersamaan — model 70B yang disesuaikan dengan AdamW memerlukan lebih dari 500 GB VRAM di seluruh klaster. Untuk pelatihan dalam skala ini, node H100 atau H200 SXM yang terhubung melalui NVSwitch adalah standar industri, menawarkan kombinasi komputasi mentah dan bandwidth NVLink yang dibutuhkan untuk memastikan semua GPU tetap terlayani.
Beban kerja inferensi lebih memperhatikan kapasitas memori dan bandwidth daripada FLOPS. Model 70B yang dikuantisasi pada INT4 memerlukan sekitar 40 GB — berarti H200 dapat melayaninya dengan ruang yang cukup, dan sepasang kartu RTX PRO 6000 Blackwell yang terhubung melalui NVLink Bridge dapat melakukan hal yang sama. Untuk layanan inferensi dengan throughput tinggi, bandwidth H200 sebesar 4,8 TB/s menjaga latensi tetap rendah bahkan di bawah batch permintaan bersamaan.
Kasus penggunaan workstation lokal — penelitian, AI kreatif, chat LLM lokal, pembuatan gambar, sintesis video — didukung dengan baik oleh RTX PRO 6000 Blackwell (96 GB), RTX 5090 (32 GB), atau A100 (40/80 GB) tergantung pada kebutuhan ukuran model. RTX 4090 tetap menjadi opsi paling kompetitif dari segi harga untuk pengguna yang menjalankan model kuantisasi di bawah 24 GB.
Klaster NVSwitch multi-node. Wajib untuk pra-pelatihan skala besar dan penyempurnaan penuh.
Memori dengan bandwidth tinggi sangat penting untuk layanan konteks panjang. Jambatan NVLink untuk pasangan workstation.
32–80 GB cukup untuk layanan kuantisasi. Throughput INT8 yang kuat.
Memori VRAM tertinggi pada kartu PCIe. Menjalankan model 34B tanpa kuantisasi. ECC untuk keandalan.
Jumlah inti CUDA tinggi + bandwidth GDDR7 cepat ideal untuk inferensi difusi.
TDP di bawah 75 W. Slot tunggal atau profil rendah. Penempatan rak yang padat.
Memori ECC, driver bersertifikat, buffer bingkai besar untuk 3D/CAD/simulasi.
GB200 menghubungkan dua GPU Blackwell pada satu paket yang terhubung melalui NVLink-C2C dengan kecepatan 1,8 TB/s — sepenuhnya menghilangkan hambatan PCIe antara unit pemrosesan.
Mode presisi FP4 baru memberikan hingga 2× throughput FP8 untuk beban kerja inferensi. Mempertahankan akurasi melalui format mikroskala NVIDIA (MXFP4).
Skala bandwidth meningkat dua kali lipat dibanding Hopper — 1,8 TB/s bidirectional per GPU. Sangat penting untuk konfigurasi rak NVL72 yang menghubungkan 72 GPU Blackwell menjadi satu unit logis.
Sebuah mesin Reliability, Availability & Serviceability yang khusus untuk deteksi kerusakan perangkat keras secara prediktif — mengurangi waktu henti tak terduga dalam cluster inferensi produksi.
Lingkungan Eksekusi Terpercaya (TEE) yang diisolasi perangkat keras untuk beban kerja GPU. Memungkinkan menjalankan model kepemilikan dan inferensi sensitif secara aman di infrastruktur cloud bersama.
96 GB GDDR7 ECC dalam bentuk standar PCIe dual-slot. Keandalan setara workstation dengan kapasitas memori kelas data centre. Edisi Server menghilangkan output tampilan.
GeForce RTX 5090 memperkenalkan Blackwell ke pasar konsumen dan prosumer. Dibangun di atas die GB202 dengan 21.760 CUDA cores dan 32 GB memori GDDR7 yang berjalan pada bandwidth 1.792 GB/detik, ini adalah GPU tunggal terkuat yang cocok untuk PC desktop standar. Untuk peneliti dan pengembang AI yang membutuhkan inferensi dan eksperimen lokal tanpa biaya cloud, RTX 5090 adalah pilihan yang pragmatis.
RTX PRO 6000 Blackwell mengambil pendekatan yang secara fundamental berbeda: daripada memaksimalkan kinerja gaming konsumen, NVIDIA merancang GPU workstation dengan 96 GB memori ECC GDDR7 — lebih dari GPU PCIe sebelumnya dari vendor mana pun. Varian Server Edition dan Max-Q Workstation Edition mencakup penerapan rak dan mobile masing-masing. Dua kartu RTX PRO 6000 yang terhubung melalui NVLink Bridge memberikan 192 GB memori gabungan — cukup untuk menjalankan model parameter 70B tanpa kuantisasi.
Untuk studio, laboratorium riset, dan startup AI yang tidak dapat atau tidak ingin menjalankan setiap beban kerja di cloud, lini workstation Blackwell mengubah perhitungan sepenuhnya. Model proprietary tetap di lokasi. Latensi inferensi berkurang. Kedaulatan data tetap terjaga. Biaya perangkat keras awal diangsur terhadap tagihan inferensi cloud yang sebaliknya akan terus membengkak tanpa batas.
Telusuri rangkaian lengkap GPU NVIDIA profesional kami di atas, mulai dari kartu workstation tunggal hingga konfigurasi server multi-GPU. Apakah Anda sedang melatih model pertama Anda atau memperluas kumpulan inferensi, tim kami akan membantu Anda mencocokkan perangkat keras yang tepat dengan beban kerja dan anggaran Anda.