Beli GPU untuk Dijual: NVIDIA RTX 5090, A100, H100 dan RTX PRO 6000

Beli GPU NVIDIA di MillionMiner, dari Blackwell konsumen hingga kelas data-center, untuk beban kerja AI dan profesional. Kartu yang tersedia termasuk RTX 5090 32GB dan RTX 4090 24GB dalam varian blower, RTX PRO 6000 Blackwell 96GB, serta GPU Tensor Core A100 dan H100. Baru dengan garansi pabrik kecuali jika daftar menunjukkan sebaliknya.

Setiap GPU dikirim gratis ke seluruh dunia DDP, sehingga harga di checkout adalah biaya terakhir yang sampai di tempat. Untuk build multi-kartu, lihat server GPU pra-bangun kami, atau minta kartu tersebut dipasang ke dalam hosting US kami dengan daya dan pendinginan yang sudah disediakan. Belanja seluruh rangkaian GPU di bawah ini.

5.0
bintang bintang bintang bintang bintang
4.97
bintang bintang bintang bintang bintang
4.5
bintang bintang bintang bintang bintang
honigwaben-gitter honigwaben-gitter
Filter & Sort

Stok Terverifikasi

Setiap GPU diuji dan diperiksa sebelum pengiriman

Pengiriman Cepat

Pengiriman dalam 1–3 hari kerja

Krypto Diterima

Bayar dengan BTC, ETH, USDT & lainnya

Dukungan Ahli

Spesialis infrastruktur AI & GPU siap membantu

AI & GPU Computing

GPU AI Profesional untuk Pelatihan, Inferensi & Beban Kerja HPC

Revolusi AI didukung oleh seperangkat chip silikon yang sangat kecil. Rangkaian GPU data center NVIDIA, dari GPU Tensor Core H100 dan H200 hingga RTX PRO 6000 Blackwell dan RTX 5090, merupakan substrat komputasi tempat model bahasa besar, model difusi, simulasi ilmiah, dan pipeline inferensi berkecepatan tinggi dijalankan. Kami menyediakan seluruh rangkaian profesional NVIDIA — akselerator data centre, GPU workstation, dan kartu visualisasi profesional — untuk pembeli perusahaan, laboratorium riset, startup AI, dan operator infrastruktur cloud.

H200 Memori BW

4.8 TB/s

HBM3e @ kapasitas 141 GB

Kinerja AI H100

3.9 PFLOPS

Operasi tensor sparse FP8

RTX PRO 6000 VRAM

96 GB

ECC GDDR7 — arsitektur Blackwell

VRAM RTX 5090

32 GB GDDR7

Blackwell GB202 — 3352 GB/s BW


Lineup GPU Profesional NVIDIA

Dari Workstation ke Data Centre Skala Hiper

H100 SXM / PCIe

80 GB HBM2e

Mesin andalan untuk pelatihan AI perusahaan. 3,35 TFLOPS FP64, NVLink 900 GB/s. Varian SXM lebih disukai untuk jaringan NVSwitch multi-GPU dalam sistem DGX H100.

H200 SXM / PCIe

141 GB HBM3e

Pengganti H100. Sama Hopper GPU die tetapi dengan 1,76× lebih banyak memori dan bandwidth 4,8 TB/s — sangat penting untuk inferensi LLM dengan jendela konteks yang panjang.

A100 PCIe / SXM

40 GB / 80 GB HBM2e

Mesin pekerjaan generasi sebelumnya masih digunakan secara intensif. 312 TFLOPS FP16 Tensor Core. Tersedia secara luas dalam konfigurasi PCIe asli dan kustom.

RTX PRO 6000 Blackwell

96 GB GDDR7 ECC

GPU Workstation paling unggul yang pernah dibuat. Form factor PCIe lengkap, dukungan NVLink bridge, Tensor Cores generasi ke-4. Ideal untuk inferensi LLM lokal dan rendering.

RTX 5090 (GB202)

32 GB GDDR7

Produk unggulan konsumen NVIDIA berbasis arsitektur Blackwell. 21.760 inti CUDA, lebar pita memori 3.352 GB/s. GPU tunggal terbaik untuk beban kerja campuran dan inferensi.

RTX 4090 (Ada)

24 GB GDDR6X

Generasi Ada sebelumnya. 16.384 core CUDA, 1008 GB/s BW. Masih menjadi Perform in yang kuat dan titik harga yang lebih terjangkau untuk kluster inferensi.

T1000 (Professional)

8 GB GDDR6

GPU profesional profil rendah untuk inferensi tepi dan beban kerja tampilan keluar. Konsumsi daya minimal, operasi diam, penyebaran padat rak.

A2 / L4 (PCIe)

16 / 24 GB GDDR6

GPU PCIe Ada dan Ampere yang dioptimalkan untuk inferensi. Dirancang untuk slot server dengan batas daya terbatas — TDP 72 W — dengan throughput INT8 yang kuat untuk penerapan skala besar.

Cerita tentang Arsitektur NVIDIA

Hopper, Ada Lovelace & Blackwell — Tiga Generasi Penggerak Era AI

NVIDIA telah mengirimkan tiga arsitektur mikro GPU utama sejak ledakan AI dimulai. Arsitektur Hopper (H100, H200) memperkenalkan Transformer Engine — sebuah blok perangkat keras yang secara dinamis mengalihkan presisi antara FP8 dan FP16 dalam satu kali lintasan lapisan untuk memaksimalkan throughput tanpa kehilangan akurasi yang berarti. Ini adalah terobosan desain yang membuat pelatihan model dengan lebih dari 70 miliar parameter menjadi layak secara komersial.

Ada Lovelace (RTX 4090, L4, L40S) membawa Tensor Core generasi ke-4 ke pasar profesional dan prosumer, bersama hardware ray tracing yang telah ditingkatkan secara signifikan. Kartu Ada menempati posisi yang ideal antara aksesibilitas untuk konsumen dan kemampuan profesional, menjadikannya pilihan utama untuk penerapan inferensi butik dan workstation AI kreatif.

Blackwell (RTX 5090, RTX PRO 6000, GB200 NVL72) adalah generasi terbaru. Blackwell memperkenalkan desain GPU dual-die untuk bagian data centre andalan, NVLink 5.0 dengan bandwidth die-ke-die sebesar 1,8 TB/s, dan Tensor Cores generasi kelima dengan dukungan FP4. RTX PRO 6000 Blackwell membawa memori ECC 96 GB ke tingkat workstation — kapasitas yang lebih besar daripada H100 PCIe — memungkinkan beban kerja yang sebelumnya eksklusif di cloud berjalan secara lokal.


Sampingan

H100 vs H200 vs RTX PRO 6000 Blackwell

Ketiga GPU yang mendefinisikan infrastruktur AI modern di tingkat workstation dan server node tunggal.

Hopper

H100 SXM5

Terbaik untuk Pelatihan
Memori 80 GB HBM2e
Memori BW 3.35 TB/s
FP8 Sparse 3.9 PFLOPS
TDP 700 W (SXM)
NVLink NVLink 4 — 900 GB/s
Form Factor SXM5 / PCIe

Standar emas untuk pelatihan terdistribusi. Varian SXM yang terhubung dengan NVSwitch wajib untuk node kelas DGX dengan 8-GPU. Varian PCIe cocok untuk server standar.

Hopper

H200 SXM5

Terbaik untuk Inferensi
Memori 141 GB HBM3e
Memori BW 4.8 TB/s
FP8 Sparse 3.9 PFLOPS
TDP 700 W (SXM)
NVLink NVLink 4 — 900 GB/s
Form Factor SXM5 / PCIe

GPU Hopper yang sama dengan H100 tetapi dengan kapasitas memori hampir dua kali lipat dan bandwidth yang jauh lebih besar. Sangat ideal untuk melayani model lebih dari 70B parameter secara besar-besaran dengan panjang konteks yang panjang.

Blackwell

RTX PRO 6000 BW

Workstation Terbaik
Memori 96 GB GDDR7 ECC
Memori BW ~1.8 TB/s
Tensor Inti 5th-gen, FP4/FP8/FP16
TDP 300 W (PCIe)
NVLink NVLink Bridge (optional)
Form Factor Dual-slot PCIe x16

Lebih banyak VRAM daripada H100 dalam slot PCIe standar. Cocok untuk semua workstation atau server tower. Menjalankan model 70B secara lokal. RTX PRO 6000 Server Edition menghapus output tampilan untuk penerapan yang dioptimalkan untuk rak.


Memilih GPU yang Tepat

Pelatihan vs Inferensi vs Workstation: GPU mana yang Anda butuhkan?

GPU yang digunakan untuk melatih model tidak selalu merupakan GPU terbaik untuk menjalankannya. Pelatihan membutuhkan FLOPS maksimum dan memori besar untuk menyimpan parameter, gradien, dan status optimiser secara bersamaan — model 70B yang disesuaikan dengan AdamW memerlukan lebih dari 500 GB VRAM di seluruh klaster. Untuk pelatihan dalam skala ini, node H100 atau H200 SXM yang terhubung melalui NVSwitch adalah standar industri, menawarkan kombinasi komputasi mentah dan bandwidth NVLink yang dibutuhkan untuk memastikan semua GPU tetap terlayani.

Beban kerja inferensi lebih memperhatikan kapasitas memori dan bandwidth daripada FLOPS. Model 70B yang dikuantisasi pada INT4 memerlukan sekitar 40 GB — berarti H200 dapat melayaninya dengan ruang yang cukup, dan sepasang kartu RTX PRO 6000 Blackwell yang terhubung melalui NVLink Bridge dapat melakukan hal yang sama. Untuk layanan inferensi dengan throughput tinggi, bandwidth H200 sebesar 4,8 TB/s menjaga latensi tetap rendah bahkan di bawah batch permintaan bersamaan.

Kasus penggunaan workstation lokal — penelitian, AI kreatif, chat LLM lokal, pembuatan gambar, sintesis video — didukung dengan baik oleh RTX PRO 6000 Blackwell (96 GB), RTX 5090 (32 GB), atau A100 (40/80 GB) tergantung pada kebutuhan ukuran model. RTX 4090 tetap menjadi opsi paling kompetitif dari segi harga untuk pengguna yang menjalankan model kuantisasi di bawah 24 GB.

Panduan Pemilihan Cepat

Sesuaikan Beban Kerja Anda dengan Perangkat Keras yang Tepat

Pelatihan LLM (70B+)
H100 / H200 SXM

Klaster NVSwitch multi-node. Wajib untuk pra-pelatihan skala besar dan penyempurnaan penuh.

Inferensi LLM (70B)
H200 or 2× RTX PRO 6000

Memori dengan bandwidth tinggi sangat penting untuk layanan konteks panjang. Jambatan NVLink untuk pasangan workstation.

Inferensi LLM (7–13B)
RTX 5090 / A100 80GB

32–80 GB cukup untuk layanan kuantisasi. Throughput INT8 yang kuat.

Stasiun Kerja AI Lokal
RTX PRO 6000 BW (96 GB)

Memori VRAM tertinggi pada kartu PCIe. Menjalankan model 34B tanpa kuantisasi. ECC untuk keandalan.

Gambar / Video Gen
RTX 5090 / RTX 4090

Jumlah inti CUDA tinggi + bandwidth GDDR7 cepat ideal untuk inferensi difusi.

Edge / Inferensi Hemat Energi
T1000 / L4 / A2

TDP di bawah 75 W. Slot tunggal atau profil rendah. Penempatan rak yang padat.

Visualisasi Profesional
RTX PRO 6000 / A100

Memori ECC, driver bersertifikat, buffer bingkai besar untuk 3D/CAD/simulasi.


Sorotan Arsitektur Blackwell

Apa yang Membuat Blackwell Merupakan Lompatan Generasi

Desain GPU Dual-Die

GB200 menghubungkan dua GPU Blackwell pada satu paket yang terhubung melalui NVLink-C2C dengan kecepatan 1,8 TB/s — sepenuhnya menghilangkan hambatan PCIe antara unit pemrosesan.

Tensor Core generasi ke-5

Mode presisi FP4 baru memberikan hingga 2× throughput FP8 untuk beban kerja inferensi. Mempertahankan akurasi melalui format mikroskala NVIDIA (MXFP4).

NVLink 5.0

Skala bandwidth meningkat dua kali lipat dibanding Hopper — 1,8 TB/s bidirectional per GPU. Sangat penting untuk konfigurasi rak NVL72 yang menghubungkan 72 GPU Blackwell menjadi satu unit logis.

Mesin RAS

Sebuah mesin Reliability, Availability & Serviceability yang khusus untuk deteksi kerusakan perangkat keras secara prediktif — mengurangi waktu henti tak terduga dalam cluster inferensi produksi.

Komputasi Kerahasiaan

Lingkungan Eksekusi Terpercaya (TEE) yang diisolasi perangkat keras untuk beban kerja GPU. Memungkinkan menjalankan model kepemilikan dan inferensi sensitif secara aman di infrastruktur cloud bersama.

RTX PRO 6000 — Bendera utama PCIe

96 GB GDDR7 ECC dalam bentuk standar PCIe dual-slot. Keandalan setara workstation dengan kapasitas memori kelas data centre. Edisi Server menghilangkan output tampilan.

NVIDIA Blackwell

RTX 5090 dan RTX PRO 6000: Blackwell untuk Profesional

GeForce RTX 5090 memperkenalkan Blackwell ke pasar konsumen dan prosumer. Dibangun di atas die GB202 dengan 21.760 CUDA cores dan 32 GB memori GDDR7 yang berjalan pada bandwidth 1.792 GB/detik, ini adalah GPU tunggal terkuat yang cocok untuk PC desktop standar. Untuk peneliti dan pengembang AI yang membutuhkan inferensi dan eksperimen lokal tanpa biaya cloud, RTX 5090 adalah pilihan yang pragmatis.

RTX PRO 6000 Blackwell mengambil pendekatan yang secara fundamental berbeda: daripada memaksimalkan kinerja gaming konsumen, NVIDIA merancang GPU workstation dengan 96 GB memori ECC GDDR7 — lebih dari GPU PCIe sebelumnya dari vendor mana pun. Varian Server Edition dan Max-Q Workstation Edition mencakup penerapan rak dan mobile masing-masing. Dua kartu RTX PRO 6000 yang terhubung melalui NVLink Bridge memberikan 192 GB memori gabungan — cukup untuk menjalankan model parameter 70B tanpa kuantisasi.

Untuk studio, laboratorium riset, dan startup AI yang tidak dapat atau tidak ingin menjalankan setiap beban kerja di cloud, lini workstation Blackwell mengubah perhitungan sepenuhnya. Model proprietary tetap di lokasi. Latensi inferensi berkurang. Kedaulatan data tetap terjaga. Biaya perangkat keras awal diangsur terhadap tagihan inferensi cloud yang sebaliknya akan terus membengkak tanpa batas.


FAQ

Pertanyaan yang Sering Diajukan

Keduanya menggunakan die GPU Hopper GH100 yang sama dan memberikan FLOPS komputasi yang identik (~3,9 PFLOPS FP8 sparse). H200 menggantikan HBM2e dengan memori HBM3e: kapasitas meningkat dari 80 GB menjadi 141 GB dan bandwidth meningkat dari 3,35 TB/dtk menjadi 4,8 TB/dtk. Oleh karena itu, H200 lebih unggul untuk beban kerja yang berat dalam inferensi di mana model besar harus muat dalam satu GPU dan throughput tinggi diperlukan.

Untuk beban kerja inferensi ya — kapasitas 96 GB ECC GDDR7-nya melebihi H100 PCIe yang sebesar 80 GB dan cocok di slot workstation PCIe standar mana pun. Untuk pelatihan, faktor bentuk H100/H200 SXM dengan NVSwitch menawarkan bandwidth antar-GPU yang jauh lebih tinggi dan FLOPS mentah yang lebih besar dengan TDP yang sama. RTX PRO 6000 adalah pilihan yang lebih baik ketika Anda membutuhkan kapasitas VRAM tinggi secara lokal tanpa infrastruktur NVSwitch.

GPU SXM (H100 SXM5, H200 SXM5) dipasang pada papan dasar khusus alih-alih slot PCIe dan terhubung satu sama lain melalui fabric NVSwitch, memungkinkan bandwidth antar-GPU sebesar 900 GB/s per GPU. Varian PCIe cocok untuk server dan workstation standar tetapi terbatas pada NVLink Bridge (2 GPU) atau bandwidth PCIe (x16, sekitar 64 GB/s) untuk komunikasi multi-GPU. Untuk klaster dengan 8+ GPU yang membutuhkan komunikasi all-to-all, sistem SXM NVSwitch adalah mutlak.

Pada presisi FP16 (16-bit) sebuah model 70B membutuhkan sekitar 140 GB VRAM — satu H200 (141 GB) mampu menangani ini dengan margin. Pada kuantisasi INT8, diperlukan sekitar 70 GB. Pada INT4 (GGUF Q4), sekitar 35–40 GB, cocok dengan H100 80 GB atau sepasang RTX 4090. RTX PRO 6000 Blackwell (96 GB) mampu menjalankan model INT8 70B pada satu GPU dengan ruang untuk cache KV.

RTX 5090 sangat cocok untuk inferensi AI lokal, pembuatan gambar (Stable Diffusion, Flux, DALL-E 3 replika), sintesis video, dan penyesuaian model kecil hingga sedang. Memori 32 GB GDDR7-nya cukup untuk menjalankan model 13B dalam FP16 dan model 70B dalam INT4. Untuk klaster pelatihan multi-GPU, GPU data centre tetap lebih disukai karena bandwidth NVLink dan kapasitas memori yang lebih besar.

NVIDIA A100 (Arsitektur Ampere, 2020) tetap menjadi GPU AI yang mampu dan banyak digunakan. Dikirim dalam konfigurasi HBM2e 40 GB dan 80 GB, menawarkan performa Tensor Core FP16 sebesar 312 TFLOPS. Dengan pasokan yang lebih longgar dibandingkan H100, harga A100 menjadi lebih terjangkau. Untuk inferensi dan beban kerja pelatihan sedang, tetap kuat. Untuk riset mutakhir atau model terbesar, H100/H200 sekarang lebih disukai.

Ya. MillionMiner melayani pelanggan dari bidang perusahaan, riset, dan infrastruktur cloud dengan pesanan GPU dalam jumlah besar. Hubungi tim penjualan kami untuk harga pembelian H100, H200, A100, dan RTX PRO 6000 dengan jumlah banyak. Kami dapat mengatur logistik pengiriman, penataan, dan penagihan dalam berbagai mata uang termasuk crypto.

Tim kami tersedia 24/7 melalui WhatsApp (+49 176 777 888 33), email, dan telepon. Kami membantu dalam pemilihan GPU untuk beban kerja pelatihan vs inferensi, desain klaster multi-GPU, dan pengadaan B2B. Hubungi kami atau kunjungi FAQ kami untuk jawaban instan.

Siap Membangun Infrastruktur AI Anda?

Telusuri rangkaian lengkap GPU NVIDIA profesional kami di atas, mulai dari kartu workstation tunggal hingga konfigurasi server multi-GPU. Apakah Anda sedang melatih model pertama Anda atau memperluas kumpulan inferensi, tim kami akan membantu Anda mencocokkan perangkat keras yang tepat dengan beban kerja dan anggaran Anda.