Koop NVIDIA-GPU's bij MillionMiner, van consumenten Blackwell tot datacenterklasse, voor AI- en professionele werkzaamheden. Beschikbare kaarten zijn onder andere de RTX 5090 32GB en RTX 4090 24GB in blowervarianten, de RTX PRO 6000 Blackwell 96GB, en de A100- en H100 Tensor Core GPU's. Nieuw met fabrieksgarantie, tenzij een aanbieding anders vermeldt.
Elke GPU wordt gratis wereldwijd DDP verzonden, dus de afrekenprijs is de uiteindelijke landed cost. Voor multi-kaart bouws, zie onze vooraf geassembleerde GPU-servers, of laat de kaarten inzetten in ons US hosting met stroom en koeling geregeld. Bekijk het volledige GPU-assortiment hieronder.
Geverifieerde voorraad
Elke GPU wordt getest en geïnspecteerd voordat deze wordt verzonden
Snelle verzending
Verzending binnen 1–3 werkdagen
Cryptovaluta Geaccepteerd
Betaal met BTC, ETH, USDT & meer
Expertsupport
Specialisten voor AI- en GPU-infrastructuur beschikbaar
De AI-revolutie wordt aangedreven door een opmerkelijk klein aantal siliciumchips. De data centre GPU-collectie van NVIDIA, van de H100 en H200 Tensor Core GPU's tot de RTX PRO 6000 Blackwell en de RTX 5090, vormt de rekenbasis waarin grote taalmodellen, diffusie-modellen, wetenschappelijke simulaties en inference-pijplijnen met hoge frequentie draaien. Wij voeren het volledige professionele NVIDIA-assortiment — data centre accelerators, werkstation GPU's en professionele visualisatiekaarten — voor bedrijfskoopjes, onderzoekscentra, AI-startups en cloud-infrastructuuroperators.
H200 Geheugen BW
4.8 TB/s
HBM3e @ 141 GB capaciteit
H100 AI-prestaties
3.9 PFLOPS
FP8 sparsere tensorbewerkingen
RTX PRO 6000 VRAM
96 GB
GDDR7 ECC — Blackwell architectuur
RTX 5090 VRAM
32 GB GDDR7
Blackwell GB202 — 3352 GB/s BW
80 GB HBM2e
Het werkpaard voor enterprise AI-training. 3,35 TFLOPS FP64, NVLink 900 GB/s. SXM-variant wordt aanbevolen voor multi-GPU NVSwitch-netwerken in DGX H100-systemen.
141 GB HBM3e
Opvolger van H100. Hetzelfde Hopper GPU-beeld, maar met 1,76× meer geheugen en 4,8 TB/s bandbreedte — essentieel voor LLM-inferentie met lange contextvensters.
40 GB / 80 GB HBM2e
Vorige generatie werkpaard nog steeds intensief in gebruik. 312 TFLOPS FP16 Tensor Core. Breed beschikbaar in originele en aangepaste PCIe-configuraties.
96 GB GDDR7 ECC
De krachtigste werkstation-GPU ooit gebouwd. Volledig PCIe-formaat, ondersteuning voor NVLink-brug, 4e-generatie Tensor Cores. Perfect voor lokale LLM-inferentie en rendering.
32 GB GDDR7
NVIDIA's consumenten vlaggenschip op Blackwell-architectuur. 21.760 CUDA-kernen, 3352 GB/s geheugenbandbreedte. Beste single-GPU voor gemengde workloads en inference.
24 GB GDDR6X
Vorige Ada-generatie. 16.384 CUDA-kernen, 1008 GB/s BW. Nog steeds een sterke performer en een meer toegankelijke prijs voor inference clusters.
8 GB GDDR6
Professionele GPU met een laag profiel voor edge inference en display-uit workloads. Minimale stroomverbruik, stille werking, rack-dichte inzet.
16 / 24 GB GDDR6
Inference-geoptimaliseerde Ada en Ampere PCIe GPU's. Ontworpen voor krachtbeperkte server slots — 72 W TDP — met sterke INT8 doorvoer voor grootschalige inzet.
NVIDIA heeft sinds het begin van de AI-boom drie belangrijke GPU-microarchitecturen geleverd. De Hopper-architectuur (H100, H200) introduceerde de Transformer Engine — een hardwareblok dat de precisie dynamisch schakelt tussen FP8 en FP16 binnen één layerrun om de doorvoer te maximaliseren zonder significante nauwkeurigheidsverlies. Dit was de ontwerpdoorbraak die het trainen van modellen met meer dan 70 miljard parameters commercieel haalbaar maakte.
Ada Lovelace (RTX 4090, L4, L40S) bracht de Tensor Core van de 4e generatie naar de professionele en prosumer markt, naast aanzienlijk verbeterde hardware voor ray tracing. Ada-kaarten bevinden zich in de perfecte balans tussen gebruiksvriendelijkheid voor consumenten en professionele capaciteit, waardoor zij de voorkeurskeuze zijn voor boutique inference-implementaties en creatieve AI-werkstations.
Blackwell (RTX 5090, RTX PRO 6000, GB200 NVL72) is de huidige generatie. Blackwell heeft een dual-die GPU-ontwerp geïntroduceerd voor de vlaggenschip onderdelen van het data centre, NVLink 5.0 met 1,8 TB/s die-naar-die bandbreedte, en vijfde generatie Tensor Cores met ondersteuning voor FP4. De RTX PRO 6000 Blackwell biedt 96 GB ECC-geheugen aan voor het werkstationsegment — meer capaciteit dan een H100 PCIe — waardoor workloads die voorheen alleen in de cloud konden worden uitgevoerd, nu lokaal kunnen worden uitgevoerd.
De drie GPU's die de moderne AI-infrastructuur op workstation- en single-node serverniveau definiëren.
De gouden standaard voor gedistribueerde training. NVSwitch-verbonden SXM-versie is verplicht voor 8-GPU DGX-klasse knooppunten. PCIe-versie past in standaard servers.
Same Hopper GPU als H100 maar bijna het dubbele geheugen en veel grotere bandbreedte. Ideaal voor het schaalbaar bedienen van modellen met meer dan 70 miljard parameters met lange contextlengtes.
Meer VRAM dan een H100 in een standaard PCIe-sleuf. Past in elke werkstations of torenserver. Voert 70B-modellen lokaal uit. De RTX PRO 6000 Server Edition verwijdert beeldoutput voor rack-geoptimaliseerde inzet.
De GPU die een model traint, is niet noodzakelijkerwijs de beste GPU om het te bedienen. Training vereist maximale FLOPS en groot geheugen om parameters, gradients en optimalisatorstatussen gelijktijdig te bewaren — een 70B-model dat met AdamW is fijngesteld, vereist meer dan 500 GB VRAM over een cluster. Voor training op deze schaal zijn H100- of H200 SXM-knooppunten verbonden via NVSwitch de industrienorm, met de combinatie van pure rekenkracht en de NVLink-bandbreedte die nodig is om alle GPU's van voldoende voeding te voorzien.
Inference-werkbelastingen maken zich minder zorgen over FLOPS en meer over geheugencapaciteit en bandbreedte. Een gequantiseerde 70B-model op INT4 past ongeveer 40 GB — wat betekent dat een H200 het met ruimte over kan ondersteunen, en een paar RTX PRO 6000 Blackwell-kaarten verbonden via NVLink Bridge kunnen hetzelfde doen. Voor inference-diensten met hoge doorvoer houdt de 4,8 TB/s bandbreedte van de H200 de latentie laag, zelfs onder gelijktijdige verzoekbatches.
Lokale werkstationgebruik - onderzoek, creatieve AI, lokale LLM-chat, afbeeldingsgeneratie, videosynthese - worden goed bediend door de RTX PRO 6000 Blackwell (96 GB), de RTX 5090 (32 GB) of de A100 (40/80 GB), afhankelijk van de grootte van het model. De RTX 4090 blijft de meest prijsconcurrerende optie voor gebruikers die gekwantiseerde modellen onder de 24 GB draaien.
Multi-node NVSwitch-cluster. Verplicht voor grootschalige pre-trainings- en volledige finetuning.
High-bandwidth geheugen essentieel voor het bedienen van lange contexten. NVLink-Bridge voor werkstationparen.
32–80 GB voldoende voor gekwantiseerde dienstverlening. Sterke INT8- doorvoer.
Meeste VRAM op een PCIe-kaart. Draait modellen van 34B ongetailleerd. ECC voor betrouwbaarheid.
Hoog CUDA-core aantal + snelle GDDR7-bandbreedte ideaal voor diffusie-inferentie.
Sub-75 W TDP. Enkel-slot of low-profile. Dichte rack-implementatie.
ECC-geheugen, gecertificeerde stuurprogramma's, grote framebuffers voor 3D/CAD/simulatie.
De GB200 koppelt twee Blackwell GPU-chipsets op één pakket die verbonden zijn via NVLink-C2C met 1,8 TB/s — waardoor de PCIe-belemmering tussen verwerkings Eenheden volledig wordt geëlimineerd.
Nieuwe FP4 precisie-modus levert tot 2× de doorvoer van FP8 voor inferentie workloads. Behoudt de nauwkeurigheid dankzij NVIDIA's microschaalformat (MXFP4).
Schaalvergroting van bandbreedte verdubbelt ten opzichte van Hopper — 1,8 TB/s in beide richtingen per GPU. Cruciaal voor de NVL72 rackconfiguratie waarin 72 Blackwell Miners worden gekoppeld tot één logisch geheel.
Een speciale Reliability, Availability & Serviceability-engine voor voorspellende hardwarefoutdetectie — vermindert ongeplande uitvaltijd in productie-inferentieclusters.
Hardware-geïsoleerde TEE (Trusted Execution Environment) voor GPU-workloads. Maakt het mogelijk om gepatenteerde modellen en gevoelige inferenties veilig uit te voeren in gedeelde cloudinfrastructuur.
96 GB GDDR7 ECC in standaard PCIe dual-slot form factor. Werkstation-kwaliteit betrouwbaarheid met datacenter-klasse geheugencapaciteit. Servereditie verwijdert beelduitgangen.
De GeForce RTX 5090 brengt Blackwell op de consumenten- en prosumer-markt. Gebouwd op de GB202-chip met 21.760 CUDA-kernen en 32 GB GDDR7-geheugen dat met 1.792 GB/s bandbreedte draait, is het de krachtigste single-GPU die in een standaard desktop-PC past. Voor AI-onderzoekers en ontwikkelaars die lokale inference en experimentatie zonder cloudkosten nodig hebben, is de RTX 5090 de pragmatische keuze.
De RTX PRO 6000 Blackwell neemt een fundamenteel andere benadering: in plaats van de maximale prestaties voor consumentenspellen, heeft NVIDIA een workstation GPU ontwikkeld met 96 GB ECC GDDR7-geheugen — meer dan enige eerdere PCIe GPU van welke fabrikant dan ook. De Server Edition en Max-Q Workstation Edition varianten dekken respectievelijk rack-mount en mobiel gebruik. Twee RTX PRO 6000 kaarten verbonden via NVLink Bridge bieden 192 GB gedeeld geheugen — voldoende voor het draaien van 70B parameters modellen ongedigitaliseerd.
Voor studiotechnologieën, onderzoeks-laboratoria en AI-startups die niet kunnen of willen elke workload in de cloud uitvoeren, verandert de Blackwell workstation-lijn de berekening volledig. Eigen modellen blijven on-premises. Inferentie-latentie daalt. Soevereiniteit over gegevens blijft gewaarborgd. De initiële hardwarekosten worden afgeschreven tegen de cloud-inferentiekosten die anders onbeperkt zouden oplopen.
Bekijk ons volledige assortiment professionele NVIDIA GPU's hierboven, van enkele werkstationkaarten tot multi-GPU serverconfiguraties. Of u nu uw eerste model traint of een inference-cluster schaalt, ons team helpt u om de juiste hardware te koppelen aan uw werklast en budget.