GPU's te koop: NVIDIA RTX 5090, A100, H100 en RTX PRO 6000

Koop NVIDIA-GPU's bij MillionMiner, van consumenten Blackwell tot datacenterklasse, voor AI- en professionele werkzaamheden. Beschikbare kaarten zijn onder andere de RTX 5090 32GB en RTX 4090 24GB in blowervarianten, de RTX PRO 6000 Blackwell 96GB, en de A100- en H100 Tensor Core GPU's. Nieuw met fabrieksgarantie, tenzij een aanbieding anders vermeldt.

Elke GPU wordt gratis wereldwijd DDP verzonden, dus de afrekenprijs is de uiteindelijke landed cost. Voor multi-kaart bouws, zie onze vooraf geassembleerde GPU-servers, of laat de kaarten inzetten in ons US hosting met stroom en koeling geregeld. Bekijk het volledige GPU-assortiment hieronder.

5.0
ster ster ster ster ster
4.97
ster ster ster ster ster
4.5
ster ster ster ster ster
Honeycomb-grid Honeycomb-grid
Filter & Sorteer

Geverifieerde voorraad

Elke GPU wordt getest en geïnspecteerd voordat deze wordt verzonden

Snelle verzending

Verzending binnen 1–3 werkdagen

Cryptovaluta Geaccepteerd

Betaal met BTC, ETH, USDT & meer

Expertsupport

Specialisten voor AI- en GPU-infrastructuur beschikbaar

AI & GPU Computing

Professionele AI GPU's voor training, inferentie en HPC-workloads

De AI-revolutie wordt aangedreven door een opmerkelijk klein aantal siliciumchips. De data centre GPU-collectie van NVIDIA, van de H100 en H200 Tensor Core GPU's tot de RTX PRO 6000 Blackwell en de RTX 5090, vormt de rekenbasis waarin grote taalmodellen, diffusie-modellen, wetenschappelijke simulaties en inference-pijplijnen met hoge frequentie draaien. Wij voeren het volledige professionele NVIDIA-assortiment — data centre accelerators, werkstation GPU's en professionele visualisatiekaarten — voor bedrijfskoopjes, onderzoekscentra, AI-startups en cloud-infrastructuuroperators.

H200 Geheugen BW

4.8 TB/s

HBM3e @ 141 GB capaciteit

H100 AI-prestaties

3.9 PFLOPS

FP8 sparsere tensorbewerkingen

RTX PRO 6000 VRAM

96 GB

GDDR7 ECC — Blackwell architectuur

RTX 5090 VRAM

32 GB GDDR7

Blackwell GB202 — 3352 GB/s BW


NVIDIA Professionele GPU-lijn

Van werkstation tot hyperscale datacenter

H100 SXM / PCIe

80 GB HBM2e

Het werkpaard voor enterprise AI-training. 3,35 TFLOPS FP64, NVLink 900 GB/s. SXM-variant wordt aanbevolen voor multi-GPU NVSwitch-netwerken in DGX H100-systemen.

H200 SXM / PCIe

141 GB HBM3e

Opvolger van H100. Hetzelfde Hopper GPU-beeld, maar met 1,76× meer geheugen en 4,8 TB/s bandbreedte — essentieel voor LLM-inferentie met lange contextvensters.

A100 PCIe / SXM

40 GB / 80 GB HBM2e

Vorige generatie werkpaard nog steeds intensief in gebruik. 312 TFLOPS FP16 Tensor Core. Breed beschikbaar in originele en aangepaste PCIe-configuraties.

RTX PRO 6000 Blackwell

96 GB GDDR7 ECC

De krachtigste werkstation-GPU ooit gebouwd. Volledig PCIe-formaat, ondersteuning voor NVLink-brug, 4e-generatie Tensor Cores. Perfect voor lokale LLM-inferentie en rendering.

RTX 5090 (GB202)

32 GB GDDR7

NVIDIA's consumenten vlaggenschip op Blackwell-architectuur. 21.760 CUDA-kernen, 3352 GB/s geheugenbandbreedte. Beste single-GPU voor gemengde workloads en inference.

RTX 4090 (Ada)

24 GB GDDR6X

Vorige Ada-generatie. 16.384 CUDA-kernen, 1008 GB/s BW. Nog steeds een sterke performer en een meer toegankelijke prijs voor inference clusters.

T1000 (Professional)

8 GB GDDR6

Professionele GPU met een laag profiel voor edge inference en display-uit workloads. Minimale stroomverbruik, stille werking, rack-dichte inzet.

A2 / L4 (PCIe)

16 / 24 GB GDDR6

Inference-geoptimaliseerde Ada en Ampere PCIe GPU's. Ontworpen voor krachtbeperkte server slots — 72 W TDP — met sterke INT8 doorvoer voor grootschalige inzet.

Het NVIDIA Architectuur Verhaal

Hopper, Ada Lovelace & Blackwell — Drie generaties die de AI-tijd aansturen

NVIDIA heeft sinds het begin van de AI-boom drie belangrijke GPU-microarchitecturen geleverd. De Hopper-architectuur (H100, H200) introduceerde de Transformer Engine — een hardwareblok dat de precisie dynamisch schakelt tussen FP8 en FP16 binnen één layerrun om de doorvoer te maximaliseren zonder significante nauwkeurigheidsverlies. Dit was de ontwerpdoorbraak die het trainen van modellen met meer dan 70 miljard parameters commercieel haalbaar maakte.

Ada Lovelace (RTX 4090, L4, L40S) bracht de Tensor Core van de 4e generatie naar de professionele en prosumer markt, naast aanzienlijk verbeterde hardware voor ray tracing. Ada-kaarten bevinden zich in de perfecte balans tussen gebruiksvriendelijkheid voor consumenten en professionele capaciteit, waardoor zij de voorkeurskeuze zijn voor boutique inference-implementaties en creatieve AI-werkstations.

Blackwell (RTX 5090, RTX PRO 6000, GB200 NVL72) is de huidige generatie. Blackwell heeft een dual-die GPU-ontwerp geïntroduceerd voor de vlaggenschip onderdelen van het data centre, NVLink 5.0 met 1,8 TB/s die-naar-die bandbreedte, en vijfde generatie Tensor Cores met ondersteuning voor FP4. De RTX PRO 6000 Blackwell biedt 96 GB ECC-geheugen aan voor het werkstationsegment — meer capaciteit dan een H100 PCIe — waardoor workloads die voorheen alleen in de cloud konden worden uitgevoerd, nu lokaal kunnen worden uitgevoerd.


Neben anander

H100 versus H200 versus RTX PRO 6000 Blackwell

De drie GPU's die de moderne AI-infrastructuur op workstation- en single-node serverniveau definiëren.

Hopper

H100 SXM5

Het beste voor training
Geheugen 80 GB HBM2e
Geheugen BW 3.35 TB/s
FP8 Sparse 3.9 PFLOPS
TDP 700 W (SXM)
NVLink NVLink 4 — 900 GB/s
Formfactor SXM5 / PCIe

De gouden standaard voor gedistribueerde training. NVSwitch-verbonden SXM-versie is verplicht voor 8-GPU DGX-klasse knooppunten. PCIe-versie past in standaard servers.

Hopper

H200 SXM5

Beste voor inference
Geheugen 141 GB HBM3e
Geheugen BW 4.8 TB/s
FP8 Sparse 3.9 PFLOPS
TDP 700 W (SXM)
NVLink NVLink 4 — 900 GB/s
Formfactor SXM5 / PCIe

Same Hopper GPU als H100 maar bijna het dubbele geheugen en veel grotere bandbreedte. Ideaal voor het schaalbaar bedienen van modellen met meer dan 70 miljard parameters met lange contextlengtes.

Blackwell

RTX PRO 6000 BW

Beste werkstation
Geheugen 96 GB GDDR7 ECC
Geheugen BW ~1.8 TB/s
Tensor Cores 5th-gen, FP4/FP8/FP16
TDP 300 W (PCIe)
NVLink NVLink Bridge (optional)
Formfactor Dual-slot PCIe x16

Meer VRAM dan een H100 in een standaard PCIe-sleuf. Past in elke werkstations of torenserver. Voert 70B-modellen lokaal uit. De RTX PRO 6000 Server Edition verwijdert beeldoutput voor rack-geoptimaliseerde inzet.


Het juiste GPU kiezen

Training versus inferentie versus werkstation: Welke GPU heeft u nodig?

De GPU die een model traint, is niet noodzakelijkerwijs de beste GPU om het te bedienen. Training vereist maximale FLOPS en groot geheugen om parameters, gradients en optimalisatorstatussen gelijktijdig te bewaren — een 70B-model dat met AdamW is fijngesteld, vereist meer dan 500 GB VRAM over een cluster. Voor training op deze schaal zijn H100- of H200 SXM-knooppunten verbonden via NVSwitch de industrienorm, met de combinatie van pure rekenkracht en de NVLink-bandbreedte die nodig is om alle GPU's van voldoende voeding te voorzien.

Inference-werkbelastingen maken zich minder zorgen over FLOPS en meer over geheugencapaciteit en bandbreedte. Een gequantiseerde 70B-model op INT4 past ongeveer 40 GB — wat betekent dat een H200 het met ruimte over kan ondersteunen, en een paar RTX PRO 6000 Blackwell-kaarten verbonden via NVLink Bridge kunnen hetzelfde doen. Voor inference-diensten met hoge doorvoer houdt de 4,8 TB/s bandbreedte van de H200 de latentie laag, zelfs onder gelijktijdige verzoekbatches.

Lokale werkstationgebruik - onderzoek, creatieve AI, lokale LLM-chat, afbeeldingsgeneratie, videosynthese - worden goed bediend door de RTX PRO 6000 Blackwell (96 GB), de RTX 5090 (32 GB) of de A100 (40/80 GB), afhankelijk van de grootte van het model. De RTX 4090 blijft de meest prijsconcurrerende optie voor gebruikers die gekwantiseerde modellen onder de 24 GB draaien.

Snelle Selectiegids

Stem uw werklast af op de juiste hardware

LLM Training (70B+)
H100 / H200 SXM

Multi-node NVSwitch-cluster. Verplicht voor grootschalige pre-trainings- en volledige finetuning.

LLM Inference (70B)
H200 or 2× RTX PRO 6000

High-bandwidth geheugen essentieel voor het bedienen van lange contexten. NVLink-Bridge voor werkstationparen.

LLM Inference (7–13B)
RTX 5090 / A100 80GB

32–80 GB voldoende voor gekwantiseerde dienstverlening. Sterke INT8- doorvoer.

Lokale AI-Workstation
RTX PRO 6000 BW (96 GB)

Meeste VRAM op een PCIe-kaart. Draait modellen van 34B ongetailleerd. ECC voor betrouwbaarheid.

Beeld / Video Gen
RTX 5090 / RTX 4090

Hoog CUDA-core aantal + snelle GDDR7-bandbreedte ideaal voor diffusie-inferentie.

Edge / Laag-vermogen Inference
T1000 / L4 / A2

Sub-75 W TDP. Enkel-slot of low-profile. Dichte rack-implementatie.

Professionele visualisatie
RTX PRO 6000 / A100

ECC-geheugen, gecertificeerde stuurprogramma's, grote framebuffers voor 3D/CAD/simulatie.


Blackwell Architectuur Hoogtepunten

Wat maakt Blackwell een generatie sprong

Dual-Die GPU ontwerp

De GB200 koppelt twee Blackwell GPU-chipsets op één pakket die verbonden zijn via NVLink-C2C met 1,8 TB/s — waardoor de PCIe-belemmering tussen verwerkings Eenheden volledig wordt geëlimineerd.

5e generatie Tensor Cores

Nieuwe FP4 precisie-modus levert tot 2× de doorvoer van FP8 voor inferentie workloads. Behoudt de nauwkeurigheid dankzij NVIDIA's microschaalformat (MXFP4).

NVLink 5.0

Schaalvergroting van bandbreedte verdubbelt ten opzichte van Hopper — 1,8 TB/s in beide richtingen per GPU. Cruciaal voor de NVL72 rackconfiguratie waarin 72 Blackwell Miners worden gekoppeld tot één logisch geheel.

RAS Engine

Een speciale Reliability, Availability & Serviceability-engine voor voorspellende hardwarefoutdetectie — vermindert ongeplande uitvaltijd in productie-inferentieclusters.

Vertrouwelijke Computing

Hardware-geïsoleerde TEE (Trusted Execution Environment) voor GPU-workloads. Maakt het mogelijk om gepatenteerde modellen en gevoelige inferenties veilig uit te voeren in gedeelde cloudinfrastructuur.

RTX PRO 6000 — PCIe vlaggenschip

96 GB GDDR7 ECC in standaard PCIe dual-slot form factor. Werkstation-kwaliteit betrouwbaarheid met datacenter-klasse geheugencapaciteit. Servereditie verwijdert beelduitgangen.

NVIDIA Blackwell

De RTX 5090 en RTX PRO 6000: Blackwell voor professionals

De GeForce RTX 5090 brengt Blackwell op de consumenten- en prosumer-markt. Gebouwd op de GB202-chip met 21.760 CUDA-kernen en 32 GB GDDR7-geheugen dat met 1.792 GB/s bandbreedte draait, is het de krachtigste single-GPU die in een standaard desktop-PC past. Voor AI-onderzoekers en ontwikkelaars die lokale inference en experimentatie zonder cloudkosten nodig hebben, is de RTX 5090 de pragmatische keuze.

De RTX PRO 6000 Blackwell neemt een fundamenteel andere benadering: in plaats van de maximale prestaties voor consumentenspellen, heeft NVIDIA een workstation GPU ontwikkeld met 96 GB ECC GDDR7-geheugen — meer dan enige eerdere PCIe GPU van welke fabrikant dan ook. De Server Edition en Max-Q Workstation Edition varianten dekken respectievelijk rack-mount en mobiel gebruik. Twee RTX PRO 6000 kaarten verbonden via NVLink Bridge bieden 192 GB gedeeld geheugen — voldoende voor het draaien van 70B parameters modellen ongedigitaliseerd.

Voor studiotechnologieën, onderzoeks-laboratoria en AI-startups die niet kunnen of willen elke workload in de cloud uitvoeren, verandert de Blackwell workstation-lijn de berekening volledig. Eigen modellen blijven on-premises. Inferentie-latentie daalt. Soevereiniteit over gegevens blijft gewaarborgd. De initiële hardwarekosten worden afgeschreven tegen de cloud-inferentiekosten die anders onbeperkt zouden oplopen.


Veelgestelde vragen

Veelgestelde vragen

Beide maken gebruik van dezelfde GH100 Hopper GPU-lichaam en leveren identieke reken FLOPS (~3,9 PFLOPS FP8 sparse). De H200 vervangt HBM2e door HBM3e geheugen: de capaciteit neemt toe van 80 GB tot 141 GB en de bandbreedte groeit van 3,35 TB/s tot 4,8 TB/s. De H200 is daarom beter geschikt voor inference-zware workloads waar grote modellen op een enkele GPU moeten passen en een hoge doorvoer vereist is.

Voor inference workloads ja — de 96 GB ECC GDDR7- capaciteit overschrijdt die van een H100 PCIe met 80 GB en past in elk standaard PCIe werkstationslot. Voor training biedt de H100/H200 SXM-formaat met NVSwitch een aanzienlijk hogere inter-GPU-bandbreedte en meer ruwe FLOPS bij dezelfde TDP. De RTX PRO 6000 is de betere keuze wanneer u lokale hoge VRAM-capaciteit nodig heeft zonder NVSwitch-infrastructuur.

SXM GPU's (H100 SXM5, H200 SXM5) worden op een gespecialiseerde onderplaat gemonteerd in plaats van een PCIe-slot en onderling verbonden via NVSwitch-bekabeling, waardoor een inter-GPU bandbreedte van 900 GB/s per GPU mogelijk is. PCIe-varianten passen in standaard servers en werkstations, maar zijn beperkt tot NVLink Bridge (2 GPU's) of PCIe-bandbreedte (x16, ~64 GB/s) voor multi-GPU communicatie. Voor clusters van 8+ GPU's die all-to-all communicatie vereisen, zijn SXM NVSwitch systemen verplicht.

Bij FP16 (16-bit) precisie vereist een 70B-model ongeveer 140 GB VRAM — een enkele H200 (141 GB) handelt dit net aan. Bij INT8-kwantisatie is ongeveer 70 GB nodig. Bij INT4 (GGUF Q4), ongeveer 35–40 GB, passend binnen een H100 80 GB of een paar RTX 4090s. De RTX PRO 6000 Blackwell (96 GB) verwerkt INT8 70B-modellen op een enkele GPU met ruimte voor KV-cache.

De RTX 5090 is uitstekend voor lokale AI-inferentie, beeldgeneratie (Stable Diffusion, Flux, DALL-E 3-replicaties), videosynthese en het fijn afstemmen van kleine tot middelgrote modellen. De 32 GB GDDR7 is voldoende voor het uitvoeren van 13B-modellen in FP16 en 70B-modellen in INT4. Voor multi-GPU trainingsclusters blijven data centre GPU's de voorkeur houden vanwege NVLink-bandbreedte en grotere geheugen capaciteit.

De NVIDIA A100 (Ampere-architectuur, 2020) blijft een krachtige en veelgebruikte AI GPU. Hij wordt geleverd in configuraties van 40 GB en 80 GB HBM2e, met een prestatie van 312 TFLOPS FP16 Tensor Core. Aangezien de voorraad zich heeft aangepast ten opzichte van H100, is de prijs van de A100 aantrekkelijker geworden. Voor inferentie en matige trainingswerkzaamheden blijft hij krachtig. Voor baanbrekend onderzoek of de grootste modellen worden nu H100/H200 aanbevolen.

Ja. MillionMiner bedient ondernemingen, onderzoeksinstellingen en cloud-infrastructuurklanten met grootschalige GPU-bestellingen. Neem contact op met ons verkoopteam voor prijzen op meerheidsaankopen van H100, H200, A100 en RTX PRO 6000. Wij kunnen freight logistiek, staging en facturering in meerdere valuta's regelen, inclusief crypto.

Ons team is 24/7 bereikbaar via WhatsApp (+49 176 777 888 33), e-mail en telefoon. Wij helpen bij het kiezen van GPU's voor training versus inference workloads, het ontwerpen van multi-GPU clusters, en B2B inkoop. Neem contact met ons op of bezoek onze FAQ voor directe antwoorden.

Klaar om uw AI-infrastructuur te bouwen?

Bekijk ons volledige assortiment professionele NVIDIA GPU's hierboven, van enkele werkstationkaarten tot multi-GPU serverconfiguraties. Of u nu uw eerste model traint of een inference-cluster schaalt, ons team helpt u om de juiste hardware te koppelen aan uw werklast en budget.