Kupte si NVIDIA H100, H200, RTX PRO 6000 nebo L40S pro trénování, inferenci a lokální LLM. Všechny karty jsou nové a doručíme je k vám včetně cla. Poradíme vám, jaký model a provedení se hodí do vašich serverů.…
Menší rozpočet nebo kompaktní sestava: RTX PRO 4000 Blackwell, RTX PRO 4500 Blackwell nebo RTX 4000 SFF Ada. Software, který nepotřebuje CUDA, poběží i na AMD Instinct MI210 nebo Intel Data Center GPU Flex.
Intel Data Center GPU Flex Series
Skladem
—
$1,634.00
NVIDIA Quadro RTX 5000 16GB Profesionální GPU
Skladem
—
$2,400.00
NVIDIA Quadro RTX 8000 48GB profesionální GPU
Skladem
—
$4,500.00
NVIDIA RTX 2000 Ada Generace 16GB Profesionální GPU
Skladem
—
$1,850.00
NVIDIA RTX 4000 Ada generace 20 GB profesionální GPU pro jeden slot
Skladem
—
$2,600.00
NVIDIA RTX 4000 SFF Ada generace 20GB GPU malého formátu
Skladem
—
$1,550.00
NVIDIA RTX 4500 Ada Generace 24GB Profesionální GPU
Skladem
—
$4,400.00
NVIDIA RTX 5000 Ada generace 32GB profesionální GPU
Skladem
—
$5,400.00
NVIDIA RTX A2000 12GB Profesionální GPU s nízkým profilem
Skladem
—
$2,569.00
NVIDIA A10 24GB Tensor Core Data Centre GPU
Skladem
—
$3,700.00
NVIDIA T400 4GB profesionální GPU
Skladem
—
$2,646.00
NVIDIA Quadro P1000 4GB Profesionální GPU s nízkým Profilem
Skladem
—
$2,168.00
Ověřené sklady
Každé GPU je před odesláním testováno a inspekováno
Rychlé odeslání
Odesíláme do 1–3 pracovních dní
Přijímáme kryptoměny
Plaťte s BTC, ETH, USDT a dalšími
Odborná podpora
Specialisté na AI a GPU infrastrukturu k dispozici
Revoluce AI je poháněna překvapivě malým množstvím křemíkových čipů. Sortiment GPU pro datová centra od NVIDIA, od GPU Tensor Core H100 a H200 po RTX PRO 6000 Blackwell a RTX 5090, představuje výpočetní substrát, na kterém běží velké jazykové modely, difuzní modely, vědecké simulace a pipeline s vysokou frekvencí inference. Nabízíme kompletní profesionální sortiment NVIDIA — akcelerátory pro datová centra, GPU pro pracovní stanice a profesionální vizualizační karty — pro podnikové zákazníky, výzkumné laboratoře, startupy v oblasti AI a provozovatele cloudové infrastruktury.
H200 Paměťové BW
4.8 TB/s
HBM3e @ kapacita 141 GB
H100 AI Výkon
3.9 PFLOPS
Operace s řídkým tensorovým formátem FP8
RTX PRO 6000 VRAM
96 GB
GDDR7 ECC — architektura Blackwell
RTX 5090 VRAM
32 GB GDDR7
Blackwell GB202 — 3352 GB/s BW
80 GB HBM2e
Pracovník podnikové tréninku AI. 3,35 TFLOPS FP64, NVLink 900 GB/s. Varianta SXM je preferována pro multi-GPU NVSwitch struktury v systémech DGX H100.
141 GB HBM3e
Nástupce H100. Stejná GPU die Hopper, ale s 1,76× více paměti a přenosovou rychlostí 4,8 TB/s — klíčové pro inference LLM s dlouhými kontextovými okny.
40 GB / 80 GB HBM2e
Pracovní stroj předchozí generace stále ve velkém provozu. 312 TFLOPS FP16 Tensor Core. Je široce dostupný v originálních a upravených konfiguracích PCIe.
96 GB GDDR7 ECC
Nejvýkonnější pracovní stanice GPU vůbec vyvinutá. Plný formát PCIe, podpora NVLink bridge, čtvrtá generace Tensor Core. Ideální pro místní inference LLM a rendering.
32 GB GDDR7
NVIDIA spotřebitelská vlajková loď na architektuře Blackwell. 21 760 CUDA jader, 3 352 GB/s paměťové pásmo. Nejlepší jednodeskový GPU pro smíšené pracovní zatížení a inference.
24 GB GDDR6X
Předchozí generace Ada. 16 384 CUDA jader, 1008 GB/s přenosové pásmo. Stále silný výkon a cenově dostupnější možnost pro inference clustery.
8 GB GDDR6
Profesionální GPU s nízkým profilem pro edge inference a workloads s výstupem na displej. Minimální spotřeba energie, tichý chod, hustá instalace v racku.
16 / 24 GB GDDR6
Inferenčně optimalizované PCIe GPU Ada a Ampere. Navrženo pro servery s omezeným výkonem — TDP 72 W — s vysokým throughputem v INT8 pro nasazení ve velkém měřítku.
NVIDIA dodala od začátku AI boomu tři hlavní mikroarchitektury GPU. Architektura Hopper (H100, H200) zavedla Transformer Engine — hardwarový blok, který dynamicky přepíná přesnost mezi FP8 a FP16 v rámci jedné vrstvy, čímž maximalizuje propustnost bez podstatné ztráty přesnosti. Tento návrhový průlom umožnil komerční nasazení tréninku modelů s více než 70 miliardami parametrů.
Ada Lovelace (RTX 4090, L4, L40S) přinesla čtvrtou generaci Tensor Core na trh profesionálů a prosumerů spolu s výrazně vylepšeným hardwarem pro ray tracing. Karty Ada obsazují ideální střední pozici mezi přístupností pro spotřebitele a profesionální výkonností, což z nich činí dominantní volbu pro boutique inference nasazení a kreativní AI pracovní stanice.
Blackwell (RTX 5090, RTX PRO 6000, GB200 NVL72) je současná generace. Blackwell zavedl dvoudílný návrh GPU pro vrcholné díly datových center, NVLink 5.0 s datovou šířkou 1,8 TB/s die-to-die a pátou generaci Tensor Core s podporou FP4. RTX PRO 6000 Blackwell přináší 96 GB ECC paměti do úrovně pracovních stanic — více kapacity než H100 PCIe — což umožňuje lokální běh dříve výhradně cloudových úloh.
Tři GPU, které určují moderní infrastrukturu AI na úrovni pracovního stanice a jednočlánkového serveru.
Zlatý standard pro distribuované trénování. Varianta SXM připojená pomocí NVSwitch je povinná pro 8-GPU uzly třídy DGX. Varianta PCIe odpovídá standardním serverům.
Stejná GPU Hopper jako H100, ale s téměř dvojnásobnou kapacitou paměti a podstatně vyšší datovou průchodností. Ideální pro obsluhu modelů s více než 70 miliardami parametrů ve velkém měřítku s dlouhými kontextovými délkami.
Více VRAM než H100 ve standardní PCIe zásuvce. Vhodný pro jakoukoli pracovní stanici nebo tower server. Spouští modely o velikosti 70B lokálně. RTX PRO 6000 Server Edition odstraní výstupy zobrazení pro rackově optimalizované nasazení.
GPU, který trénuje model, není nutně nejlepší GPU pro jeho nasazení. Trénování vyžaduje maximální FLOPS a velkou paměť pro současné uložení parametrů, gradientů a stavů optimalizátoru — například 70B model jemně doladěný s AdamW vyžaduje přes 500 GB VRAM napříč clusterem. Pro trénování v této velikosti jsou průmyslovým standardem uzly H100 nebo H200 SXM připojené přes NVSwitch, které nabízejí kombinaci surového výpočetního výkonu a šířky pásma NVLink potřebné k tomu, aby všechny GPU byla napojeny.
Zátěžové práce na inferenci méně záleží na FLOPS a více na kapacitě paměti a šířce pásma. Kvantizovaný model o velikosti 70B při INT4 se vejde přibližně do 40 GB — což znamená, že H200 jej může obsloužit s rezervou, a dva karty RTX PRO 6000 Blackwell připojené přes NVLink Bridge to dokážou také. Pro služby inference s vysokou průchodností udrží šířka pásma H200 o hodnotě 4,8 TB/s nízkou latenci i při současných požadavcích na skupiny požadavků.
Případy použití lokální pracovní stanice — výzkum, kreativní AI, místní LLM chat, generování obrázků, syntéza videa — jsou dobře obsluhovány grafickými kartami RTX PRO 6000 Blackwell (96 GB), RTX 5090 (32 GB) nebo A100 (40/80 GB) v závislosti na požadované velikosti modelu. RTX 4090 zůstává nejvíce cenově výhodnou možností pro uživatele používající kvantizované modely do 24 GB.
Multi-node NVSwitch cluster. Povinné pro rozsáhlé předtrénování a úplné doladění.
Vysoce pásmová paměť je nezbytná pro poskytování dlouhého kontextu. NVLink Bridge pro páry pracovních stanic.
32–80 GB postačuje pro kvantizované poskytování služeb. Silný průchod INT8.
Nejvíce VRAM na PCIe kartě. Spouští modely za 34 miliardů bez kvantizace. ECC pro spolehlivost.
Vyšší počet CUDA jader + rychlá šířka pásma GDDR7 ideální pro difuzní inference.
TDP pod 75 W. Jednotlivá nebo nízkoprofilová karta. Husté rozmístění ve stojanu.
Paměť ECC, certifikovaní ovladače, velké rámcové bufferové paměti pro 3D/CAD/simulaci.
GB200 spojuje dva čipy Blackwell GPU v jednom balení, propojené pomocí NVLink-C2C rychlostí 1,8 TB/s — čímž zcela eliminuje limitaci PCIe mezi výpočetními jednotkami.
Nový režim přesnosti FP4 dosahuje až dvojnásobné průchodnosti oproti FP8 u inference úloh. Zachovává přesnost pomocí NVIDIA mikroškálovacího formátu (MXFP4).
Rozšíření šířky pásma zdvojnásobí v porovnání s Hopper — 1,8 TB/s oboustranně na GPU. Klíčové pro konfiguraci stojanu NVL72, která spojuje 72 GPU Blackwell do jednoho logického celku.
Dedikovaný engine pro Reliability, Availability & Serviceability pro prediktivní detekci hardwarových poruch — snižuje neplánované odstávky v produkčních inference klastrech.
Hardwarově izolované TEE (Důvěryhodné prostředí pro spuštění) pro pracovní zátěže GPU. Umožňuje bezpečné spuštění vlastních modelů a citlivé inference v sdílené cloudové infrastruktuře.
96 GB GDDR7 ECC ve standardním formátu PCIe s dvojitým slotem. Spolehlivost úrovně pracovního stanice s kapacitou paměti třídy datového centra. Serverová edice odstraňuje výstupy pro displej.
GeForce RTX 5090 uvádí Blackwell na trh spotřební a pro-sumerové grafické karty. Postavena na čipu GB202 s 21 760 CUDA jádry a 32 GB GDDR7 pamětí s přenosovou rychlostí 1 792 GB/s, je to nejsilnější jednotný GPU, který se vejde do standardního stolního počítače. Pro AI výzkumníky a vývojáře, kteří potřebují místní inference a experimentování bez cloudových nákladů, je RTX 5090 rozumnou volbou.
RTX PRO 6000 Blackwell přistupuje odlišně: namísto maximalizace výkonu pro spotřebitelské herní využití navrhla společnost NVIDIA pracovní stanici GPU s 96 GB ECC GDDR7 paměti — více než jakékoliv předchozí PCIe GPU od jakéhokoliv výrobce. Varianty Server Edition a Max-Q Workstation Edition pokrývají nasazení v racku a na mobilních zařízeních. Dvě karty RTX PRO 6000 připojené pomocí NVLink Bridge poskytují 192 GB sdílené paměti — dostatečné pro provoz modelů s 70 miliardami parametrů ve formátu bez kvantování.
Pro studia, výzkumné laboratoře a AI startupy, které nemohou nebo nechtějí provozovat veškerou zátěž v cloudu, mění řada Blackwell workstation zcela výpočty. Vlastní modely zůstanou na místě. Latence inference se sníží. Svrchovanost dat je zachována. Počáteční náklady na hardware jsou amortizovány na základě cloudových nákladů na inference, které by jinak narůstaly nepřetržitě.
Prohlédněte si naši kompletní nabídku profesionálních GPU NVIDIA výše, od jednotlivých karet pro pracovní stanice po více GPU v serverových konfiguracích. Ať už trénujete svůj první model nebo škálujete inference cluster, náš tým Vám pomůže sladit správný hardware s Vaší pracovní zátěží a rozpočtem.