NVIDIA
Model: RTX 5090 32GB Blower
RTX 5090 32GB w konfiguracji chłodzenia typu blower dwu-slotowego do wdrożeń w serwerach wielogpu i szafach AI. Ten sam układ scalony GB202 Blackwell: 21 760 rdzeni CUDA, 680 piątej generacji Tensor rdzeni, 32GB GDDR7… przy 1 792 GB/s, około 104,8 TFLOPS FP32. Zamknięty blower odprowadza ciepło na zewnątrz przez tylny uchwyt, co umożliwia instalację do 8 GPU w jednej obudowie. Złącze zasilania 16-pin przeniesione do tylnego brzegu dla lepszego wykorzystania przestrzeni w racku. TDP 575 W. PCIe Gen 5 x16. Jest to konwersja aftermarket blower lub wariant AFOX Professional, nie jest to standardowy produkt detaliczny NVIDIA.
Wybierz dostępność
Ilość
$6,099.00
Kupujesz 10 lub więcej? Uzyskaj niestandardową cenę hurtową
Pay withCeny i dostępność zmieniają się wraz z rynkiem. Potwierdzamy oba z Państwem, zanim zamówienie stanie się wiążące. Sprawdź cenę i dostępność
Prawdziwe
Przetestowane urządzenia
Na świecie
Globalne wysyłki
Wsparcie
Eksperci ds. kopania
RTX 5090 32GB w konfiguracji chłodzenia typu blower dwu-slotowego do wdrożeń w serwerach wielogpu i szafach AI. Ten sam układ scalony GB202 Blackwell: 21 760 rdzeni CUDA, 680 piątej generacji Tensor rdzeni, 32GB GDDR7… przy 1 792 GB/s, około 104,8 TFLOPS FP32. Zamknięty blower odprowadza ciepło na zewnątrz przez tylny uchwyt, co umożliwia instalację do 8 GPU w jednej obudowie. Złącze zasilania 16-pin przeniesione do tylnego brzegu dla lepszego wykorzystania przestrzeni w racku. TDP 575 W. PCIe Gen 5 x16. Jest to konwersja aftermarket blower lub wariant AFOX Professional, nie jest to standardowy produkt detaliczny NVIDIA.
Pick a workload to check the RTX 5090 Blower with 32 GB.
Llama 3.1 8B
A common local assistant model at 4-bit quantisation.
Tell us the workload and we will size a multi-GPU server for it.
Stacking that many cards is rarely the right answer. Ask us to size a server instead
VRAM figures are estimates for single-user inference and include headroom for context and system overhead. Throughput depends on model, settings and driver stack.
Cennik, czas realizacji i opcje hostingu. Osobista porada od naszego zespołu sprzedaży.
Cennik, czas realizacji i opcje hostingu. Osobista porada od naszego zespołu sprzedaży.
RTX 5090 32GB Blower to produkt, który zgodnie z oficjalnym planem produktów NVIDIA nie powinien istnieć, ale istnieje ze względu na zapotrzebowanie rynku obliczeń AI na multi-GPU o dużej gęstości konsumenckiej Blackwell, którą NVIDIA oficjalnie oferuje jedynie w ramach linii RTX PRO 6000 za ponad 10 000 USD. Warsztaty uzupełniają lukę, konwertując standardowe karty RTX 5090 z retaille'u na konfiguracje z chłodzeniem typu blower, dwugwiazdkowe, zoptymalizowane do montażu w rackach serwerowych. Proces konwersji jest dobrze udokumentowany. Tom's Hardware uzyskał nagrania od twórcy Ajian Talk z Bilibili, pokazujące fabrykę „CT” w Shenzhen: stosy pudełek z kartami RTX 5090, każda poddawana… testom funkcjonalnym, następnie odlutowywane od oryginalnych 3-slotowych otwartych PCB z GPU i modułów GDDR7, czyszczone, ponownie luturowane i montowane na niestandardowych dwugwiazdkowych PCB przeznaczonych do chłodzenia blowerem. Wtyczka zasilania 16-pin jest przenoszona na tylny brzeg (zgodnie z konwencjami profesjonalnych GPU) dla lepszego przepływu kabli w gęstych konfiguracjach multi-GPU. 24-godzinne testy spalania i wielokrotne cykle zasilania potwierdzają stabilność przy obciążeniu ciągłym 575W do 600W. CT rzekomo używa komponentów wyższej klasy, ulepszonego rozplanowania PCB i pokrycia kontaktów PCIe złotem, zdolnych do pracy przy dużym napięciu. Profesjonalna RTX 5090 32GB od AFOX to jedyna półoficjalna wersja od partnera NVIDIA AIB, wyposażona w tę samą koncepcję blowera w formie fabrycznej za 5999 USD (HydraCluster Tech). Należy potwierdzić podczas zakupu, czy zapasy MillionMiner to jednostki AFOX, czy konwersje warsztatowe z Chin. Matematyka skalowania multi-GPU napędza decyzję zakupową. Osiem kart RTX 5090 blower w jednym chassis serwera: 256GB łącznego GDDR7, około 838 TFLOPS FP32 łącznie, 5440 piątej generacji Tensor Cores. Każda karta działa niezależnie na 32GB i obsługuje pasmo PCIe Gen 5 (brak interfejsu NVLink). Dla zadań ekstremalnie równoległych (serwowanie inferrencji, kopanie, rendering), gdzie każda GPU operuje na niezależnych danych, ta architektura zapewnia ogromną przepustowość na węzeł. W przypadku zadań wymagających dzielenia pamięci GPU (rozproszone szkolenie z synchronizacją gradientów), brak NVLink ogranicza wydajność skalowania w porównaniu do klastrów z NVLink H100/B200. AI inference na 8 GPU: każda karta obsługuje jednocześnie niezależne modele od 13B do 25B. Osiem kart w równoległym inferencingu obsługuje znaczące obciążenia produkcyjne. Dla startupów AI i laboratoriów badawczych potrzebujących lokalnej infrastruktury inferencyjnej bez cen H100/B200, blower RTX 5090 oferuje najefektywniejszy stosunek mocy obliczeniowej do ceny. Kopanie na multi-GPU: osiem kart, około 0,83 USD zysku dziennie każda (Hashrate.no przy 0,10 USD/kWh) generuje około 6,64 USD dziennie z jednego węzła. Wynajem GPU przez Clore.ai po do 10,52 USD za kartę dziennie może wygenerować do 84 USD dziennie na węzeł, jeśli wszystkie osiem kart jest wynajętych jednocześnie. Ekonomia wynajmu drastycznie przewyższa bezpośrednie kopanie dla operatorów multi-GPU. Uczciwe zastrzeżenia. To modyfikacje sprzętu na rynku wtórnym, nieoryginalne GPU zaprojektowane do pracy w chłodzeniu blowerem przy 575W ciągłego obciążenia. Proces konwersji wiąże się z ryzykiem: ponowne lutowanie GPU to precyzyjna praca, w której defekty mogą nie objawiać się od razu, lecz pojawić się pod wpływem długotrwałego stresu termicznego. Nie obowiązuje gwarancja NVIDIA. Gwarancja pochodzi od konwertera/sprzedawcy (warunki MillionMiner). Wentylator blower przy 575W generuje znaczący hałas. Temperatura modułów pamięci na niestandardowych PCB może się różnić od zatwierdzonych przez NVIDIA rozwiązań termicznych.
Standardowe karty RTX 5090 (w stylu "Fan" w cenie 5 000 USD) zajmują od 2,5 do 3,5 slotów i odprowadzają ciepło wewnątrz obudowy. Montaż dwóch w jednym systemie jest trudny. Montaż czterech lub ośmiu jest fizycznie niemożliwy. Wariant z wentylatorem rozwiązuje ten problem: szerokość podwójnego slotu, zamknięte chłodzenie odprowadzające ciepło na tył, 16-pinowe zasilanie przesunięte do tylnego krawędzi w celu zapewnienia przestrzeni na kable między sąsiednimi kartami. Do 8 kart RTX 5090 z wentylatorem w jednej obudowie serwerowej. Osiem kart… oznacza 256 GB łącznej pamięci VRAM GDDR7 oraz około 838 TFLOPS FP32 łącznej mocy obliczeniowej z jednego węzła. To prawdziwa klasa obliczeń centrum danych w cenie konsumenckiego GPU. Dla porównania, węzeł z 8 GPU A100 80GB (640 GB HBM2e, 156 TFLOPS FP32) kosztuje ponad 60 000 USD tylko za karty GPU. Osiem kart RTX 5090 z wentylatorem dostarcza 5,4 razy więcej mocy obliczeniowej FP32 za ułamek kosztów, choć bez szerokości pasma HBM, NVLink czy możliwości MIG. Ta kategoria produktów istnieje ze względu na popyt rynkowy, a nie oficjalne planowanie produktów NVIDIA. Tom's Hardware, VideoCardz i WCCFTech dokumentują łańcuch dostaw: detaliczne karty RTX 5090 są kupowane, rozmontowywane w chińskich warsztatach (zwłaszcza "CT" w Shenzhen), układy GPU i moduły VRAM są odlutowywane, czyszczone, ponownie zalutowywane i montowane na niestandardowych dwuslotowych PCB z chłodzeniem z wentylatorem. Testowanie funkcjonalne przed demontażem, 24-godzinne wypalanie po montażu i komponenty PCB wyższej jakości zapewniają stabilność przy stałej pracy na poziomie 575W do 600W. AFOX RTX 5090 Professional jest jedynym półoficjalnym wariantem z wentylatorem, dostępny w sprzedaży za 5 999 USD w USA. Ta sama moc obliczeniowa co styl Fan: 21 760 rdzeni CUDA, 680 piątej generacji rdzeni Tensor (FP4/FP8), 170 rdzeni RT, 32 GB GDDR7 z przepustowością 1 792 GB/s, PCIe Gen 5. Brak NVLink.
Nasi specjaliści ds. kopania mogą pomóc Ci znaleźć idealny miner dla Twojej konfiguracji i budżetu.
RTX 5090 przebudowany w konfiguracji typu dual-slot blower dla wielogpu density. To samo GB202: 21 760 rdzeni CUDA, 32GB GDDR7 przy 1 792 GB/s, ~104,8 TFLOPS FP32, piątej generacji rdzenie Tensor FP4. Blower wyprowadza ciepło na tylną listwę. Do 8 kart w obudowie serwera (łącznie 256 GB, ~838 TFLOPS sumarycznie). Zasilanie 16-pin przeniesione na tylny brzeg. PCIe Gen 5. Konwersja na aftermarket blower lub wariant AFOX Professional. Nie jest to standardowy produkt NVIDIA detaliczny.
Dwuslotowa konstrukcja wentylatora umożliwia gęstość serwera na poziomie 8 kart. ~838 TFLOPS FP32 łącznie z jednego węzła. Wylot z tyłu zapobiega kaskadowi termicznemu.
To samo metalowe silikon Blackwell co Fan Style 5090. Przepustowość 1 792 GB/s. Tensor Cores FP4. PCIe Gen 5. Inny chłodnica, ta sama moc obliczeniowa.
Detaliczny 5090 przebudowany na niestandardowej PCB z podwójnym wentylatorem. Przeróbka przemysłowa z 24-godzinnym testem obciążeniowym. Potwierdź pochodzenie i gwarancję u MillionMiner.
Żaden standardowy partner NVIDIA AIB nie produkuje chłodzonego powietrzem RTX 5090. AFOX RTX 5090 Professional jest jedyną półoficjalną wersją blower ($5 999 USD detal). Większość blowerów 5090 dostępnych na rynku to konwersje rynkowe: karty 5090 sprzedawane detalicznie, rozmontowane i przebudowane na niestandardowych dwuslotowych płytkach PCB typu blower.
Gęstość Multi-GPU. Standardowe otwarte RTX 5090 o szerokości od 2,5 do 3,5 slotu nie mieszczą się fizycznie więcej niż 2 w dowolnej obudowie, a kaskada termiczna między kartami sprawia, że nawet 2 są problematyczne. Dual-slotowy wentylator umożliwia umieszczenie od 4 do 8 kart w obudowie serwera dla racków do wnioskowania AI, farm wynajmu GPU oraz operacji kopania.
Do 8 w obudowie serwera z odpowiednią liczbą slotów PCIe, dostawą mocy i chłodzeniem zgodnie z dokumentacją Tom's Hardware. Osiem kart: 256 GB łącznej pamięci VRAM, około 838 TFLOPS FP32, pobór mocy GPU 4 600 W. Wymaga przemysłowej infrastruktury zasilania, wysokiej pojemności rozdzielnic zasilających i odpowiedniego przepływu powietrza w obudowie serwera.
Tak. Ta sama płytka GB202: 21 760 rdzeni CUDA, 680 rdzeni Tensor, 170 rdzeni RT, 32GB GDDR7 przy 1 792 GB/s, ~104,8 TFLOPS FP32, PCIe Gen 5. Wentylator wpływa tylko na projekt termiczny, nie na wydajność układu scalonego. Prędkości zegara zwiększone: 2 017 MHz bazowe, 2 407 MHz boost.
Nie zostało jeszcze oficjalnie opublikowane dla konwersji 5090 (nowsza od modułu 4090 48GB, który ma około 2% udokumentowanej awaryjności od GPU Lab). Proces naprawy przemysłowej w renomowanych chińskich warsztatach (CT itp.) wykorzystuje stacje do napraw BGA i profesjonalne protokoły testowe, ale ponowne lutowanie układów GPU zawsze wiąże się z ryzykiem w porównaniu z montażem fabrycznym. Rezerwuj budżet na potencjalne jednostki zastępcze w wdrożeniach wielogPU.
8x blower 5090: ~838 TFLOPS FP32, 256GB GDDR7 przy 1 792 GB/s na kartę, brak NVLink, PCIe Gen 5, sterowniki konsumenckie. 8x A100 80GB (HGX): 156 TFLOPS FP32, 640GB HBM2e przy 2 039 GB/s na kartę, NVLink przy 600 GB/s, 7 MIG na kartę, sterowniki przedsiębiorstwa. Węzeł 5090 zapewnia 5,4 razy więcej obliczeń FP32 przy o 60% mniejszej pamięci. Dla inferencji (obliczenia ograniczone): 5090 zdecydowanie wygrywa pod względem przepustowości na dolar. Dla treningu (pamięć i interkonekt ograniczający): A100 HGX wygrywa pod względem NVLink i pasma HBM.
Osiem kart o mocy 575W: pobór prądu GPU 4 600W. Całkowite węzeł z dwoma CPU, pamięcią, pamięcią masową i chłodzeniem: około 5 500W do 6 500W. Wymaga przemysłowego zasilania trójfazowego, wysokiej pojemności PDU i odpowiedniego doboru bezpiecznika obwodowego. Standardowa instalacja elektryczna w domu lub małym biurze nie jest w stanie obsłużyć tego obciążenia.
Tak samo jak Fan Style, ta sama zdolność wydobycia. Projekt wentylatora jest właściwie bardziej pożądany dla rigów do kopania, ponieważ gęstość wielu kart jest standardową konfiguracją rigów do kopania. Osiem kart kopiących niezależnie przy zysku dziennym wynoszącym 0,83 USD każda: około 6,64 USD na węzeł dziennie przy stawce 0,10 USD/kWh. Wynajem GPU może generować znacznie więcej.
RTX 5090 Blower: ~104,8 TFLOPS FP32, 32GB GDDR7, 575W, sterowniki konsumenckie, hardware aftermarket, do 8 sztuk na chassis. RTX PRO 6000 Max-Q: ~120 TFLOPS FP32, 96GB GDDR7 ECC, 300W, sterowniki profesjonalne, fabryczne NVIDIA, do 4 sztuk na stację roboczą. Na kartę: PRO 6000 Max-Q oferuje 3 razy więcej pamięci, niezawodność profesjonalną oraz certyfikację ISV przy niższym poborze mocy. Na nod: osiem blowerów RTX 5090 zapewnia większą łączną moc obliczeniową. Różne poziomy niezawodności dla różnych tolerancji ryzyka.
Równoczesne serwowanie inferencji: osiem niezależnych instancji modeli 13B do 25B obsługujących równoczesne żądania użytkowników. Generowanie partii osadzeń na dużych zbiorach dokumentów. Serwowanie wielu modeli (różne modele na różnych GPU). farmy renderujące. Wynajem GPU dla stron trzecich za pośrednictwem Clore.ai, Vast.ai lub podobnych platform.