Dacă dețineți, închiriați sau plănuiți să achiziționați GPU-uri AI, Rubin contează pentru dumneavoastră chiar dacă nu le atingeți niciodată, deoarece fiecare lansare NVIDIA revalorizează întregul nivel de tehnologie de dedesubt. Acest explicator acoperă ce reprezintă de fapt Rubin, specificațiile confirmate comparativ cu afirmațiile de marketing, calendarul real de livrare până în 2028 și întrebarea care contează cel mai mult pentru cumpărători: ce impact are această lansare asupra prețului Minerului.H100, H200 și B200puteți obține de fapt.
Răspunsul scurt
- Ce este:Rubin este următoarea platformă GPU a NVIDIA, succesoarea Blackwell: un GPU cu 336 miliarde de tranzistori pe TSMC 3nm, cu 288 GB de memorie HBM4 la 22 TB/s, asociat cu noul CPU Vera.
- Titlul afirmă:5x inferență și 3,5x antrenament comparativ cu Blackwell, performanță de inferență de 8x pe watt, iar costurile pe token sunt de aproximativ unu-zecelea pentru încărcările de lucru agentice și MoE. Numerele NVIDIA, încă nu independente.
- Când:producție completă acum, disponibilitate partener și cloud în H2 2026, rackul de inferență CPX până la sfârșitul lui 2026, Rubin Ultra în 2027, Feynman în 2028.
- Pentru cumpărători:Alocarea inițială merge către hyperscalers. Efectul practic în 2026 este presiune descendentă asupra prețurilor pentru Blackwell și Hopper, care sunt locurile unde se iau cele mai importante decizii de achiziție.
Ce este NVIDIA Rubin?
GPU-ul este un design cu dublu cip, două cipuri de dimensiune reticul pe un singur pachet, fabricat pe procesul de 3nm de la TSMC și conținând 336 miliarde de tranzistori, de 1,6 ori mai mult decât numărul Blackwell. Se vizează ceea ce NVIDIA numește era agentică: sarcini de lucru în care inferența domină și costul per token decide dacă un produs AI este viabil din punct de vedere comercial. Această încadratura contează, deoarece cele mai mari câștiguri pe care Rubin susține că le obține sunt exact în economia inferenței, cifra care decide dacă un produs AI generează profit.
Cât de rapid este Rubin? Specificațiile față de Blackwell

Afirmările Demne de Reținut, cu etichetele lor:5x inferență și 3,5x antrenament comparativ cu Blackwell; performanță de inferență de 8x pe watt; costurile pe token reduse la aproximativ unzecime pentru lucrul cu agentic și amestec de experți; antrenamentul MoE cu un sfert din GPU-uri. Afirmațiile NVIDIA despre era Blackwell privind „până la 30x” au învățat industriei să aștepte cifre din lumea reală, care de obicei sunt mult sub cifra maximă de marketing, fiind totuși decisive din punct de vedere generațional. Tratați Rubin în același mod. Notabil, NVIDIA nu a dezvăluit încă consumul de energie al cipului, ceea ce reprezintă numărul pe care orice planificator de facilități îl așteaptă.
Când va fi expediat de fapt Rubin? Cronologia

Atunci continuă și ritmul:Rubin Ultraîn H2 2027, pe măsura Kyber NVL576, care consumă până la 600 kW, și celălaltFeynmanarhitectură în 2028. Două aspecte ies în evidență în această secvență. În primul rând, ritmul de 18 luni este acum politică, ceea ce înseamnă că orice cumpărați este la două etape distanță de modelul de top în trei ani, iar prețurile se ajustează în consecință. În al doilea rând, curva de putere continuă să urce: rack-urile de 600 kW depășesc cele actuale de 120 până la 140 kWProiecte de centre de date AIarată conservator și intensează constrângerea reală a industriei,alimentare securizată, în întregul joc.
Ce aspect are un rack Rubin?

Gata să începi să minezi?
Livrare DDP gratuită în întreaga lume. Hosting profesional de la $0.055/kWh.
Ce face Rubin cu prețurile GPU-urilor?

Contraeșecul sincer:acest lanț de cazuri este un model, nu o lege. Cererea de AI a depășit în mod repetat oferta, iar atunci când se întâmplă acest lucru, prețurile de generație anterioară scad mai încet decât sugerează foaia de parcurs. Urmăriți ratele de piață actuale pe rețea.carduri pe care le puteți cumpăra astăzi, comparați-le cuvolumul real de lucru al dumneavoastră, și lăsați costul pe muncă finalizată, nu ciclul de știri, să decidă.
Trebuie să așteptați pentru Rubin sau să cumpărați acum?
Și pentru toți cei din urmă, aceleași aspecte economice ca întotdeauna se aplică: utilizarea sustenabilă favorizează deținerea față de închiriere, iar deținerea favorizează puterea profesională și răcirea peste un dulap încălzit. Acesta este cel mai bun avantaj.găzduire GPUlogica, nu suferă schimbări din partea lui Rubin, iar dacă ar fi să fie, traiectoria de 600 kW o întărește. Deținătorii de plăci din generația actuală pot compensa ciclul de amortizare menținând o rată de utilizare ridicată, inclusiv direcționând capacitatea inactivă spreRețele de calcul DePINîntre locuri de muncă
Ceea ce încă nu știm
Rezumatul rezultatului final
Întrebări frecvente
Rubin este platforma de AI pentru centre de date de generație următoare a NVIDIA, succesorul Blackwell, denumită după astronomerul Vera Rubin. Aceasta combină un GPU dual-die nou (336 miliarde de tranzistori pe TSMC 3nm, cu 288 GB de memorie HBM4) cu CPU-ul Vera bazat pe Arm și patru cipuri de rețea suport. NVIDIA o poziționează pentru era AI agentic, unde volumul inferenței și costul pe token decid viabilitatea comercială.
Când va fi lansat NVIDIA Rubin?
Acum este în producție completă, anunțat la CES 2026 și reconfirmat la GTC Taipei în iunie. Sistemele partenere și disponibilitatea în cloud vor fi disponibile în a doua jumătate a anului 2026 prin intermediul marilor hyperscalers și cloud-urilor specializate GPU. Rack-ul de inferență NVL144 CPX urmează până la sfârșitul anului 2026, Rubin Ultra în a doua jumătate a anului 2027 și arhitectura Feynman în 2028. Alocările inițiale merg în mod covârșitor către hyperscalers și laboratoare AI de frontieră.
Cu cât este Rubin mai rapid decât Blackwell?
Potrivit afirmațiilor NVIDIA: de 5 ori performanță de inferență, de 3,5 ori performanță de antrenament, de 8 ori performanță de inferență per watt și aproximativ o zecime din costul pe token pentru sarcinile agentice și mixture-of-experts, cu antrenamentul MoE necesitând un sfert din GPU-uri. Acestea sunt cifrele producătorului pentru sarcinile alese, nu benchmark-uri independente; rezultatele din lumea reală sunt istoric mai mici decât valorile maxime de marketing, păstrând în același timp o importanță generatională.
Ce este HBM4 și de ce contează?
HBM4 este următoarea generație de memorie cu lățime de bandă mare și reprezintă cea mai importantă actualizare a Rubin. Fiecare GPU are 288 GB la 22 TB/s, aproape de trei ori capacitatea de bandă a HBM3e de la Blackwell, obținută prin dublarea lățimii de bandă pe stivă. Saregresorii AI moderni sunt din ce în ce mai limitați de memorie, astfel încât alimentarea nucleelor, nu doar calculul brut, reprezintă bottleneck-ul. HBM4 este ceea ce îi permite Rubin să servească modele mai mari mai rapid, folosind un singur GPU.
Ce este procesorul Vera?
Vera este noul CPU pentru centre de date bazat pe Arm de la NVIDIA, succesorul lui Grace, de aproximativ două ori mai rapid și conectat la GPU-urile Rubin prin NVLink-C2C. Un nod standard combină un Vera cu două GPU-uri Rubin. Vera completează de asemenea povestea NVIDIA despre calculul confidențial la scară rack, permițând un întreg Rack criptat în loc de doar un GPU criptat.
Ce este Vera Rubin NVL72?
Rack-ul de vârf Rubin al NVIDIA: 72 GPU Rubin și 36 CPU Vera unite prin NVLink 6 într-o singură mașină cu o lățime de bandă agregată de 260 TB/s. Este complet răcit prin lichid cu tăvi modulare fără cabluri, care reduc timpul de instalare de aproximativ două ore la câteva minute. O variantă specializată, NVL144 CPX, adaugă procesoare CPX bazate pe GDDR7 pentru inferența contextului cu milioane de token-uri, cu 100 TB de memorie rapidă per rack.
Ce este Rubin Ultra?
Reîmprospătarea de la mijlocul ciclului, programată pentru a doua jumătate a anului 2027, implementată sub forma rack-ului Kyber NVL576, care conține 576 cipuri GPU și consume până la 600 kW pe rack. Această cifră de consum este titlul: depășește de peste patru ori rack-urile din clasa GB200 de astăzi și confirmă faptul că puterea și răcirea facilității, nu aprovizionarea cu cipuri, devin constrângerea principală în implementarea AI.
Will Rubin va determina scăderea prețurilor pentru H100 și B200?
Modelul istoric indică da, treptat. Fiecare lansare NVIDIA împinge generațiile anterioare într-un nivel de preț inferior: premiumul de vârf al B200 se comprimă, H100 și H200 se deplasează spre zona valorii (tarifele cloud ale H100 deja scădeau pe măsură ce oferta B200 creștea), iar plafonul A100 se mută mai jos. Precizarea sinceră: atunci când cererea de AI depășește oferta, prețurile generației anterioare scad mai lent decât sugerează foaia de parcurs, așadar verificați ratele actuale ale pieței în timp real, nu presupuneți reducerea.
Ar trebui să așteptați pentru Rubin sau să cumpărați un GPU acum?
Dacă aveți nevoie de capacitate de calcul acum, cumpărați acum: alocarea Rubin din 2026 merge către hyperscaleri, iar așteptarea hardware-ului pe care nu îl puteți obține are un cost real în lucru livrat, în timp ce plăcile de generație actuală sunt dovedite și devin mai ieftine. Dacă planificați o flotă de capacitate pentru 2027 și mai departe, testați Rubin atunci când accesul se deschide și faceți ca furnizorii să demonstreze multiplicatorii revendicați pe propria sarcină de lucru înainte de a vă angaja. Pentru toți ceilalți, costul pe job finalizat la utilizarea dvs. reală rămâne numărul hotărâtor.
Cât vor costa NVIDIA Rubin?
Neanunțat oficial. Oricine citează o listă de prețuri Rubin cu încredere este doar o estimare. Așteptări rezonabile în urma precedentului Blackwell: un premium de lansare la vârful pieței, vândut în principal ca rafturi complete și capacitate cloud mai degrabă decât ca plăci individuale, cu disponibilitate semnificativă în afara hyperscalers abia în 2027. Pentru deciziile de cumpărare din 2026, cifrele practice sunt prețurile înscăzătoare ale gamei actuale, nu viitorul sticker Rubin.
După Rubin vine Sapphire.
Rubin Ultra în a doua jumătate a anului 2027, apoi arhitectura Feynman în 2028, combinată cu procesorul Rosa până în 2029 și dincolo de această perioadă. NVIDIA s-a stabilizat într-un ritm de aproximativ 18 luni pentru arhitecturile principale, ceea ce înseamnă că orice placă pe care o achiziționați se află la două etape în urmă față de flagship în aproximativ trei ani, iar prețurile de achiziție inteligente depășesc această depreciere încă de la prima zi.
Surse și note
Specificații și calendar din informațiile dezvăluite de NVIDIA la CES 2026, GTC 2026 și Computex 2026, după cum au raportat presa specializată în centre de date și semiconductori. Multiplicatorii de performanță sunt afirmațiile NVIDIA pe anumite sarcini, nu teste independente, și sunt etichetate ca afirmații pe tot parcursul textului. Consumul de energie și prețurile nu au fost dezvăluite la momentul publicării. Analiza de cascade a prețurilor este o perspectivă bazată pe modele, nu o garanție; verificați cursul live al pieței înainte de achiziție. Imagine principală: DrHughManning, CC BY-SA 4.0; fotografie corp: Windell Oskay, CC BY 2.0, ambele via Wikimedia Commons. Diagrame: grafice originale MillionMiner. Conținut informativ, nu sfaturi financiare.