אם בבעלותכם, בשכירות או בתכנון לרכוש GPUs מבוססי AI, Rubin חשוב לכם גם אם לעולם לא תיגעו באחד מהם, כי כל שיגור של NVIDIA משנה את המחיר של כל שכבת התשתית שמתחתיו. הסבר זה מכסה מה באמת Rubin, הפרטים הטכניים המאושרים לעומת ההצהרות השיווקיות, לוח הזמנים האמיתי למשלוח עד 2028, והשאלה שהכי מעניינת את הקונים: מה ההשפעה של ההשקה הזאת על מחירי ה-H100, H200, ו-B200אתה יכול למעשה לקבל.
התשובה הקצרה
- מה זה:רובין היא הפלטפורמה החדשה של NVIDIA לגרפיקה, המחליפה את Blackwell: גרפיקה עם 336 מיליארד טרנזיסטורים ב-TSMC 3nm עם זיכרון HBM4 בנפח 288 GB במהירות 22 TB/s, בשילוב עם מעבד ה-Vera החדש.
- הכותרת טוענת:5x inference ו-3.5x אימון לעומת Blackwell, ביצועי inference של 8x לוואט, ועלויות טוקן של כעשירית בערך בעומסי עבודה agentic ו-MoE. המספרים של NVIDIA, 아직 независимые.
- מתי:ייצור מלא כעת, זמינות שותפים וענן במחצית השנייה של 2026, ארון ההסקה להסקה של CPX בסוף 2026, Rubin Ultra ב-2027, Feynman ב-2028.
- לקונים:המבחין הראשון מיועד להיפרסקלרים. ההשפעה הפרקטית בשנת 2026 היא לחץ ירידת מחירים על Blackwell ו-Hopper, שהם המקום בו מתקיימות רוב ההחלטות הרכישה האמיתיות.
מהו NVIDIA Rubin?
ה-GPU הוא עיצוב דו-שברי, שני שבבים בגודל ריטקל על חבילה אחת, המיוצר בטכנולוגיית ה-3 ננומטר של TSMC ומכיל 336 מיליארד טרנזיסטורים, פי 1.6 מספירת של Blackwell. הוא מיועד למה שנקרא על ידי NVIDIA עידן האגנטי: עומסי עבודה שבהם ההסקה שולטת ומחיר לכל תו决定 אם המוצר מבוסס בינה מלאכותית הוא רווחי. ההקשר הזה חשוב, כי הרווחים הגדולים שמר Rubin מציין הם בדיוק בכלכלה של ההסקה, המספר שמחליט אם מוצר בינה מלאכותית מייצר רווח.
מה המהירות של Rubin? המפרטים לעומת Blackwell

הטענות שיש לזכור, עם התוויות שלהן:5x אינפרנס ו-3.5x אימון לעומת Blackwell; ביצועי אינפרנס ב-8x לוואט; עלויות טוקן انخفاض בערך לעשירית בעבודה של agentic ו-mixture-of-experts; אימון MoE עם רבע מ-GPU. טענות תקופת Blackwell של NVIDIA ב-"עד 30x" לימדו את התעשייה לחכות למספרים מהעולם האמיתי, אשר בדרך כלל נמוכים בהרבה מהמספר שיווקי השיא עדיין מכריעים מבחינה דורותית. התייחסו ל-Rubin באותו אופן. שים לב, שבינתיים, NVIDIA לא חשפה את צריכת האנרגיה של שבב זה, שהיא המספר שכל מתכנן מתקן מחכה לו.
מתי ארוזין בפועל את Rubin? הלוח זמנים

ואז הקצב ממשיך:Rubin Ultraברבעון השני של 2027, הארון Kyber NVL576 עם צריכה של עד 600 קילווואט, וה-פיינמןהארכיטקטורה ב-2028. שני דברים בולטים באותה רצף. ראשית, הקצב של 18 חודשים הופך עכשיו למדיניות, מה שאומר שכל מה שאתם קונים נמצא שני צעדים ממהדורת הדגל תוך שלוש שנים, והתמחור מתנהג בהתאם. שנית, עקומת ההספק ממשיכה לעלות: ערכות של 600 קילווואט מנפיקות את ה-120 עד ה-140 קילווואט של היוםעיצובי מרכזי נתונים בינה מלאכותיתהם נראים שמרנים, והם מחמשים את המגבלה האמיתית של התעשייהמאובטח חשמללתוך כל המשחק.
איך נראה מתקן קינון Rubin?

מוכן להתחיל את החקירה?
משלוח DDP חינם בכל העולם. אחסון מקצועי החל מ- $0.055/ק"ו.
מה עושה Rubin למחירי ה-GPU?

המשקל הנגדי הכנה:שרשרת זו היא תבנית, לא חוק. הביקוש ל-AI חורג שוב ושוב מההיצע, וכשהוא עושה זאת, מחירי הדורות הקודמים נמוכים יותר לאט ממה שה-roadmap מציע. עקבו אחר שיעורי השוק_actual ב-ההשקעות.כרטיסים שאפשר לקנות היום, השוו אותם להעבודה האמיתית שלכםותרו על מחזור החדשות וקבעו את העלות לכל עבודה שהושלמה.
האם עליכם להמתין לרובין או לרכוש עכשיו?
ולכל שאר האנשים, אותו הכלכלה כמו mindig חלה: ניצול מתמשך מועדף על פני שכירות, והבעלות מועדפת על פני כוח קירור מקצועי על פני ארון חם. זה הוּא ה־אירוח GPUהיגיון, הוא אינו משתנה על ידי רובין, ואם כבר, הנתיב של 600 קילוואט מחזק אותו. בעלי כרטיסים מדגם נוכחי יכולים גם לעקוף את מחזור הפחת הערך על ידי שמירת השימוש הגבוה, כולל הפניית קיבולת ריקה לרשתות חישוב DePINבין עבודות.
מה שאנחנו עדיין לא יודעים
הקו התחתון
שאלות נפוצות
רובין היא פלטפורמת ה-AI של מרכז הנתונים מהדור הבא של NVIDIA, היורשת את Blackwell, הנקראת על שם אסטרונומית ורה רובין. היא משלבת GPU חדש עם שני שבבים (336 מיליארד טרנזיסטורים ב-TSMC 3nm ו-288 GB זיכרון HBM4), יחד עם מעבד Vera מבוסס Arm וארבעת שבבי רשת תומכים. NVIDIA מייעדת אותה לעידן ה-AI הפעיל, שבו נפח הייחוס ועלות לכל תוקדן קובעים את הכדאיות המסחרית.
מתי יוצאת NVIDIA Rubin?
זה נמצא בייצור מלא כעת, הוכרז ב-CES 2026 ואושר מחדש ב-GTC Taipei ביוני. מערכות שותפים וזמינות בענן יגיעו במחצית השנייה של 2026 דרך הספקי ה-Hyperscalers המרכזיים וענני ה-GPU המיוחדים. ארגז ה-inference NVL144 CPX ילווה בסוף 2026, Rubin Ultra במחצית השנייה של 2027, וארכיטקטורת Feynman ב-2028. ההקצאות הראשונות מועברות ברובם להיפרסקלרים ולמעבדות AI שמול היקף.
כמה מהיר יותר רובין מבלאקואל?
על פי טענות NVIDIA: ביצועי חיזוי ב-5x, ביצועי אימון ב-3,5x, ביצועי חיזוי לוואט ב-8x, וכדור שליש מהעלות לכל טוקן בעומסי עבודה של agentic ו-mixture-of-experts, כאשר אימון MoE דורש רבע ממספר ה-GPU. אלה הם מספרי היצרן על העומסים שנבחרו, ולא מדדים עצמאיים; התוצאות בעולם האמיתי בדרך כלל נמוכות יותר מהתצוגות המתקדמות של השיווק, אך נשארות משמעותיות על פני דור.
מהו HBM4 ולמה זה חשוב?
HBM4 היא הדור הבא של זיכרון פס רחב גבוה, והיא השדרוג החשוב ביותר של Rubin. כל GPU מכיל 288 GB במהירות 22 TB/s, כמעט שלוש ממהירות ה-HBM3e של Blackwell, שהושגה על ידי הכפל של רוחב המערכת לכל חבילה. עומסי העבודה המודרניים של AI תלויים יותר ויותר בזיכרון, לכן אספקת הנתונים לגרעינים, ולא עיבוד גולמי, היא נקודת החוזק. HBM4 מאפשר ל-Rubin לספק מודלים גדולים יותר במהירות רבה יותר מ-GPU יחיד.
מה זה ה-Vera CPU?
ורה היא מעבד ה-Rechenzentrum החדש מבוסס Arm של NVIDIA, היורש של Grace, במהירות כפולה בערך, המחובר ל-Rubin GPUs באמצעות NVLink-C2C. צומת סטנדרטי משייך ורה עם שני Rubin GPUs. וורה משלים גם את סיפור המחשוב הסודי ברמת המדף של NVIDIA, ומאפשר מדף מוצפן כולו במקום רק GPU מוצפן.
מה זה ה-Vera Rubin NVL72?
Rack Rubin של NVIDIA: 72 GPU Rubin ו-36 CPU Vera מצטרפים באמצעות NVLink 6 למכונה אחת עם רוחב פס כולל של 260 טרה-ביט לשנייה. היא מלאה במיזוג נוזלים עם תיקים מודולריים ללא כבלים שמקצרים את זמן ההתקנה מכשעה לדקות. גרסה מיוחדת, NVL144 CPX, מוסיפה מעבדי CPX מבוססי GDDR7 להסקת הקשר של מיליון טוקנים, עם 100 טרה-בייט זיכרון מהיר לכל Rack.
מהו Rubin Ultra?
עדכון אמצע המחזור המתוכנן למחצית השנייה של 2027, המיושם כארגז Kyber NVL576, שמכיל 576 DIE של GPU ומושך עד 600 kW לכל ארגז. המספר הזה הוא הכותרת: הוא יותר מארבע פעמים הארגזים מקלאס GB200 של היום ומאשר כי חשמל וקירור המתקן, ולא אספקת השבבים, הופכים למגבלה המכריעה בפריסת בינה מלאכותית.
האם רובן יגרום לירידת מחירי H100 ו-B200?
הדפוס ההיסטורי אומר כן, בהדרגה. כל השקת NVIDIA דוחפת דורות קודמים למדרג המחירים הנמוך יותר: הפרימיום של B200 נדחס, H100 ו-H200 זוחלים לכיוון אזור הערך (מחירי הענן של H100 כבר היו במגמת ירידה ככל ש-NVIDIA B200 גדלו בהיצע), והריצפה של A100 מזדקנת. היזהרות הוגנות: כאשר הביקוש ל-AI חורג מההיצע, מחירי הדורות הקודמים יורדים באיטיות פחות מהמפה הדרך מציעה, אז נא לאמת את המחירים בשוק החי במקום להניח את ההנחות.
האם עלי לחכות לרובין או לרכוש כרטיס גרפי עכשיו?
אם אתם צריכים חישוב עכשיו, רכשו עכשיו: ההקצאה של Rubin ב-2026 הולכת להיפרסקיילרים, והמתנה לחומרה שלא ניתן להשיג יש לה עלות אמיתית בעבודה שנשלחה, בעוד שחברי כרטיסי הדור הנוכחי מוכחים והופכים לזולים יותר. אם אתם מתכננים קיבולת בהיקף צי לאחרים ל-2027 ומעבר, נסו את Rubin כאשר הגישה נפתחת ונתנו לספקים להוכיח את מכפלות המוצהרות על עומס העבודה שלכם לפני ההתחייבות. לכל שאר, העלות לכל עבודה שהושלמה בזמן השימוש בפועל נשארת המספר המכריע.
כמה עולה NVIDIA Rubin?
מפורסם באופן לא רשמי. כל מי שמביא מחירי ריבן בביטחון הוא מנחש. ציפיות סבירות מאחריות Blackwell: פרמיית השקה בשיא השוק, נמכרת בעיקר כמערכות מלאות וקיבולת ענן במקום כרטיסים בודדים, עם זמינות משמעותית מחוץ להיפרסקלרים רק עד 2027. לקבלת החלטות קנייה ב-2026, המספרים המעשיים הם מחירי היבול הנוכחי המתדרדרים, לא תווית המחיר העתידית של ריבן.
מה בא אחר רובן?
Rubin Ultra במחצית השנייה של 2027, ואז ארכיטקטורת Feynman ב-2028, בשילוב עם ה-Rosa CPU עד 2029 ומעבר. NVIDIA התיישבה על קצב ארכיטקטורה עיקרית של כ-18 חודשים, מה שאומר שכל כרטיס שאתם רוכשים עוקב באופן משמעותי אחרי הדגלית כשני צעדים בתוך כשלוש שנים, והמחירים של הרכישות החכמות מפחיתים את הפחת מהמיום הראשון.
מקורות והערות
המפרטים והלוח זמנים מד disclosures של NVIDIA ב-CES 2026, GTC 2026, ו-Computex 2026, כפי שהדווחו על ידי עיתונות מרכזי הנתונים ותחום המוליכים למחצה. מכפילי ביצועים הם טענות של NVIDIA על עומס עבודה נבחר, אינם מדדי ביצוע עצמאים, ומסומנים כטענות לאורך כל הטקסט. צריכת החשמל והמחיר לא נחשפו בעת הפרסום. ניתוח ה-price-cascade הוא תחזית מבוססת תבניות, ואינו ערובה; חשוב לאמת שערי שוק חיים לפני הרכישה. תמונת גיבור: DrHughManning, CC BY-SA 4.0; תמונת גוף: Windell Oskay, CC BY 2.0, שניים דרך Wikimedia Commons.תרשימים: גרפיקה מקורית של MillionMiner. תוכן אינפורמטיבי, לא ייעוץ כלכלי.

