Million Miner Logo
Industry News · 18 קריאה מינימלית · Jul 28, 2026

NVIDIA Rubin הסבר: מפרטים, תהליך הזמן, ומה שזה עושה למחירי ה-GPU

Sara Chen

Bitcoin & Altcoin Analyst

NVIDIA Rubin הסבר: מפרטים, תהליך הזמן, ומה שזה עושה למחירי ה-GPU
ג'נסן הוואנג עלה לבמה ב-CES בינואר 2026 ואמר את הדברים שהתכננו האנליסטים ל-2027: רובין בהפקה מלאה.לא מדגם, לא סינון, ייצור מלא, עם משלוחי נפח שנוחתים בחלק השני של 2026. זהו זמן תגובה של 18 חודשים מאז השקת Blackwell בתעשייה בה ארכיטקטורה חדשה בדרך כלל אורך מ-24 עד 30 חודשים, וזה אומר שהיורש של הצ'יפים היקרים ביותר על כדור הארץ החל להגיע עכשיו.

אם בבעלותכם, בשכירות או בתכנון לרכוש GPUs מבוססי AI, Rubin חשוב לכם גם אם לעולם לא תיגעו באחד מהם, כי כל שיגור של NVIDIA משנה את המחיר של כל שכבת התשתית שמתחתיו. הסבר זה מכסה מה באמת Rubin, הפרטים הטכניים המאושרים לעומת ההצהרות השיווקיות, לוח הזמנים האמיתי למשלוח עד 2028, והשאלה שהכי מעניינת את הקונים: מה ההשפעה של ההשקה הזאת על מחירי ה-H100, H200, ו-B200אתה יכול למעשה לקבל.

התשובה הקצרה

  • מה זה:רובין היא הפלטפורמה החדשה של NVIDIA לגרפיקה, המחליפה את Blackwell: גרפיקה עם 336 מיליארד טרנזיסטורים ב-TSMC 3nm עם זיכרון HBM4 בנפח 288 GB במהירות 22 TB/s, בשילוב עם מעבד ה-Vera החדש.
  • הכותרת טוענת:5x inference ו-3.5x אימון לעומת Blackwell, ביצועי inference של 8x לוואט, ועלויות טוקן של כעשירית בערך בעומסי עבודה agentic ו-MoE. המספרים של NVIDIA, 아직 независимые.
  • מתי:ייצור מלא כעת, זמינות שותפים וענן במחצית השנייה של 2026, ארון ההסקה להסקה של CPX בסוף 2026, Rubin Ultra ב-2027, Feynman ב-2028.
  • לקונים:המבחין הראשון מיועד להיפרסקלרים. ההשפעה הפרקטית בשנת 2026 היא לחץ ירידת מחירים על Blackwell ו-Hopper, שהם המקום בו מתקיימות רוב ההחלטות הרכישה האמיתיות.


מהו NVIDIA Rubin?

רובין, שנקרא על שם האסטרונומית ורה רובין, הוא הפלטפורמת AI של מרכז הנתונים הבאה של NVIDIA והיורש הישיר של Blackwell. לקרוא לה GPU זה מפחית מערכה: הפלטפורמה היא שישה שבבים המעוצבים כמערכת אחת. ה-Rubin GPU עצמו, ה-Arm-based Vera CPU החדש שמחליף את Grace, מתג NVLink 6, ה-ConnectX-9 SuperNIC, ה-BlueField-4 DPU, ומתג ה-Ethernet Spectrum-6. NVIDIA הפסיקו לשלח שבבים והחלו לשלח ארכיטקטורות, ו-Rubin היא הגרסה הברורה ביותר לכך עד כה.

ה-GPU הוא עיצוב דו-שברי, שני שבבים בגודל ריטקל על חבילה אחת, המיוצר בטכנולוגיית ה-3 ננומטר של TSMC ומכיל 336 מיליארד טרנזיסטורים, פי 1.6 מספירת של Blackwell. הוא מיועד למה שנקרא על ידי NVIDIA עידן האגנטי: עומסי עבודה שבהם ההסקה שולטת ומחיר לכל תו决定 אם המוצר מבוסס בינה מלאכותית הוא רווחי. ההקשר הזה חשוב, כי הרווחים הגדולים שמר Rubin מציין הם בדיוק בכלכלה של ההסקה, המספר שמחליט אם מוצר בינה מלאכותית מייצר רווח.

מה המהירות של Rubin? המפרטים לעומת Blackwell

זו התמונה המאושרת, עם טענות הביצועים של NVIDIA מסומנות כמה שהן: טענות, מחברת המוכרת את ה-Chip, ולא מבחנים עצמאיים.
A spec table comparing Rubin to Blackwell: 336 vs 208 billion transistors, TSMC 3nm, 288 GB HBM4 at 22 TB/s versus HBM3e at 8 TB/s, claimed 5x inference and 3.5x training, and NVLink 6 at 3.6 TB/s per GPU.
הסיפור האמיתי הוא זיכרון.רובין נושא 288 GB של HBM4 עם רוחב פס של 22 TB/ש', כמעט triple של HBM3e של Blackwell. עומסי העבודה המודרניים של AI הם יותר תלויים בזיכרון מאשר בתחשב, ולכן ה־H200 נמכר יותר מהיתרון החישובי שלוהזנת הליבות היא צוואר הבקבוק. HBM4 מכפילה את רוחב הערוץ בכל ערימה, ובגודל מערך זה מצטבר ל-1.6 פטהבייט לשנייה של רוחב פס מצטבר. אם רובין תעמוד באחד מהבטחותיה, זו תהיה החלק שמשנה את היכולת של GPU בודד לשרת.

הטענות שיש לזכור, עם התוויות שלהן:5x אינפרנס ו-3.5x אימון לעומת Blackwell; ביצועי אינפרנס ב-8x לוואט; עלויות טוקן انخفاض בערך לעשירית בעבודה של agentic ו-mixture-of-experts; אימון MoE עם רבע מ-GPU. טענות תקופת Blackwell של NVIDIA ב-"עד 30x" לימדו את התעשייה לחכות למספרים מהעולם האמיתי, אשר בדרך כלל נמוכים בהרבה מהמספר שיווקי השיא עדיין מכריעים מבחינה דורותית. התייחסו ל-Rubin באותו אופן. שים לב, שבינתיים, NVIDIA לא חשפה את צריכת האנרגיה של שבב זה, שהיא המספר שכל מתכנן מתקן מחכה לו.

מתי ארוזין בפועל את Rubin? הלוח זמנים

NVIDIA's GPU roadmap: Hopper 2022, Blackwell 2024, Blackwell Ultra mid-2026, Rubin in H2 2026, Rubin CPX end of 2026, Rubin Ultra in H2 2027 at up to 600 kW per rack, and Feynman in 2028.
התפוקה המלאה אושרה ב-CES בינואר ושוב ב-GTC טייפיי ביוני. מערכות שותפים וזמינות בענן, באמצעות ההיפרסקלרים ומקלאודים כמו CoreWeave ו-Lambda, יגיעו במחצית השנייה של 2026, כלומר: במחצית זו. הNVL144 CPXרַק, תצורה מיוחדת שמשלבת את Rubin עם מעבדי CPX מצוידים ב-GDDR7 לביצוע היסק בהקשר של מיליון תו, תושלם עד לסוף 2026 עם 100 TB של זיכרון מהיר ו-8 אקספלופילים לכל ריק.

ואז הקצב ממשיך:Rubin Ultraברבעון השני של 2027, הארון Kyber NVL576 עם צריכה של עד 600 קילווואט, וה-פיינמןהארכיטקטורה ב-2028. שני דברים בולטים באותה רצף. ראשית, הקצב של 18 חודשים הופך עכשיו למדיניות, מה שאומר שכל מה שאתם קונים נמצא שני צעדים ממהדורת הדגל תוך שלוש שנים, והתמחור מתנהג בהתאם. שנית, עקומת ההספק ממשיכה לעלות: ערכות של 600 קילווואט מנפיקות את ה-120 עד ה-140 קילווואט של היוםעיצובי מרכזי נתונים בינה מלאכותיתהם נראים שמרנים, והם מחמשים את המגבלה האמיתית של התעשייהמאובטח חשמללתוך כל המשחק.

איך נראה מתקן קינון Rubin?

פריסת הדגל היא Vera Rubin NVL72: 72 GPUs Rubin ו-36 CPUs Vera בארון אחסון אחד, מחוברים באמצעות NVLink 6 ליצירת מכונה אחת אחידה עם רוחב פס מצטבר של 260 טראביט לשנייה, מספר שנכון ל-NVIDIA מעלות עליונה על תנועת הנתונים של כל האינטרנט. הארון כולו מקורר בנוזלים, והעדיפות ההנדסית היא מובהקת: מנות מודולוריות ללא כבלים וללא צינורות שמקצרות את זמן ההתקנה מכשעה שעוסקים בהשערות של שעתיים דקות. NVIDIA אופטימיזציה למהירות שבה מתקנים יכולים לספוג את הדברים האלה, כי קיבולת המרכזית, לא אספקת השבבים, הופכת לגורם המגביל.
A close view of a silicon wafer, the starting point for GPU dies like the two reticle-sized 3nm dies inside each NVIDIA Rubin package.
לכל מי שמתחת להייפרסקל, המדף חשוב כסימן ולא כרכישה. כל מה לגביו, קירור נוזלי חובה, צפיפות קיצונית, חשמל כנתון התורה, מאשר את הכיוון שנדון בו ב-עוגן מיכון נתונים בינה מלאכותיתעצם החישוב הופך להיות יותר ויותר לגישה פשוטה, והבנייה, הקירור, ומגהוואט מתחת לכךזה החלק הקשה. זה השכבה שבה מפעילים עם כוח מאובטח, כולל חברות כרייה רבות, ממשיכים לגלות את עצמם מחזיקים בנכס הנדיר.

מוכן להתחיל את החקירה?

משלוח DDP חינם בכל העולם. אחסון מקצועי החל מ- $0.055/ק"ו.

מה עושה Rubin למחירי ה-GPU?

המחיר העצמי של Rubin אינו מוכר מראש, ובשנת 2026 כמעט אף אחד מחוץ להיפרסקלרים ומעבדות הפרונטיר לא יקבל הקצאה בכל מקרה. ההשקה עדיין משמעותית לכל קונה, בגלל ההשפעה שהיא יש לה על הדורות שמתחתיה. הדפוס חזר על עצמו בכל השקת NVIDIA, וכבר נראה: תעריפי הענן של H100 ירדו בזמן שההיצע של B200 גדל, ויכולת ה-H200 משכירה בזול מספיק כדי לתחרות את H100 במחיר-ביצועים לעבודה עם זיכרון.
The price cascade from the Rubin launch: hyperscalers take first allocation, the B200's premium compresses, the H100 and H200 drop toward value territory, and the A100 floor moves lower.
המשיכו הלאה.Blackwellמאבד את המוטו המוביל שלו ומתהפך לדרגת ההכשרה המרכזית.Hopperמבצעת עוד צעד כלפי מטה: ה-H100 שהעלה יותר מ-30,000 דולר וה-H200 שמעליו משייטים לעבר הקטע הערך שבו תופסת היום ה-A100, וקרקע ה-A100 עצמה יורדת עוד יותר, וממשיכה את המסלול שלה כמיטה הזולה ביותר ב-80 GB בקרב כרטיסי AI, ההשוואה שפורסת ב־A100 לעומת H100עבור הקונים, המסקנה כמעט משעממת בעקביותה: הכסף החכם לרוב קונה דור אחד אחורה בכותרת, בדיוק כשהדגל החדש נוחת וצד המוכר מתמוטט.

המשקל הנגדי הכנה:שרשרת זו היא תבנית, לא חוק. הביקוש ל-AI חורג שוב ושוב מההיצע, וכשהוא עושה זאת, מחירי הדורות הקודמים נמוכים יותר לאט ממה שה-roadmap מציע. עקבו אחר שיעורי השוק_actual ב-ההשקעות.כרטיסים שאפשר לקנות היום, השוו אותם להעבודה האמיתית שלכםותרו על מחזור החדשות וקבעו את העלות לכל עבודה שהושלמה.

האם עליכם להמתין לרובין או לרכוש עכשיו?

השאלה שכל השקת חדשה מעלה, והתשובה מחולקת בדיוק לפי זהותכם. אם אתם זקוקים למחשב כעת, רכשו עכשיו: המתנה לפטיש שלא יוקצה לכם עד 2027 עולה באמת בעבודה שנשלחת, ו הרשימת ההרכבים הזמינה כרגעמוכח, תומך ונהיה זול יותר. הבחירה הנכונה בכלל תלויה בעומס העבודה שלכם, שנדון ב-כיצד לבחור כרטיס גרפי עבור בינה מלאכותיתוה-דירוגי אימוןאם אתם מתכננים קיבולת בהיקף גדול לשנת 2027 ואחריה, Rubin שייך בתוכנית: פיילוט כאשר הגישה נפתחת, מדדו את עלות הטוקן וזמן ההכשרה על המודלים שלכם, ותהיו דורשים מהספקים להוכיח את המוליכים על עומס העבודה שלכם לפני התחייבות לציוד.

ולכל שאר האנשים, אותו הכלכלה כמו mindig חלה: ניצול מתמשך מועדף על פני שכירות, והבעלות מועדפת על פני כוח קירור מקצועי על פני ארון חם. זה הוּא ה־אירוח GPUהיגיון, הוא אינו משתנה על ידי רובין, ואם כבר, הנתיב של 600 קילוואט מחזק אותו. בעלי כרטיסים מדגם נוכחי יכולים גם לעקוף את מחזור הפחת הערך על ידי שמירת השימוש הגבוה, כולל הפניית קיבולת ריקה לרשתות חישוב DePINבין עבודות.

מה שאנחנו עדיין לא יודעים

ארבעה פערים, פשוט ומפורש. צריכת החשמל לכל GPU не נחשפת, והיא ההחלטה שמכתיבה את עלות הפריסה. המחירים אינם מתפרסמים, גם עבור השבבים וגם עבור הרפדים. מכפלות הביצועים הן של NVIDIA עצמו, ומודדות את העבודה המוטלת של NVIDIA; בדיקות עצמאיות יראו תוצאות נמוכות יותר, כמו תמיד, ואנחנו לא נדע עד שהשבבים האמיתיים יגיעו ללקוחות האמיתיים. והלוח זמנים, למרות שהוכח בשני אירועים נפרדים, הוא יעד בשוק שבו היעדים משתנים. כל דבר שתקראו שמצהיר שאלו ארבעת העובדות קבעות, כולל רשימות המחירים של Rubin בביטחון, הוא הערכה. דף זה יתעדכן ככל שיגיעו המספרים האמיתיים.

הקו התחתון

רובין מציאותי, בפעולה, ומגיע על קצב שהוגדר כבלתי זהיר לפני חמש שנים. הסיליקון המאושר שלו, 336 מיליארד טרנזיסטורים ומערכת זיכרון HBM4 עם כמעט שלוש פעמים רוחב הפס של Blackwell, מכוונים לדבר שמכריע כיום את כלכלת הבינה המלאכותית: עלות השירות של אסימוני גישה. עבור המעט מארגונים שיפעלו אותו ב-2026, זו היא שינוי פלטפורמה אמיתי. עבור כולם האחרים, המשמעות המידית פשוטה ויעילה יותר: גל נוסף של לחץ כלפי מטה עלכרטיסי GPU שניתן למעשה לקנותעוד אישור לכך שהחשמל והמתקנים הם השכבה החסרה, וסיבה נוספת לכך שהתנועה המשולבת, של רכישת חומרה מוכחת בצעדים מאחור מהכותרות והפעלתה במאמץ, ממשיכה לנצח. הדגל משנה כל 18 חודשים. המתמטיקה שמתחתיה לא משתנה.

שאלות נפוצות

מהו NVIDIA Rubin?
רובין היא פלטפורמת ה-AI של מרכז הנתונים מהדור הבא של NVIDIA, היורשת את Blackwell, הנקראת על שם אסטרונומית ורה רובין. היא משלבת GPU חדש עם שני שבבים (336 מיליארד טרנזיסטורים ב-TSMC 3nm ו-288 GB זיכרון HBM4), יחד עם מעבד Vera מבוסס Arm וארבעת שבבי רשת תומכים. NVIDIA מייעדת אותה לעידן ה-AI הפעיל, שבו נפח הייחוס ועלות לכל תוקדן קובעים את הכדאיות המסחרית.

מתי יוצאת NVIDIA Rubin?
זה נמצא בייצור מלא כעת, הוכרז ב-CES 2026 ואושר מחדש ב-GTC Taipei ביוני. מערכות שותפים וזמינות בענן יגיעו במחצית השנייה של 2026 דרך הספקי ה-Hyperscalers המרכזיים וענני ה-GPU המיוחדים. ארגז ה-inference NVL144 CPX ילווה בסוף 2026, Rubin Ultra במחצית השנייה של 2027, וארכיטקטורת Feynman ב-2028. ההקצאות הראשונות מועברות ברובם להיפרסקלרים ולמעבדות AI שמול היקף.

כמה מהיר יותר רובין מבלאקואל?
על פי טענות NVIDIA: ביצועי חיזוי ב-5x, ביצועי אימון ב-3,5x, ביצועי חיזוי לוואט ב-8x, וכדור שליש מהעלות לכל טוקן בעומסי עבודה של agentic ו-mixture-of-experts, כאשר אימון MoE דורש רבע ממספר ה-GPU. אלה הם מספרי היצרן על העומסים שנבחרו, ולא מדדים עצמאיים; התוצאות בעולם האמיתי בדרך כלל נמוכות יותר מהתצוגות המתקדמות של השיווק, אך נשארות משמעותיות על פני דור.

מהו HBM4 ולמה זה חשוב?
HBM4 היא הדור הבא של זיכרון פס רחב גבוה, והיא השדרוג החשוב ביותר של Rubin. כל GPU מכיל 288 GB במהירות 22 TB/s, כמעט שלוש ממהירות ה-HBM3e של Blackwell, שהושגה על ידי הכפל של רוחב המערכת לכל חבילה. עומסי העבודה המודרניים של AI תלויים יותר ויותר בזיכרון, לכן אספקת הנתונים לגרעינים, ולא עיבוד גולמי, היא נקודת החוזק. HBM4 מאפשר ל-Rubin לספק מודלים גדולים יותר במהירות רבה יותר מ-GPU יחיד.

מה זה ה-Vera CPU?
ורה היא מעבד ה-Rechenzentrum החדש מבוסס Arm של NVIDIA, היורש של Grace, במהירות כפולה בערך, המחובר ל-Rubin GPUs באמצעות NVLink-C2C. צומת סטנדרטי משייך ורה עם שני Rubin GPUs. וורה משלים גם את סיפור המחשוב הסודי ברמת המדף של NVIDIA, ומאפשר מדף מוצפן כולו במקום רק GPU מוצפן.

מה זה ה-Vera Rubin NVL72?
Rack Rubin של NVIDIA: 72 GPU Rubin ו-36 CPU Vera מצטרפים באמצעות NVLink 6 למכונה אחת עם רוחב פס כולל של 260 טרה-ביט לשנייה. היא מלאה במיזוג נוזלים עם תיקים מודולריים ללא כבלים שמקצרים את זמן ההתקנה מכשעה לדקות. גרסה מיוחדת, NVL144 CPX, מוסיפה מעבדי CPX מבוססי GDDR7 להסקת הקשר של מיליון טוקנים, עם 100 טרה-בייט זיכרון מהיר לכל Rack.

מהו Rubin Ultra?
עדכון אמצע המחזור המתוכנן למחצית השנייה של 2027, המיושם כארגז Kyber NVL576, שמכיל 576 DIE של GPU ומושך עד 600 kW לכל ארגז. המספר הזה הוא הכותרת: הוא יותר מארבע פעמים הארגזים מקלאס GB200 של היום ומאשר כי חשמל וקירור המתקן, ולא אספקת השבבים, הופכים למגבלה המכריעה בפריסת בינה מלאכותית.

האם רובן יגרום לירידת מחירי H100 ו-B200?
הדפוס ההיסטורי אומר כן, בהדרגה. כל השקת NVIDIA דוחפת דורות קודמים למדרג המחירים הנמוך יותר: הפרימיום של B200 נדחס, H100 ו-H200 זוחלים לכיוון אזור הערך (מחירי הענן של H100 כבר היו במגמת ירידה ככל ש-NVIDIA B200 גדלו בהיצע), והריצפה של A100 מזדקנת. היזהרות הוגנות: כאשר הביקוש ל-AI חורג מההיצע, מחירי הדורות הקודמים יורדים באיטיות פחות מהמפה הדרך מציעה, אז נא לאמת את המחירים בשוק החי במקום להניח את ההנחות.

האם עלי לחכות לרובין או לרכוש כרטיס גרפי עכשיו?
אם אתם צריכים חישוב עכשיו, רכשו עכשיו: ההקצאה של Rubin ב-2026 הולכת להיפרסקיילרים, והמתנה לחומרה שלא ניתן להשיג יש לה עלות אמיתית בעבודה שנשלחה, בעוד שחברי כרטיסי הדור הנוכחי מוכחים והופכים לזולים יותר. אם אתם מתכננים קיבולת בהיקף צי לאחרים ל-2027 ומעבר, נסו את Rubin כאשר הגישה נפתחת ונתנו לספקים להוכיח את מכפלות המוצהרות על עומס העבודה שלכם לפני ההתחייבות. לכל שאר, העלות לכל עבודה שהושלמה בזמן השימוש בפועל נשארת המספר המכריע.

כמה עולה NVIDIA Rubin?
מפורסם באופן לא רשמי. כל מי שמביא מחירי ריבן בביטחון הוא מנחש. ציפיות סבירות מאחריות Blackwell: פרמיית השקה בשיא השוק, נמכרת בעיקר כמערכות מלאות וקיבולת ענן במקום כרטיסים בודדים, עם זמינות משמעותית מחוץ להיפרסקלרים רק עד 2027. לקבלת החלטות קנייה ב-2026, המספרים המעשיים הם מחירי היבול הנוכחי המתדרדרים, לא תווית המחיר העתידית של ריבן.

מה בא אחר רובן?
Rubin Ultra במחצית השנייה של 2027, ואז ארכיטקטורת Feynman ב-2028, בשילוב עם ה-Rosa CPU עד 2029 ומעבר. NVIDIA התיישבה על קצב ארכיטקטורה עיקרית של כ-18 חודשים, מה שאומר שכל כרטיס שאתם רוכשים עוקב באופן משמעותי אחרי הדגלית כשני צעדים בתוך כשלוש שנים, והמחירים של הרכישות החכמות מפחיתים את הפחת מהמיום הראשון.

מקורות והערות
המפרטים והלוח זמנים מד disclosures של NVIDIA ב-CES 2026, GTC 2026, ו-Computex 2026, כפי שהדווחו על ידי עיתונות מרכזי הנתונים ותחום המוליכים למחצה. מכפילי ביצועים הם טענות של NVIDIA על עומס עבודה נבחר, אינם מדדי ביצוע עצמאים, ומסומנים כטענות לאורך כל הטקסט. צריכת החשמל והמחיר לא נחשפו בעת הפרסום. ניתוח ה-price-cascade הוא תחזית מבוססת תבניות, ואינו ערובה; חשוב לאמת שערי שוק חיים לפני הרכישה. תמונת גיבור: DrHughManning, CC BY-SA 4.0; תמונת גוף: Windell Oskay, CC BY 2.0, שניים דרך Wikimedia Commons.תרשימים: גרפיקה מקורית של MillionMiner. תוכן אינפורמטיבי, לא ייעוץ כלכלי.

מוכן להתחיל את החקירה?

משלוח DDP חינם בכל העולם. אחסון מקצועי החל מ- $0.055/ק"ו.

Sara Chen

Verfasst von

Sara Chen

Bitcoin & Altcoin Analyst

Sara covers network fundamentals, mining economics, and emerging proof-of-work protocols. She holds a background in applied mathematics and has tracked Bitcoin difficulty adjustments since block 600,000.

תגובות 0

בבקשה היכנס להשאיר הערה

מחיקת הערה?

פעולה זו לא ניתנת לביטול.