NVIDIA משיקה את DSX: 24% יותר תפוקה באותו תקציב כוח
NVIDIA הכריזה אתמול (ג') ב-AI Infra Summit על פלטפורמת DSX למפעלי AI. הפלטפורמה החדשה, שכוללת את DSX MaxLPS לניהול דינמי של צריכת החשמל, הוכיחה בניסוי עם Lambda יכולת להגדיל את תפוקת הטוקנים ב-24% באותו תקציב כוח. בנוסף, מערך DSX Flex מאפשר לחוות AI להגיב באופן מתוזמן לאותות מרשת החשמל — צעד ראשון לקראת גמישות רשתית בקנה מידה גדול.

חבר'ה, אתם יודעים שהמגבלה הגדולה ביותר כיום על חוות AI היא הספק החשמל. NVIDIA הציגה אתמול (ג') ב-AI Infra Summit תשובה מרכזית: NVIDIA DSX, פלטפורמת תשתית ל"מפעלי AI" שמבטיחה להפיק פי 1.4 יותר "טוקנים" — יחידות עבודה של מודלים — מכל מגה-ואט שאתם מזינים אליהם.
מה בעצם קרה כאן? החדשות הגדולות התמקדו בשלושה מרכיבים עיקריים: NVIDIA DSX MaxLPS: חבילה שמתחברת למעבדי ה-GPU שלכם ומנטרת את צריכת האנרגיה בזמן אמת. ההדגמה הוכיחה שספקית הענן Lambda הצליחה להריץ 19 צמתים בתקציב כוח ש-Redux תכנן עבור 16 צמתים בלבד. התוצאה: עלייה של 24% בתפוקת הטוקנים ויותר מ-23% שיפור בביצועים לכל ואט. בפועל, זה אומר שאפשר להגדיל את קיבולת ה-GPU ב-40% באותו תקציב כוח — אם עוברים ל-NVL72 הבא של Vera Rubin. NVIDIA DSX Flex: מרכיב שמטפל ברשת החשמל. הוא מקבל אותות משולבים — כמו אותות המעידים על עומס יתר ברשת — ומסיט באופן אוטומטי עומסים פחות קריטיים. Emerald AI ערכה ניסוי עם חברת החשמל המקומית, Silicon Valley Power: המערכת קיבלה יותר מ-200 אותות כאלה והגיבה כהלכה, מבלי להפסיק משימות קריטיות. זה לא רק חוסך בהוצאות — זה מאפשר למרכזי נתונים להשתתף בגמישות רשתית, ובעצם להפוך ל"משאבים גמישים" שיכולים לפרוק עומס מהרשת בזמני שיא. ההיצע המלא: DSX מגיע גם כמערכת הפעלה מודולרית (DSX OS), ככלי סימולציה לתכנון (DSX Sim) ועם תכנוני ייחוס מאומתים. המטרה היא לנהל את חיי מפעל ה-AI — מהחומרה ועד לרשת — כמערכת אופטימלית אחת.
למה זה חשוב לכם? תשימו לב לטרנד: המדד לתשתיות AI עובר מ-Peak Performance ל-Token per Megawatt. הכנס משך השנה 8,000 משתתפים — לעומת 3,500 בשנה שעברה — מה שמעיד שהתחום הזה צומח במהירות.
DSX מתייחס ל-Vera Rubin, ל-NVLink 6 — הדור הבא של קישוריות ה-GPU — ול-NVIDIA Dynamo, תוכנת Inference. שיתופי פעולה חדשים כוללים עבודה עם Annapurna Labs של אמזון על טכנולוגיית זיכרון HBM מותאמת אישית, ועם d-Matrix, שמשלבת את NVLink Fusion.
Pinterest, לדוגמה, קפצה על הרכבת כבר עכשיו ומשתמשת בפלטפורמת Blackwell של NVIDIA עם Dynamo כדי להביא יכולות AI שיחתיות לגילוי חזותי.
השורה התחתונה: NVIDIA דוחפת חזון שבו "מפעל AI" של ג'יגה-ואט אחד לא יהפוך פתאום לשניים, אבל יוכל להפיק ממנו הרבה יותר עומסי עבודה. DSX נועד לגרום לזה לקרות. המנכ"ל Jensen Huang תמיד אומר שכאשר נתקלים במגבלות פיזיקליות — מפסיקים לייעל חלקים ומתחילים לתכנן את השלם. DSX הוא בדיוק התשובה הזו. וכשהתוצאות מהשטח מראות שיפור של 24% בתפוקה באותו תקציב כוח — זה לא עוד מונח שיווקי, אלא נתון שמהנדסי התשתיות שביניכם צריכים לבחון מקרוב.