Nvidia: Vera Rubin NVL72 יעילה פי 30 ב-AI סוכני
Nvidia הכריזה על פלטפורמת Vera Rubin NVL72, שמבטיחה עד פי 30 יותר עבודה לכל ואט במשימות AI סוכניות, בעלות נמוכה פי 35 לטוקן. SpaceXAI תהיה בין הראשונות לפרוס את מעבדי Vera בקנה מידה גדול, כולל תוכניות ללוויינים — מה שמצביע על הרחבת השימוש במחשוב AI סוכני גם לחלל.

אז אם אתם מפתחים או מנהלים יישומים סוכניים מבוססי AI, כדאי לשמוע על ההצהרה האחרונה של Nvidia. החברה טוענת שפלטפורמת Vera Rubin NVL72 החדשה שלה מספקת עד פי 30 יותר עבודה לכל ואט בהשוואה לפלטפורמות קודמות. כדי להבין למה זה משמעותי, בואו ניזכר במה מדובר.
עומסי עבודה של AI סוכני — כמו סוכנים שחוקרים חברות להשקעות, מפתחים קוד או נותנים שירות לקוחות — צורכים הרבה יותר טוקנים מצ'אט פשוט. לפי נתוני OpenRouter, עומס כזה צורך פי 15 יותר טוקנים מבקשת צ'אט רגילה. הסיבה היא שהסוכנים ותתי־הסוכנים מנהלים תהליכי היגיון מרובי־שלבים, כשההקשר מצטבר ויכול להגיע למאות אלפי טוקנים של קלט. כל זה דורש תשתית שתוכל להתמודד עם הביקוש הזה ביעילות.
ה-Vera Rubin NVL72, שכבר נכנסה לייצור מלא, נבדקה על ידי Nvidia על בסיס עומס העבודה AgentX של SemiAnalysis, המבוסס על סשנים אמיתיים של קידוד סוכני. התוצאות: פי 30 יותר תפוקה למגה־ואט לעומת ה-GB300 NVL72, ועלות נמוכה פי 35 למיליון טוקנים. במילים פשוטות, מפעלי AI מוגבלי־הספק יכולים לבצע פי 30 יותר עבודת סוכנים באותה צריכת אנרגיה — מה שמשפיע ישירות על ההכנסה ועל שולי הרווח.
השיפורים מגיעים מתכנון משותף וקיצוני בכל שכבות הפלטפורמה, מ-Optimized CUDA kernels דרך TensorRT LLM ועד NVLink 6 Switch. בין הטכנולוגיות: עיבוד מפוצל של prefill ו-decode, ניהול מטמון מבוזר וכימות NVFP4. הדומיין של NVL72 מאפשר תקשורת בין GPUs ברוחב פס גבוה ובשיהוי נמוך, מה שחיוני לפריסת סוכנים בקנה מידה גדול.
ומה עם SpaceXAI? החברה, שמפתחת תשתיות AI עבור Grok ולווייני Starmind, הודיעה שתפרוס את מעבדי Nvidia Vera בקנה מידה עצום. Vera הוא ה-CPU הראשון שנבנה במיוחד ל-AI סוכני, עם 88 ליבות Olympus ורוחב פס של 1.2TB/s. SpaceXAI תשתמש ב-Vera כדי לזרז משימות כמו עיבוד נתונים, הרצת קוד ותזמור בין קריאות למודלים, מה שישאיר את ה-GPUs עסוקים ביצירת פלט. Mike Nicolls, נשיא SpaceXAI, אמר: ״Vera נותן לנו את ביצועי ה-CPU ואת רוחב הפס הדרושים כדי להריץ כמויות עצומות של תיאום ועיבוד, מה שאומר סוכנים יעילים יותר שמפיקים יותר עבודה שימושית מכל ואט.״
הפלטפורמה המורחבת של Vera Rubin, שכוללת גם את ה-Vera CPU, Groq 3 LPU ורכיבים אחרים, מתוכננת לפריסות של גיגה־ואטים של כוח מחשוב על פני כדור הארץ ואפילו בחלל. SpaceXAI מתכננת להרחיב את Vera Rubin NVL72 ללוויין הראשון שלה, Starmind, מה שמרמז על עתיד שבו מחשוב AI סוכני פועל גם מחוץ לכדור הארץ.
Nvidia מדגישה שהתוצאות הנוכחיות הן ראשוניות ושיש מקום לשיפור נוסף באופטימיזציות תוכנה. Vera Rubin כבר נמצאת בייצור מלא וכבר נוכחת באקוסיסטם, אז אם אתם עוסקים בתשתיות AI, כדאי לעקוב מקרוב.