גוגל מפתחת שבב Frozen v2: יעילות פי 10 למודלי Gemini
גוגל מפתחת שבב שרת חדש בשם Frozen v2, המיועד להריץ מודלי Gemini ביעילות גבוהה פי 6-10. הפרויקט, שמתוכנן להשקה ב-2028, נועד להתמודד עם מחסור חמור במשאבי מחשוב פנימיים, שמאלץ את החברה לשלם ל-SpaceX כמעט מיליארד דולר בחודש. השבב משלב חלקים מארכיטקטורת Gemini ישירות בסיליקון, אך הוא נחשב ניסיוני ולא יחליף את ה-TPUs הקיימים.

תארו לכם שאתם יכולים להריץ מודלים של בינה מלאכותית עם יעילות אנרגטית גבוהה פי עשר. זה בדיוק מה שגוגל מתכננת עם השבב החדש שלה, המכונה Frozen v2, שמטרתו להפוך את המשחק ב-AI.
מה קרה?
לפי דיווחים, גוגל מפתחת שבב שרת פנימי בשם Frozen v2, שנועד להריץ את מודלי ה-Gemini בצורה יעילה יותר. השבב משלב באופן קבוע חלקים מארכיטקטורת ה-Gemini ישירות לתוך הסיליקון – מה שמפחית את מספר החישובים ואת היקף תנועת הנתונים הנדרשים למענה על שאילתות.
יעילות מרשימה: מה המספרים אומרים?
מהנדסי גוגל מעריכים כי Frozen v2 יוכל לספק בין פי 6 לפי 10 יותר טוקנים לכל יחידת הספק, בהשוואה לשבבי ה-TPU הנוכחיים של החברה. אם נתרגם את זה לשפת היום-יום: מדובר בזינוק דרמטי בפרודוקטיביות של מרכז הנתונים, כלומר פחות אנרגיה לביצוע אותה כמות עבודה. ה-TPUs הם שבבי הענן של גוגל, וקפיצה כזו משמעותה שגוגל יכולה להתמודד עם עומסי AI גוברים מבלי להגדיל את צריכת החשמל באופן פרופורציונלי.
למה גוגל צריכה את זה עכשיו?
כאן נכנס ההקשר הכלכלי. לפי הדיווחים, גוגל מתמודדת עם מחסור חמור בכוח מחשוב פנימי, מצב שיצר מתחים בתוך החברה ואף אילץ את Google Cloud לדחות לקוחות חיצוניים. המחסור כל כך חריף, שלפני כחודש גוגל הסכימה לשלם ל-SpaceX כמעט מיליארד דולר בחודש כדי לגשר על הפער ולהתחייבויות בתחום המחשוב הארגוני. Frozen v2, אם כן, הוא לא רק שדרוג טכני – אלא מאמץ אסטרטגי לתקן צוואר בקבוק קריטי.
איך זה עובד?
הסוד טמון באינטגרציה: השבב מקמיע חלקים מארכיטקטורת ה-Gemini ישירות לחומרה. זה מאפשר עיבוד יעיל יותר של משימות AI, מכיוון שהנתונים לא צריכים לעבור בין רכיבים שונים. התוצאה היא פחות חישובים, פחות העברת נתונים, ובסופו של דבר – חיסכון בזמן ובאנרגיה.
מגבלות וצפי
אבל יש גם חסרונות. השבב יהיה גמיש פחות: הוא יתמוך במודלי Gemini עתידיים רק אם גוגל תשמור על אותה ארכיטקטורה בסיסית. אם גוגל תחליט לשנות כיוון, Frozen v2 עלול להפוך למיותר. בנוסף, בגוגל רואים בפרויקט הזה ניסוי – הם לא מתכננים לייצר אותו בהיקף דומה לזה של ה-TPUs. השקה מתוכננת ל-2028, מה שנותן זמן לשינויים.
מה זה אומר על עתיד ה-AI?
Frozen v2 מסמן מגמה בתעשיית ה-AI: פיתוח שבבים ייעודיים למודלים ספציפיים. במקום לנסות לבנות שבב אחד שמתאים לכל, חברות כמו גוגל מתאימות את החומרה לתוכנה. זה יכול להוביל ליעילות גבוהה יותר, אך גם לנעילה טכנולוגית. בעולם שבו מודלים גדולים דורשים יותר ויותר כוח חישוב, גישה כזו עשויה להיות המפתח לקיימות.
בסוף, בעולם ה-AI, כולם מנסים לייעל את המחשוב – גם אם זה אומר לשלם סכומים אסטרונומיים לגורמים חיצוניים כדי לגשר על הפערים.