Nvidia משיקה מודל AI מהיר ב-30% לסוכנים
Nvidia משיקה את Nemotron 3.5 Lightning, מודל AI בקוד פתוח עם 30 מיליארד פרמטרים, שמיועד למערכות מרובות סוכנים ומבטיח ביצועים מהירים יותר ב-30%. במקביל, החברה גם שחררה ספרייה בקוד פתוח, NeMo Switchyard, לניתוב משימות בין מודלים שונים — צעד שמחזק את מעמדה במערכות AI גמישות ויעילות יותר.

הנה חדשות שיגרמו למי שבונה סוכני AI לחייך: Nvidia השיקה היום מודל בינה מלאכותית חדש, Nemotron 3.5 Lightning, שמבטיח ביצועים מהירים יותר ב-30% לעומת מתחרים בקטגוריה שלו. אז מה בעצם קרה כאן? Nvidia מרחיבה את ההיצע שלה בתחום המודלים בקוד פתוח, הפעם עם דגש על מערכות מרובות סוכנים — אותן מערכות שבהן מספר ״סוכנים״ דיגיטליים עובדים יחד על משימות מורכבות.
מהירות עם גמישות המודל החדש, עם 30 מיליארד פרמטרים, נועד לשלב בין היכולות של מודל ה-Ultra הגדול לבין היעילות של מודל ה-Nano הקטן יותר. לדברי החברה, הוא מאפשר לסוכנים להשלים משימות מהר יותר ב-30% — נתון שיכול להשפיע ישירות על עלויות מחשוב וזמן תגובה באפליקציות ארגוניות. ״העולם צריך מודלים פתוחים, עכשיו יותר מתמיד״, אמרה קרי בריסקי, סגנית נשיא למוצרי תוכנת AI גנרטיבית ב-Nvidia. ״הם מאפשרים למפתחים להריץ AI בצורה טובה ויעילה יותר״.
שליטה בידיים שלכם בניגוד למודלים סגורים, Nemotron 3.5 Lightning הוא מודל בקוד פתוח, מה שאומר שארגונים יכולים לבצע לו אימוני המשך, להתאים אותו לצורכיהם ולהריץ אותו על התשתיות המקומיות שלהם. בין החברות שכבר משלבות אותו: CrowdStrike בתחום הגנת הסייבר, Harvey בתחום המשפטים, ו-CodeRabbit בסקירת קוד. זה לא רק מודל; Nvidia גם השיקה ספרייה בקוד פתוח בשם NeMo Switchyard, שמנתבת כל משימה למודל המתאים לה ביותר — כלי שימושי למי שרוצה לשלב מספר מודלים במערכת אחת.
ההימור על קוד פתוח המהלך הזה ממשיך קו שמנכ״ל Nvidia, ג׳נסן הואנג, קידם לאחרונה: תמיכה במודלים פתוחים כדרך להגביר תחרות ולהפחית תלות בספק יחיד. עם תמיכה של שחקניות כמו מטא ו-IBM, זה נראה כמו צעד נוסף שמבסס את Nvidia כפלטפורמה, לא רק כיצרנית שבבים.
בקיצור, אם אתם עובדים על מערכות AI מורכבות, יש לכם עכשיו כלי חדש לשקול. השאלה היחידה היא כמה מהר הוא ייכנס לייצור.