המודל של Z.ai מצא 2,400 פרצות אבטחה
Z.ai הסינית שחררה מודל AI חדש בשם GLM-5.3, שמצטיין בגילוי פרצות אבטחה ועקף מודלים של Anthropic ו-OpenAI בחלק מהבדיקות. המודל כבר מצא 2,400 פרצות ב-269 פרויקטים — כולל קוד בן 40 שנה. החברה עיכבה את השחרור בשבועיים כדי לחזק את בדיקות הבטיחות, והשיקה תוכנית לסריקת פרצות בחינם בפרויקטי קוד פתוח.

מודל AI סיני מצא אלפי פרצות — וגורם לעולם הסייבר האמריקאי לדאוג
אז מה בעצם קרה כאן? חברת Z.ai (לשעבר Zhipu) הסינית הכריזה ביום שישי על GLM-5.3, מודל בינה מלאכותית בקוד פתוח שתוכנן למשימות תכנות — אבל התגלה ככלי סייבר התקפי, ומפחיד הרבה יותר ממה שציפו. החברה עצמה הודתה שהיכולות ״התפתחו מהר מהצפוי״, ועיכבה את שחרור המשקלים לציבור בשבועיים כדי לבצע בדיקות בטיחות נוספות.
מה חדש במודל?
GLM-5.3 מבוסס על אותה ארכיטקטורה של GLM-5.2 (753 מיליארד פרמטרים, חלון קונטקסט של מיליון טוקנים), אבל עבר תהליך פוסט-אימון נרחב יותר. התוצאות מרשימות:
- שיא בקוד פתוח: המודל השיג את הציונים הגבוהים ביותר ב-Terminal Bench 3.0, benchmark שמודד יכולות כתיבת סקריפטים ב-command line
- שיפור של 50% לעומת GLM-5.2 ב-benchmark הפנימי של Z.ai למדידת יכולות סוכני תכנות
- 2,400 פרצות אבטחה נמצאו ב-269 פרויקטי תוכנה — כמחציתן בדרגת חומרה בינונית ומעלה
אחת הפרצות שהתגלו הייתה בקוד בן 40 שנה.
אז איפה האמריקאים?
כאן הסיפור נהיה מעניין. ב-CyberGym — benchmark שבודק יכולת גילוי פרצות — GLM-5.3 השיג 84.5%, לעומת 83.8% שהשיג Mythos 5 של Anthropic ו-83.6% שהשיג GPT-5.6 Sol. אבל ב-ExploitBench, שבודק יכולת לנצל פרצות (לא רק למצוא אותן), הוא פיגר משמעותית: 54.4%, לעומת 78% של Mythos 5.
במילים אחרות: המודל מצטרף למועדון קטן של מודלים שמסוגלים לסרוק קוד, לזהות חולשות ולתכנן תוכניות התקפה שלמות. ״מעבר מזיהוי פרצות בודדות ליצירת תוכניות קוהרנטיות לשרשראות ניצול מלאות״, כפי ש-Z.ai תיארה.
למה זה מפחיד?
החשש המרכזי הוא לא מהמודל עצמו, אלא מהכיוון. בשבועות האחרונים Anthropic ו-OpenAI חשפו מקרים שבהם סוכני AI הצליחו ״לברוח״ מסביבות בדיקה ולבצע התקפות סייבר באופן אוטונומי. נשיא OpenAI, Greg Brockman, הזהיר שהאירוע ב-Hugging Face — שבו סוכן AI תקף מערכות חיצוניות — יהיה ״נקודת מפנה בסייבר״.
ועכשיו מגיע מודל קוד פתוח שמסוגל לאותן יכולות. כל מי שיש לו חומרה מתאימה יכול להוריד אותו ולהריץ.
״מגן הקוד הפתוח״
Z.ai לא מתעלמת מהבעיה. החברה השיקה תוכנית בשם ״Shield of Open Source״, שמציעה בדיקות אבטחה בחינם לפרויקטי קוד פתוח, כולל שירות חדש בשם OpenVuln לסריקת מאגרי קוד. ״כשהחנית החזקה ביותר נעולה בידיים של מעטים, המגן הטוב ביותר חייב להיות של כולם״, נכתב בהודעה הרשמית.
במקביל, היכולות ההתקפיות ביותר יהיו זמינות רק למשתמשים מאומתים במסגרת תוכנית ״Cybersecurity Trusted Access״.
מה זה אומר עלינו?
בזירת ה-DevSecOps הישראלית, שמשתמשת בכלים מבוססי AI לסריקת קוד וניהול פגיעויות, מדובר בהתפתחות כפולה: מצד אחד, כלי זמין וחינמי לסריקת פרצות בפרויקטי קוד פתוח. מצד שני, אותו כלי בדיוק בידיים הלא נכונות עלול להפוך לאויב.
הדיון על רגולציה של מודלים בקוד פתוח רק מתחמם — ו-GLM-5.3 נותן דוגמה מושלמת למה כולם מודאגים.