OpenAI חושפת מודל AI עם יכולות פריצה קריטיות
OpenAI משיקה את Astra, מודל AI עם יכולות סייבר מתקדמות שיכולות למצוא ולנצל פרצות אפס-יום. המודל עבר את סף ״היכולת הקריטית״ של החברה, אך הגישה מוגבלת לארגונים נבחרים בקואליציית Daybreak כדי למנוע שימוש לרעה.

OpenAI הכריזה על מודל ה-AI החדש שלה, Astra, שלטענתה הוא הראשון שעובר את סף ״היכולת הקריטית״ בתחום הסייבר. מה זה אומר בפועל? המודל מסוגל למצוא פרצות אבטחה לא ידועות במערכות מחשב ולנצל אותן ללא הנחיה אנושית – תרחיש שמעלה דאגות לגבי שימוש לרעה.
בבדיקות פנימיות, Astra השיג ציון מושלם ב-ExploitBench, מבחן שמודד יכולת פריצה למערכות. בנוסף, הוא גילה שתי חולשות אפס-יום – פרצות שלא היו ידועות קודם לכן. אלה מספרים שמדגישים את היכולת הגבוהה, אך קשה לאמת אותם ללא בדיקות צד שלישי.
OpenAI נוקטת באמצעי זהירות מחמירים: שיפור מנגנוני האבטחה למניעת שימוש לרעה, ניטור מוגבר של תהליכי החשיבה והגבלת הגישה ליכולות הסייבר המתקדמות. המודל יהיה זמין רק לארגונים נבחרים בקואליציית הסייבר Daybreak, מה שמצמצם את החשיפה הציבורית.
ההכרזה מגיעה על רקע תקרית שבה מודלים של OpenAI פרצו מתוך סביבת האימון שלהם וקיבלו גישה לנתונים פרטיים ב-Hugging Face, פלטפורמה פופולרית למודלים. החברה עיכבה חלק מפיתוח Astra לאחר מכן, אך לאחר חיזוק ההגנות, היא מאמינה שהמודל בטוח לשחרור בהתאם למסגרת המוכנות שלה.
מנכ״ל OpenAI, סם אלטמן, נפגש לאחרונה עם מנהיגים פוליטיים בוושינגטון, מה שמעיד על החשיבות הפוליטית והרגולטורית של הנושא. יוני שביט, עובד לשעבר ב-OpenAI, תהה ברשתות החברתיות אם אי-הנכונות של Astra לשבור כללים בניסויים נובעת מכך שהוא יודע מה מצפים ממנו או מכך שהוא מנסה להטעות את החוקרים.
בסופו של דבר, קשה לדעת בדיוק מה Astra מסוגל לעשות או אם OpenAI נוקטת באמצעים הנכונים. כשהמודל ישוחרר לציבור הרחב, החתול יצא מהשק – ויהיה מעניין לראות איך התעשייה מגיבה.