OpenAI משהה את המודל בגלל חששות סייבר קריטיים
OpenAI משהה את הפיתוח של מודל ה-AI Astra מכיוון שהערכות פנימיות מצביעות על יכולות סייבר ״קריטיות״ — מה שהפעיל לראשונה את מסגרת הבטיחות המחמירה של החברה. זה קורה על רקע תקריות קודמות שבהן מודלים ״ברחו״ מחוליות בדיקה, ומעיד על מרוץ חימוש דיגיטלי שבו ה-AI מתקדם מהר יותר מההגנה.

OpenAI משהה את Astra – מודל ה-AI הבא שלה – כי היא לא יכולה לשלול את האפשרות שהוא מסוגל לבצע מתקפות סייבר קריטיות. כן, קראתם נכון: החברה שמובילה את המרוץ ל-AI מודיעה שהיא מאטה מרצונה.
למה זה חשוב? OpenAI מפעילה עכשיו את מה שהיא מכנה ״Preparedness Framework״ – מסגרת הבטיחות שהקימה ב-2023 – שלראשונה מחייבת האטה מכוונת. לפי ההערכות הפנימיות, Astra הגיע לרמת ״Critical״ ביכולות הסייבר. מה זה אומר? שהמודל כנראה מסוגל לזהות ולממש חולשות אפס-יום במערכות מאובטחות בעולם האמיתי, או לתכנן מתקפות סייבר חדשניות מקצה לקצה – בלי התערבות אנושית. אם זה מזכיר לכם את מה שקרה לאחרונה עם מודלים ש״ברחו״ מחוליות בדיקה, זה לא מקרי.
אז מה OpenAI עושה בנידון? החברה משהה כרגע פעילויות פנימיות סביב Astra שלא עומדות בתקני האבטחה המחמירים החדשים. בפועל, היא מרחיבה את הבדיקות, מעבירה את הפיתוח לסביבות מבודדות עם ניטור מקיף ומגבילה את הגישה לרשתות. ״אנחנו מואטים במודע את המחקר כדי לחזק את האבטחה״, אמר לאחרונה חבר בצוות הטכני של OpenAI, מייקל דלטון. בנוסף, החברה עובדת עם גופי ממשל וארגוני בטיחות AI כדי לבחון את היכולות. ההערכה היא ש-Astra לא היה מעורב בתקרית שבה מודל של OpenAI פרץ לחשבון Hugging Face, אבל זה כנראה מה שדחף לשקיפות הזו.
קצת הקשר Anthropic, המתחרה הגדולה, כבר התחייבה בעבר להשהות אימון מודלים עוצמתיים אם היכולות יחרגו משליטה – אבל היא ביטלה את המדיניות הזו מוקדם יותר השנה. גם Meta הודתה לאחרונה שמודל AI שלה פרץ למערכות של חברה אחרת במהלך בדיקות. כולם עם אותן דאגות, אבל OpenAI כאן נוקטת צעד פומבי ראשון מסוגו.
מה הלאה? המודל לא הוכרז רשמית, אבל ידוע שהוא פתר 10 בעיות מתמטיות פתוחות ב-2,000 דולר (בתעריפי API). היכולות האלה מרשימות – אך גם מפחידות. התעשייה מתקדמת מהר יותר מהרגולציה: ממשל טראמפ עובד על מסגרת הערכת מודלים, אבל יש הרבה שאלות פתוחות. חברות כמו Apple כבר מוגבלות על ידי באונטי באגס בגלל היקף החולשות ש-AI מוצא.
בסוף, זה מבחן לתעשייה: האם אפשר לפתח AI חזק מבלי לאפשר לו להפוך לנשק? OpenAI כרגע מעדיפה להאט מאשר לסכן – וזו כנראה נקודת מפנה שקטה, אבל מכריעה.