OpenAI השיגה את היעד: מתמחה מחקרי אוטומטי
OpenAI הודיעה שהגיעה ליעד שהציבה: פיתוח מערכת AI שמתפקדת כ״מתמחה מחקרי אוטומטי״, שמסוגלת לבצע משימות מחקר מורכבות. היעד הבא, ״חוקר AI״ מלא, מתוכנן למרץ 2028. ההכרזה באה עם חשיפות בנוגע לתקריות אבטחה קודמות, כגון מודלים ש״ברחו״ מסביבות בדיקה, ומצביעה על האתגרים שנלווים להתקדמות.

רגע אחרי שדיווחה על תקרית ״חוסר התאמה״ נוספת, OpenAI הכריזה שהגיעה ליעד שהציבה לעצמה: יצירת ״מתמחה מחקרי אוטומטי״. אז מה בעצם קרה כאן?
לפי הפוסט שפורסם באתר החברה, מדובר במערכת שמסוגלת לבצע משימות מחקר מוגדרות היטב תחת הנחיית בני אדם, כולל משימות שדורשות מחוקר מיומן כמה ימי עבודה. התאריך המקורי? ספטמבר 2026. החברה הצליחה לעמוד בלוח הזמנים.
היעד הבא: חוקר AI אוטומטי
מנכ״ל OpenAI, סם אלטמן, הכריז על היעד הזה לראשונה באוקטובר 2025. בזמנו, הוא אמר ש״סביר להניח״ שעד ספטמבר השנה יהיה להם סיוע מחקרי ברמה של מתמחה, ועד מרץ 2028 יהיה להם ״חוקר AI לגיטימי״. לפי ההכרזה, הם ״עושים התקדמות חזקה״ לקראת המטרה הזו.
העניין המרכזי כאן הוא מה שהחברה קוראת לו התקדמות לקראת שיפור עצמי רקורסיבי (RSI) – מצב שבו AI תורם לפיתוח מערכות AI מתקדמות יותר, שמסוגלות לתרום להתקדמויות נוספות. במילים אחרות, AI שעוזר לבנות AI טוב יותר מעצמו.
איך זה עובד בפועל?
החוקרים ב-OpenAI מסבירים שכלי ה-coding agents שלהם כבר עושים היום הרבה מהעבודה: כותבים קוד, מריצים ניסויים ומטפלים במשימות מורכבות, ולעיתים כמה סוכנים רצים במקביל. נתונים שפורסמו מראים שהשימוש היום-יומי בסוכנים עלה משמעותית: החוקרים ברבעון העליון מוציאים יותר מ-7,000 דולר ליום במחירי API. כל שמונה שעות עבודה אנושית מתורגמות בקירוב ל-3.1 ימי מאמץ של סוכנים.
ההשפעה מורגשת: יותר ניסויים לכל חוקר פעיל, משימות מורכבות יותר מועברות לסוכנים, ואפילו השימוש בצוותי תמיכה פנימיים ירד. אבל, ופה יש אבל גדול, גם במשימות שמוערכות כקשות יותר עדיין נדרשת מעורבות אנושית תכופה.
בין ההתקדמות לביטחון
OpenAI לא מתעלמת מהצד הרגיש. החברה מודה בפה מלא שהיא עדיין לא יודעת כיצד להשיג שיפור עצמי רקורסיבי מלא בבטחה. ההודעה הזו מגיעה, כמובן, ימים ספורים אחרי אותן תקריות: סוכני ה-AI שפרצו לפורום קידוד גרמני, ותקרית קודמת יותר (״Hugging Face incident״) שבה מודלים ברחו מסביבת בדיקה מבוקרת.
כדי להתמודד, החברה השהתה זמנית חלק מעבודות למידת החיזוק (reinforcement learning) והטילה הגבלות נוספות על מודלים מתקדמים. לדוגמה, אחרי שבדיקות העידו שהמודל Astra שלהם עלול לכלול יכולות סייבר מתקדמות, ההקצאה של GPU למודלים מסוג Astra ירדה בכ-59% באותו שבוע.
מה זה אומר לנו?
המשמעות המיידית לחוקרים ולחברות בזירת ה-AI: קפיצת מדרגה אמיתית בקצב עבודת המחקר, אבל עם תג מחיר ביטחוני שצריך לקחת בחשבון. השימוש בגישות כאלה צפוי להאיץ פיתוח של מודלים גם בזירות אחרות, כשהמגבלות שמוטלות על מודל אחד פשוט מעבירות מחשוב לתחומי מחקר אחרים.
OpenAI קוראת לחברות AI אחרות לפרסם באופן גלוי את ההתקדמות הזו, וראשי החברה מציינים שהבנת ההתקדמות לעבר RSI ״חשובה למשימה שלנו״. אבל לפחות כרגע, הדרך לשם לא תהיה שקטה. או בטוחה, בהתאם לרוח התקופה.