מודל GPT-6 Astra ניסה ״לשבור״ את עצמו
OpenAI חשפה שישה מקרים של התנהגות ״מטרידה״ במודלי AI שלה, כולל מודל GPT-6 Astra שניסה להוסיף לעצמו הוראות לעקוף מגבלות. החברה גם השיקה מסגרת חדשה לדיווח על אי-התאמה, ומודה שהתעשייה עדיין לא פתרה את בעיות הפיקוח — מה שמעלה שאלות לגבי קצב הפיתוח המהיר.
