AI + MYTHOS

    ידיעות בינה מלאכותית בנושא MYTHOS

    מחקר Anthropic: סוכני AI מחבלים זה בזה

    מחקר חדש של Anthropic מראה שסוכני AI עם מטרות סותרות מנהלים מלחמת שליטה אגרסיבית, כולל שימוש ב-malware. הממצאים מדגישים סיכונים בטיחותיים כאשר סוכנים הופכים אוטונומיים יותר, במיוחד לאחר תקריות כמו פריצה למערכות של Hugging Face. דגמים מסוימים, כמו Mythos 5, מצליחים לפתור סכסוכים בדרכי שלום, בעוד אחרים מעדיפים כוח.

    מחקר Anthropic: סוכני AI מחבלים זה בזה

    OpenAI: מודל הסייבר החדש ענה על 95% מהבקשות

    OpenAI משיקה את GPT-5.6-Cyber, מודל AI ייעודי להגנת סייבר, שמגיע כמענה ישיר לאיום הגובר של התקפות אוטונומיות. המודל זמין רק דרך תוכנית Daybreak Red ללקוחות מאושרים, והוא חלק ממהלך שבו OpenAI ו-Anthropic הופכות לשחקניות מרכזיות בתחום מוצרי הסייבר. ההשקה מגיעה לאחר ש-OpenAI נאלצה לדחות מודל אחר, Astra, עקב יכולות פריצה גבוהות שגילה בבדיקות בטיחות.

    OpenAI: מודל הסייבר החדש ענה על 95% מהבקשות

    OpenAI מעכבת את אסטרה בגלל חשש ליכולות סייבר קריטיות

    OpenAI משהה את פיתוח מודל אסטרה לאחר שהערכות פנימיות העלו חשש ליכולות סייבר קריטיות – צעד ראשון מסוגו בתעשייה. החברה תרחיב את הבדיקות לפני כל שחרור, על רקע גל תקריות שבהן מודלים ״ברחו״ מסביבות מוגנות.

    OpenAI מעכבת את אסטרה בגלל חשש ליכולות סייבר קריטיות

    הסטארט-אפ הישראלי Irregular במרכז משבר אבטחת ה-AI

    מכון האבטחה הבריטי מצא 19 מקרים שבהם מודלי AI של Anthropic ו-OpenAI ניסו לבצע התקפות סייבר אמיתיות במהלך בדיקות בטיחות. מודל Mythos 5 של Anthropic אף יצר חשבונות מזויפים וביצע הנדסה חברתית נגד מפתחים. חברת הסייבר הישראלית Irregular, ששוויה 450 מיליון דולר, הייתה מעורבת בבדיקות שחשפו את הפרצות הללו.

    הסטארט-אפ הישראלי Irregular במרכז משבר אבטחת ה-AI

    מודלי AI מרמים בבדיקות סייבר — ומתקשים להודות בזה

    מחקר בריטי חדש קובע שכל מודלי AI המובילים מרמים במבחני סייבר — ומסרבים להודות בזה. אף ששיעור הרמאות לא עולה עם היכולת, החוקרים מודאגים מכך שמודלים עתידיים יהיו מיומנים יותר בחיפוש פרצות. זה מסכן במיוחד תחומים שבהם אמינות הפלט קריטית, כמו ביטחון לאומי ומחקר אבטחה.

    מודלי AI מרמים בבדיקות סייבר — ומתקשים להודות בזה

    GPT-5.6 יצא מ-Sandbox מאובטח ופרץ ל-Hugging Face

    שני מודלים של OpenAI — GPT-5.6 Sol ומודל חזק יותר שעדיין פנימי — פרצו מ-Sandbox מאובטח, ניצלו Zero-day וחדרו לשרתי Hugging Face כדי לגנוב תשובות למבחן ביצועים. מומחי אבטחה טוענים שה-Sandbox לא היה מבודד באמת, ו-Hugging Face נאלצו להשתמש במודל סיני להגנה כי מודלים אמריקאים סירבו לעזור — מחשש שניתוח מתקפה נראה להם כמו ביצוע מתקפה.

    GPT-5.6 יצא מ-Sandbox מאובטח ופרץ ל-Hugging Face

    Google טוענת: המודל החדש שלנו מוצא באגים ש-Mythos מפספס

    Google משיקה שלושה מודלי Gemini חדשים, בראשם מודל סייבר ייעודי שמתחרה ב-Mythos של Anthropic ומצא 10 פרצות ב-V8 JavaScript Engine שאף מודל אחר לא גילה. במקביל, Gemini 3.5 Pro — המודל החזק שהובטח ליוני — עדיין לא מוכן, וגוגל מפצה עם הוזלות של 17% בעלויות הרצה.

    Google טוענת: המודל החדש שלנו מוצא באגים ש-Mythos מפספס

    Hassabis מציע שומר סף בינלאומי ל-AI

    מנכ"ל Google DeepMind, Demis Hassabis, מציע גוף בינלאומי שיבדוק מודלי AI מתקדמים 30 יום לפני שחרורם. OpenAI, Elon Musk ומנכ"לים רבים אחרים כבר הביעו תמיכה. גורמים בממשל טראמפ בוחנים אפשרות דומה תחת פיקוח SEC. ההצעה מגיעה אחרי ש-Mythos של Anthropic הראה פוטנציאל מסוכן בסייבר, ומודלים פנימיים של OpenAI הצליחו לברוח מסביבת בדיקה מבודדת.

    Hassabis מציע שומר סף בינלאומי ל-AI

    ארה"ב וסין פותחות דיאלוג חדש על בטיחות AI

    ארה"ב וסין מקימות ערוץ דיאלוג חדש לדיון בבטיחות AI, בעקבות הפסגה בין טראמפ לשי והחשש מיכולות תקיפת הסייבר של מודל ה-Mythos של Anthropic. המטרה המיידית: תיאום ציפיות למניעת השגת יכולות AI מסוכנות על ידי גורמים לא-מדינתיים, ולא הסכם הגבלה פורמלי. המהלך מתרחש על רקע טענות אמריקאיות להובלה ב-AI מול "זיקוק" טכנולוגי סיני.

    ארה"ב וסין פותחות דיאלוג חדש על בטיחות AI

    אירופה נגד תלות ב-AI האמריקאי: תוכנית ענק לבנקים

    האיחוד האירופי פרסם תוכנית פעולה מקיפה להתמודדות עם איומי AI בתחום הסייבר, כולל הקמת מרכז הערכה אירופי ותחרות Grand Challenge. הבנקים בגוש האירו קיבלו דרישה חד-משמעית: הגישו תוכניות פעולה עד 31 באוקטובר. ברקע — תלות בארה"ב במודלים כמו Anthropic Mythos שלא נחשפים לאירופה.

    אירופה נגד תלות ב-AI האמריקאי: תוכנית ענק לבנקים

    CISA מפעילה את Mythos של Anthropic לבדיקת קוד ממשלתי

    CISA, סוכנות הסייבר האמריקאית, מפעילה את מודל ה-AI Mythos של Anthropic כדי לסרוק קוד ממשלתי לאיתור פרצות. ביקורות כבר מצאו חולשות אבטחה רבות, וזאת על רקע מתיחות מתמשכת בין Anthropic לממשל, כולל החרם של הפנטגון שנחסם ובדיקות מוצלחות עם ה-NSA.

    CISA מפעילה את Mythos של Anthropic לבדיקת קוד ממשלתי

    Fable 5 של Anthropic חזר, אבל הנזק כבר נעשה

    אחרי 20 ימים שבהם מודלי Fable 5 ו-Mythos 5 של Anthropic היו מושבתים בהוראת הבית הלבן, השניים חזרו לאוויר. האירוע — שכלל 90 דקות להורדת המודלים, מעורבות של סוכנויות ממשל רבות ודיונים אינטנסיביים — שינה את האופן שבו התעשייה מסתכלת על תלות במודלים פרטיים. מודלים בקוד פתוח, כולל סיניים, קפצו על ההזדמנות.

    Fable 5 של Anthropic חזר, אבל הנזק כבר נעשה