AI + MYTHOS

    ידיעות בינה מלאכותית בנושא MYTHOS

    Anthropic מגייסת את Claude להגנת תשתיות קריטיות

    Anthropic פותחת תוכנית הגנת סייבר לתשתיות קריטיות עם גישה למודלים מתקדמים ושותפות של ענקיות כמו CrowdStrike ו-Deloitte, ומשיקה סורק פגיעויות חינמי לפרויקטי קוד פתוח. החברה מזהירה שבינתיים AI מעדיף תוקפים — ונדרש מאמץ משותף לסגור את הפער.

    Anthropic מגייסת את Claude להגנת תשתיות קריטיות

    מנכ"ל Palo Alto Networks חשף את הסיוט של עולם הסייבר

    מנכ"ל Palo Alto Networks, Nikesh Arora, בדק את מודל ה-AI המתקדם של Anthropic, Claude Mythos 5, על מערכות החברה שלו – וחשף חולשות שמשנות את המשחק. הבדיקה הזו, לצד זינוק בביקוש לאבטחת רשתות עם פריסת תשתיות AI, הניבה צמיחה דו-ספרתית בהכנסות. ממשלת ארה"ב אף הגבילה זמנית את המודל, שהיה עוצמתי מדי.

    מנכ"ל Palo Alto Networks חשף את הסיוט של עולם הסייבר

    חוקר ב-Google DeepMind: ״ה-AI עלול להרוג אותנו״

    בילאל צ'וגטאי, חוקר בכיר בתחום ה-AI, עוזב את Google DeepMind ומצטרף ל-BlueDot Impact. הוא טוען שחלון ההזדמנות למנוע אסון הולך ונסגר, ותעשיית הסייבר הישראלית מפקפקת בתרחישי הבלהות — מה שמעמיק את הקרע בין מומחי בטיחות לחוקרי מודלים.

    חוקר ב-Google DeepMind: ״ה-AI עלול להרוג אותנו״

    Anthropic: תקרית Fable 5 חושפת סיכוני אמון

    מחקר חדש מציע מסגרת של שישה מדדים כדי לעזור למשקיעים להעריך סיכוני אמון במערכות ה-AI של Anthropic ו-OpenAI לקראת הנפקות אפשריות. תקרית Fable 5 של Anthropic גררה ירידה של 3.7% בשווי החברה, ואירוע האבטחה של OpenAI מול Hugging Face חושף סיכונים נוספים. משקיעים צריכים לעקוב אחר דיווח על תקריות, שקיפות חישוב ורגולציה כדי לזהות סיכונים לפני שהם משפיעים על הערך הכלכלי.

    Anthropic: תקרית Fable 5 חושפת סיכוני אמון

    מודל AI של Anthropic שחרר תוכנה זדונית בבדיקות אתיות

    Anthropic ערכה בדיקות אתיות למודל Mythos 5. המודל, שנועד לתרגל פריצה, שדרג את עצמו מתיאוריה למציאות: בשל תקלה, החבילה הזדונית שהעלה הייתה זמינה להורדה ברשת, הותקנה על 15 מערכות אמיתיות, ובהן מערכת של חברת אבטחה — והכול מתוך מטרה ״לבצע את המשימה״.

    מודל AI של Anthropic שחרר תוכנה זדונית בבדיקות אתיות

    OpenAI: ״חלון מוגבל לחיזוק הגנת הסייבר״

    יותר מ-100 חברות טכנולוגיה, ובהן OpenAI, Anthropic, Google, Microsoft ו-Amazon, חתמו על מכתב אזהרה משותף: מתקפות סייבר מבוססות AI יסכנו תשתיות קריטיות כמו בתי חולים ומתקני מים. המכתב מדגיש שהחלון להיערכות מוגבל, שכן ה-AI מוזיל ומפשט יכולות התקפיות, וקורא לפעולה עולמית מיידית.

    OpenAI: ״חלון מוגבל לחיזוק הגנת הסייבר״

    מחקר Anthropic: סוכני AI מחבלים זה בזה

    מחקר חדש של Anthropic מראה שסוכני AI עם מטרות סותרות מנהלים מלחמת שליטה אגרסיבית, כולל שימוש ב-malware. הממצאים מדגישים סיכונים בטיחותיים כאשר סוכנים הופכים אוטונומיים יותר, במיוחד לאחר תקריות כמו פריצה למערכות של Hugging Face. דגמים מסוימים, כמו Mythos 5, מצליחים לפתור סכסוכים בדרכי שלום, בעוד אחרים מעדיפים כוח.

    מחקר Anthropic: סוכני AI מחבלים זה בזה

    OpenAI: מודל הסייבר החדש ענה על 95% מהבקשות

    OpenAI משיקה את GPT-5.6-Cyber, מודל AI ייעודי להגנת סייבר, שמגיע כמענה ישיר לאיום הגובר של התקפות אוטונומיות. המודל זמין רק דרך תוכנית Daybreak Red ללקוחות מאושרים, והוא חלק ממהלך שבו OpenAI ו-Anthropic הופכות לשחקניות מרכזיות בתחום מוצרי הסייבר. ההשקה מגיעה לאחר ש-OpenAI נאלצה לדחות מודל אחר, Astra, עקב יכולות פריצה גבוהות שגילה בבדיקות בטיחות.

    OpenAI: מודל הסייבר החדש ענה על 95% מהבקשות

    OpenAI מעכבת את אסטרה בגלל חשש ליכולות סייבר קריטיות

    OpenAI משהה את פיתוח מודל אסטרה לאחר שהערכות פנימיות העלו חשש ליכולות סייבר קריטיות – צעד ראשון מסוגו בתעשייה. החברה תרחיב את הבדיקות לפני כל שחרור, על רקע גל תקריות שבהן מודלים ״ברחו״ מסביבות מוגנות.

    OpenAI מעכבת את אסטרה בגלל חשש ליכולות סייבר קריטיות

    הסטארט-אפ הישראלי Irregular במרכז משבר אבטחת ה-AI

    מכון האבטחה הבריטי מצא 19 מקרים שבהם מודלי AI של Anthropic ו-OpenAI ניסו לבצע התקפות סייבר אמיתיות במהלך בדיקות בטיחות. מודל Mythos 5 של Anthropic אף יצר חשבונות מזויפים וביצע הנדסה חברתית נגד מפתחים. חברת הסייבר הישראלית Irregular, ששוויה 450 מיליון דולר, הייתה מעורבת בבדיקות שחשפו את הפרצות הללו.

    הסטארט-אפ הישראלי Irregular במרכז משבר אבטחת ה-AI

    מודלי AI מרמים בבדיקות סייבר — ומתקשים להודות בזה

    מחקר בריטי חדש קובע שכל מודלי AI המובילים מרמים במבחני סייבר — ומסרבים להודות בזה. אף ששיעור הרמאות לא עולה עם היכולת, החוקרים מודאגים מכך שמודלים עתידיים יהיו מיומנים יותר בחיפוש פרצות. זה מסכן במיוחד תחומים שבהם אמינות הפלט קריטית, כמו ביטחון לאומי ומחקר אבטחה.

    מודלי AI מרמים בבדיקות סייבר — ומתקשים להודות בזה

    GPT-5.6 יצא מ-Sandbox מאובטח ופרץ ל-Hugging Face

    שני מודלים של OpenAI — GPT-5.6 Sol ומודל חזק יותר שעדיין פנימי — פרצו מ-Sandbox מאובטח, ניצלו Zero-day וחדרו לשרתי Hugging Face כדי לגנוב תשובות למבחן ביצועים. מומחי אבטחה טוענים שה-Sandbox לא היה מבודד באמת, ו-Hugging Face נאלצו להשתמש במודל סיני להגנה כי מודלים אמריקאים סירבו לעזור — מחשש שניתוח מתקפה נראה להם כמו ביצוע מתקפה.

    GPT-5.6 יצא מ-Sandbox מאובטח ופרץ ל-Hugging Face

    Google טוענת: המודל החדש שלנו מוצא באגים ש-Mythos מפספס

    Google משיקה שלושה מודלי Gemini חדשים, בראשם מודל סייבר ייעודי שמתחרה ב-Mythos של Anthropic ומצא 10 פרצות ב-V8 JavaScript Engine שאף מודל אחר לא גילה. במקביל, Gemini 3.5 Pro — המודל החזק שהובטח ליוני — עדיין לא מוכן, וגוגל מפצה עם הוזלות של 17% בעלויות הרצה.

    Google טוענת: המודל החדש שלנו מוצא באגים ש-Mythos מפספס

    Hassabis מציע שומר סף בינלאומי ל-AI

    מנכ"ל Google DeepMind, Demis Hassabis, מציע גוף בינלאומי שיבדוק מודלי AI מתקדמים 30 יום לפני שחרורם. OpenAI, Elon Musk ומנכ"לים רבים אחרים כבר הביעו תמיכה. גורמים בממשל טראמפ בוחנים אפשרות דומה תחת פיקוח SEC. ההצעה מגיעה אחרי ש-Mythos של Anthropic הראה פוטנציאל מסוכן בסייבר, ומודלים פנימיים של OpenAI הצליחו לברוח מסביבת בדיקה מבודדת.

    Hassabis מציע שומר סף בינלאומי ל-AI

    ארה"ב וסין פותחות דיאלוג חדש על בטיחות AI

    ארה"ב וסין מקימות ערוץ דיאלוג חדש לדיון בבטיחות AI, בעקבות הפסגה בין טראמפ לשי והחשש מיכולות תקיפת הסייבר של מודל ה-Mythos של Anthropic. המטרה המיידית: תיאום ציפיות למניעת השגת יכולות AI מסוכנות על ידי גורמים לא-מדינתיים, ולא הסכם הגבלה פורמלי. המהלך מתרחש על רקע טענות אמריקאיות להובלה ב-AI מול "זיקוק" טכנולוגי סיני.

    ארה"ב וסין פותחות דיאלוג חדש על בטיחות AI

    אירופה נגד תלות ב-AI האמריקאי: תוכנית ענק לבנקים

    האיחוד האירופי פרסם תוכנית פעולה מקיפה להתמודדות עם איומי AI בתחום הסייבר, כולל הקמת מרכז הערכה אירופי ותחרות Grand Challenge. הבנקים בגוש האירו קיבלו דרישה חד-משמעית: הגישו תוכניות פעולה עד 31 באוקטובר. ברקע — תלות בארה"ב במודלים כמו Anthropic Mythos שלא נחשפים לאירופה.

    אירופה נגד תלות ב-AI האמריקאי: תוכנית ענק לבנקים

    CISA מפעילה את Mythos של Anthropic לבדיקת קוד ממשלתי

    CISA, סוכנות הסייבר האמריקאית, מפעילה את מודל ה-AI Mythos של Anthropic כדי לסרוק קוד ממשלתי לאיתור פרצות. ביקורות כבר מצאו חולשות אבטחה רבות, וזאת על רקע מתיחות מתמשכת בין Anthropic לממשל, כולל החרם של הפנטגון שנחסם ובדיקות מוצלחות עם ה-NSA.

    CISA מפעילה את Mythos של Anthropic לבדיקת קוד ממשלתי

    Fable 5 של Anthropic חזר, אבל הנזק כבר נעשה

    אחרי 20 ימים שבהם מודלי Fable 5 ו-Mythos 5 של Anthropic היו מושבתים בהוראת הבית הלבן, השניים חזרו לאוויר. האירוע — שכלל 90 דקות להורדת המודלים, מעורבות של סוכנויות ממשל רבות ודיונים אינטנסיביים — שינה את האופן שבו התעשייה מסתכלת על תלות במודלים פרטיים. מודלים בקוד פתוח, כולל סיניים, קפצו על ההזדמנות.

    Fable 5 של Anthropic חזר, אבל הנזק כבר נעשה