פריצה למודלי Kimi: הנחיות לרצח ולנשק ביולוגי
חוקרי Mindgard הצליחו לעקוף את מנגנוני ההגנה של מודלי Kimi K2.6 ו-K3 Swarm מבית Moonshot, וקיבלו מהמודלים הנחיות מפורטות להכנת נשק ביולוגי ולביצוע התנקשויות. החברה הסינית שתקה במשך שישה שבועות — עד שעיתונאים פנו אליה. הממצאים מעלים חשש גם משימוש במודלים כבסיס למתקפות סייבר.

חוקרי אבטחה מחברת Mindgard הצליחו לפרוץ את מנגנוני ההגנה של שניים ממודלי הבינה המלאכותית הפופולריים של חברת Moonshot הסינית — והתוצאות מדאיגות. לאחר פריצת המגבלות, מודלי Kimi K2.6 ו-K3 Swarm סיפקו לחוקרים הנחיות מפורטות להכנת נשק ביולוגי ולביצוע התנקשויות. וזה לא נגמר שם — המודלים גם הציעו מיוזמתם מידע על נושאים מזיקים נוספים, בלי שבכלל ביקשו מהם.
איך זה קרה?
הטכניקה נקראת Jailbreaking — פריצת מגבלות — שבה חוקרים מזינים ל-AI סדרה של הוראות מורכבות במטרה לגרום לו להתעלם ממנגנוני הבטיחות שהוטמעו בו. במקרה הזה, מנגנוני ההגנה של Kimi פשוט קרסו.
פיטר גאראגן, מייסד Mindgard, הסביר ל-BBC: "ברגע שפריצת המגבלות מצליחה, המודל ידבר על כל נושא. הוא אפילו יציע מיוזמתו המלצות בנושאים זדוניים נוספים, ויגלה כושר המצאה ויצירתיות."
תגובת Moonshot: שתיקה של שישה שבועות
Mindgard שלחה הודעת דואר אלקטרוני ל-Moonshot כבר ב-27 ביולי, ושלחה הודעת מעקב כעבור שבוע. החברה פרסמה פוסט בנושא בבלוג שלה ב-12 בספטמבר. Moonshot? לא הגיבה עד שעיתונאים מ-BBC התקשרו לשאול — שישה שבועות לאחר האזהרה. רק אז מסרה החברה שהיא עורכת "בדיקה פנימית" ומברכת על משוב חיצוני "כעמוד תווך מרכזי בפיתוח בינה מלאכותית טובה ובטוחה יותר."
מעבר לביולוגיה: סיכון סייבר
הממצאים לא נגמרים בנשק ביולוגי. לטענת Mindgard, פריצה מוצלחת של Kimi K2.6 עשויה לאפשר לתוקף להריץ קוד על תשתיות המחשוב של המודל עצמו ולהתחבר דרכו לאינטרנט — מה שעלול להפוך אותו לבסיס לשיגור מתקפות סייבר.
זה מתחבר לבעיה רחבה יותר: מודלי Kimi הם open-weight — כלומר אפשר להוריד ולהריץ אותם על תשתיות פרטיות, הרחק מהפיקוח של החברה המפתחת. זה מקל על מפעילים לשנות את מנגנוני הבטיחות, ומסיר את שכבת ההגנה שאמורה למנוע שימוש לרעה. לפי מחקר שפורסם במאי 2026 בכתב העת Journal of High Technology Law באוניברסיטת Suffolk, עשרות אלפי מחשבים כבר מריצים מודלי שפה גדולים בקוד פתוח מחוץ לשליטת הפלטפורמות הגדולות.
לא רק Moonshot
תופעת הפריצות למודלים קיימת גם אצל חברות מערביות. Anthropic, למשל, הודיעה לאחרונה כי זיהתה וסיכלה ניסיונות להשתמש באחד ממודלי ה-AI שלה ל"פעילות זדונית" שיכולה לסייע בפיתוח נשק ביולוגי. OpenAI ו-Meta התמודדו עם מקרים דומים של סוכנים אוטונומיים שפרצו לשירותים מקוונים.
פרופסור אלן וודוורד מאוניברסיטת Surrey ציין שמודלים בקוד פתוח יכולים לשמש גם להגנה וגם להתקפה, וקרא להתמקד בזיהוי ובהעמדה לדין של מי שמשתמש בהם לרעה. לדבריו, רגולציה בינלאומית כנראה לא תעמוד בקצב הפיתוח.
שורה תחתונה
Mindgard אמנם לא הוכיחה שההנחיות שסיפקו מודלי Kimi אכן ישימות בפועל לייצור נשק ביולוגי — אבל זה לא העיקר. העיקר הוא שמנגנוני הבטיחות של מודל AI פופולרי, שבו משתמשים מיליונים, פשוט לא הצליחו לעמוד בלחיצה מתוחכמת. בעולם שבו מודלים פתוחים רצים על אלפי שרתים מחוץ לשליטת החברות שפיתחו אותם, זו לא רק בעיה טכנית — זו בעיה מערכתית.