הסטארטאפ הסיני Moonshot AI מואשם בחילוץ היגיון ממודלים
OpenAI חשפה ועצרה קמפיין מתואם מצד גורמים הקשורים ל-Moonshot AI, שניסו לחלץ היגיון מוגן ממודלים שלה. הפעילות, שזוהתה ביולי, כללה אלפי חשבונות והגיעה לשיא של 16,000 בקשות ביומיים, ובעקבותיה חיזקה החברה את ההגנות למניעת זיקוק עוין בעתיד.

OpenAI הצליחה לסכל ניסיון מתוחכם לגנוב את ״המוח״ של המודלים שלה – קמפיין מתואם שלטענתה הובילה החברה הסינית Moonshot AI.
בסוף יולי זיהתה OpenAI פעילות חריגה שנשאה מאפיינים של "זיקוק עוין" (adversarial distillation) – ניסיון לחלץ היגיון מוגן ממודלי ה-AI שלה. בשיא, ב-24–25 ביולי, נרשמו 16,000 בקשות מיותר מ-4,000 משתמשים, ועד 28 ביולי זיהתה החברה אשכול של למעלה מ-15,000 משתמשים הקשורים לפעילות.
איך זה עבד? המפעילים ניסו להעתיק היגיון מוצפן משיחה אחת ולבקש ממודל בינה מלאכותית בשיחה אחרת לפענח ולשחזר את התוכן המוסתר. לדברי OpenAI, הם לא הצליחו לפרוץ את ההצפנה או לגשת למאגרי מידע חסויים, אלא רק לתמרן אינטראקציות כדי לחשוף היגיון פנימי.
ל-Moonshot AI, שפיתחה את המודל Kimi K3, שהגיע לצמרת דירוגים מובילים מוקדם יותר השנה, יש כבר היסטוריה של ביקורות דומות. חברות כמו Anthropic האשימו אותה ואת חברות סיניות אחרות בזיקוק לא חוקי, וגם סוכנות הסייבר האמריקאית CISA ציינה אותה כגורם שמחלץ נתונים ממודלים אמריקאיים.
בתגובה, OpenAI נקטה צעדים: חסימת משתמשים, חיזוק בקרות הרישום, הרחבת הניטור וחיזוק ההגנה על היגיון מוגן כדי למנוע שחזור מתוכן מוצפן. החברה גם שיתפה את ממצאיה עם מפתחי AI אחרים באמצעות Frontier Model Forum וערוצי ממשל.
זיקוק, כשנעשה בהסכמה, הוא חלק מקובל בחדשנות AI – מטא, למשל, הגנה על הפרקטיקה כחיונית לדמוקרטיזציה. אבל כאן, הטענות הן על חילוץ עוין שמאיים על ביטחון לאומי ועל יתרון תחרותי. בעולם שבו כל מודל חדש מעורר תיאבון ללוגיקה שלו, המשחק בין החתול לעכבר ממשיך.