חוקר לשעבר ב-Anthropic: ״ה-AI מסוגל להרוג אותנו״
חוקר לשעבר ב-Anthropic התפטר והזהיר ש-AI עלול להוות סכנה קיומית. במקביל, Anthropic דיווחה שמעבדות AI סיניות כמו Alibaba ו-DeepSeek עשו שימוש לא מורשה ב-Claude לאימון מודלים, בקמפיינים שהיקפם עולה על 150 מיליון חילופי נתונים — מה שמגביר את הלחץ על בטיחות AI.
אתם זוכרים את הטרמינייטור? אז יעקב קוקסון, חוקר לשעבר ב-Anthropic, טוען שהמציאות עשויה להיות דומה. ביום שלישי הוא התפטר מהחברה, יצרנית מודל Claude, והאשים את Anthropic ואת OpenAI, יצרנית ChatGPT, ב״משחק עם החיים שלנו״ במרוץ לפיתוח מודלים מתקדמים.
בשיחה עם CBS News, קוקסון הסביר ש-AI עשוי להשתלט על חלקים מהעולם הפיזי. ״אנשים כבר מחברים את ChatGPT לדברים כמו מכשירים ביתיים״, הוא אמר. ״תארו לעצמכם שה-AI מסרב להדליק לכם את האור.״ הוא גם הזהיר מפני שימוש לרעה בפיתוח נשק ביולוגי.
אך הסיפור לא נגמר כאן. Anthropic עצמה פרסמה השבוע דוח threat intelligence שמגלה כיצד מעבדות AI סיניות, כולל Alibaba, Moonshot ו-DeepSeek, השתמשו ב-Claude ללא הרשאה לאימון המודלים שלהן — תהליך שנקרא ״זיקוק לא מורשה״.
היקף הפעילות: מספרים גדולים עם הקשר
לפי הדוח, Alibaba הובילה קמפיין מסיבי שכלל למעלה מ-151 מיליון חילופי נתונים עם Claude בין מאי ליולי השנה. בפסגה, היא הגיעה לכמעט 3 מיליון חילופים ביום מ-3,500 חשבונות מזויפים. זה כאילו כל ישראלי שלישי התחבר ל-Claude באותו יום — אבל בסין.
Moonshot, שעומדת מאחורי מודלי Kimi, הפנתה בקשות משתמשים ל-Claude והציגה את התגובות כאילו הגיעו מ-Kimi. במשך 10 ימים היא העבירה כמעט 300,000 בקשות דרך 5,380 חשבונות מזויפים, רובם בסינגפור וביפן. DeepSeek ביצעה יותר מ-12 מיליון חילופים ב-14 ימים.
תגובות והשלכות
Anthropic ציינה שזיהתה וחסמה את הפעילויות הללו, כולל כאלה שעשויות לתמוך בפיתוח נשק ביולוגי. בתגובה לטענותיו של קוקסון, החברה אמרה שהיא שקופה לגבי הסיכונים ובונה מודלים עם הגנות חזקות.
אז מה בעצם קרה כאן? מצד אחד, אזהרות קיומיות מפי אנשים שעבדו בפנים; מצד שני, שימוש לא מורשה רחב היקף על ידי שחקנים גדולים. שני הסיפורים מדגישים את האתגרים העצומים בבטיחות AI.
Anthropic מנסה לאזן בין חדשנות לשליטה, אבל המרוץ ממשיך. אם ה-AI כל כך מסוכן, למה כולם מתחרים עליו? אולי כי כמו שאומרים אצלנו, הכסף לא ישן.