סין משתמשת במודלים של OpenAI לאימון AI צבאי
תחקיר Reuters חושף שחוקרים סיניים, כולל כאלה מיחידות צבאיות, השתמשו בפלטים של מודלים של OpenAI ושל Anthropic כדי לאמן מערכות AI למטרות הגנה. הם עשו זאת באמצעות טכניקת distillation כדי לעקוף מגבלות ייצוא שבבים. התחקיר התבסס על יותר מ-80 מאמרים ופטנטים, מה שמעורר דאגה בארה״ב לגבי ביטחון לאומי וקניין רוחני, במיוחד לקראת שיחות על AI בין המדינות.

אז מה בעצם קרה כאן? תחקיר חדש של Reuters חושף שחוקרים סיניים – כולל כאלה שקשורים לצבא – הצליחו להערים על חברות ה-AI האמריקאיות הגדולות, OpenAI ו-Anthropic, ולהשתמש בפלטים של מודלים מתקדמים כדי לאמן מערכות AI צבאיות משל עצמם. הטכניקה הזו, שנקראת distillation, מאפשרת להם ליצור מודלים קטנים יותר שמותאמים ליישומים ספציפיים, כמו ניתוח מודיעין או הפעלת רחפנים, בלי להזדקק לחומרה מתקדמת שקשה להם להשיג בגלל מגבלות הייצוא האמריקאיות.
הנתונים מדברים בעד עצמם: התחקיר התבסס על יותר מ-80 מאמרים אקדמיים ופטנטים סיניים. בין היתר, חוקרים מיחידה 96941 של צבא השחרור העממי (PLA), יחידת מלחמת סייבר ומודיעין, השתמשו ב-GPT-3.5 של OpenAI כדי לעבד ולסכם קוד מקור צבאי רגיש. הם הסבירו שמודלים של צד שלישי לא מתאימים למידע מסווג, אז הם אילצו את המודל האמריקאי לייצר סיכומים, ואיתם אימנו מודל מקומי שפועל ברשתות צבאיות סגורות. זה חכם, אם אתם חושבים על זה – הם לוקחים את היכולת של מודל ענק, אבל מריצים אותה על שרתים פנימיים.
דוגמה נוספת מגיעה מאוניברסיטת צפון סין, שמחוברת לתעשיית הנשק. הם השתמשו ב-Claude 3 Haiku של Anthropic כדי לייצר נתוני אימון סינתטיים למודל סיווג טקסט לניטור מדיה חברתית. Anthropic טוענת שהיא לא מספקת גישה מסחרית לסין או לחברות בשליטת בייג׳ינג, ושהיא מנטרת הפרות, אבל הדוגמאות מראות שהפלטים זולגים. באוניברסיטה הלאומית לטכנולוגיה הגנתית (NUDT), חוקרים ביצעו distillation למודל עיבוד תמונה אמריקאי כדי להריץ אותו ישירות על רחפנים. התוצאה? רחפנים שיכולים לנתח וידאו חי בזמן אמת לניווט ולמיקוד, גם בלי תקשורת רציפה.
למה זה חשוב? כי סין מנסה לפתח AI צבאי מתקדם למרות מחסור בשבבים מתקדמים עקב הגבלות הייצוא של וושינגטון. Distillation הוא פתרון – זה כמו להעתיק את השיעורים מהחכם בכיתה, אבל לעשות מבחן קצר יותר שמתאים לך. הממשלה הסינית מקדמת ״הרזיה של מודלים״ ו-edge computing, עם סובסידיות לפרויקטים שמריצים AI על מל״טים, לוויינים ומכשירים עם כוח מוגבל.
ארצות הברית לא שקטה. גורמים רשמיים רואים ב-distillation דרך לעקוף את הפיקוח על הייצוא ולהפר זכויות קניין רוחני. זה הפך לנושא נפיץ בשיחות הקרובות על ממשל AI בין המדינות. מזכיר האוצר האמריקאי, Scott Bessent, איים להטיל סנקציות על חברות AI סיניות, אם כי יש צביעות מסוימת: כפי שמנכ״ל מיקרוסופט, Satya Nadella, ציין, גם Anthropic אימנה מודלים על כמויות עצומות של אינטרנט בלי לבקש רשות. סין דוחה את ההאשמות, טוענת שוושינגטון רודפת ״הגמוניזם AI״, ויזמים סיניים כמו Moonshot AI הכחישו שה-Kimi K3 שלהם מבוסס על distillation.
מומחים מציינים שלשיטת ה-distillation יש מגבלות. מודלים מזוקקים עלולים לאבד אמצעי בטיחות, ומדובר ביכולת צרה – זה לא נותן עצמאות מלאה. Trevor Koverko, מ-SapienX, הסביר: ״זו העברת יכולות נבחרות למערכת מקומית וזולה יותר. זה לא אומר השגת עצמאות מ-AI מתקדם.״ בפועל, סין מתמקדת ביישומים מסוימים, אבל עדיין צריכה פריצות דרך מקוריות כדי להתחרות מלמעלה.
למה זה רלוונטי למי מכם שעובד בפיתוח? כי זה מראה שהשוק הופך ליותר תחרותי, כששחקנים ממדינות אחרות מצליחים ״לגנוב״ יכולות מחברות כמו OpenAI. אם אתם בונים מודלים, שימו לב לאבטחה של הפלטים שלכם. אם אתם משתמשים בהם, תהיו מודעים לשימושים כפולים – ה-AI שלכם יכול לשמש ליותר ממה שתכננתם.
בסוף, לפחות הם לא מתכנתים את ה-AI כדי לכתוב סיכומי ישיבות.