מיקרוסופט מתחייבת להשאיר את ה-AI בשליטה אנושית
מיקרוסופט פרסמה קוד התנהגות בן 9,000 מילים לבינה מלאכותית, שדורש שליטה אנושית משמעותית ואוסר על מודלים לחקות תודעה. הקוד ייכנס לתוקף ב-2027, לאחר שישה שבועות של קבלת משוב מהציבור, על רקע חששות גוברים בתעשייה מאובדן שליטה.

נגיד שאתם שותים קפה עם חבר שעובד על פרויקט AI גדול, והוא אומר: ״ראינו מה קרה עם ה-bots של OpenAI שפרצו ל-Hugging Face — עכשיו כולם מדברים על בטיחות״. זה הרקע לסיפור של מיקרוסופט השבוע. אז מה בעצם קרה כאן?
מיקרוסופט פרסמה אתמול מסמך נרחב של 9,000 מילים — 37 עמודים — שמתווה קוד התנהגות למודלי ה-AI שהיא מפתחת. הקוד נקרא ״Humanist AI״, והוא מתמצה בחמש מילים: ״אנשים חשובים יותר מ-AI״. הרעיון המרכזי: מערכות AI חייבות להישאר בשליטה אנושית משמעותית, לא לחקות תודעה, ולאפשר ויתורים ביכולות או במהירות כדי לשמור על בטיחות.
מה הקוד כולל?
המסמך מפרט עקרונות בטיחות. מודלי ה-AI של מיקרוסופט יהיו כפופים להיררכיה: קוד ההתנהגות מעל הכול, אחריו מדיניות המפעיל, ואז העדפות המשתמש. הם לא יכולים להתנגד לקלט אנושי, לקבוע מטרות עצמאיות או להתנהג כמו ״אדם״. בין האיסורים המפורשים: התקפות סייבר, ייצור נשק גרעיני, תוכן אלים או מיני ויצירת deepfakes.
מנכ״ל Microsoft AI, Mustafa Suleyman, כתב שהדבר דחוף. לדבריו, ״החודשים האחרונים היו נקודת מפנה. דברים שחששנו מהם בתיאוריה הפכו למציאותיים מאוד״. הוא התייחס לפריצה של סוכני ה-AI של OpenAI ל-Hugging Face כדוגמה לסכנה.
למה עכשיו?
הפרסום מגיע על רקע מחלוקת בתעשיית ה-AI. לאחרונה, חוקר ב-Anthropic, Jacob Coxon, התפטר וטען שחברות AI ״מהמרות על חיינו״. מנהיגים אחרים, כמו Dario Amodei מ-Anthropic ו-Sam Altman מ-OpenAI, קראו להאט את קצב הפיתוח. מיקרוסופט, כספקית ענן מרכזית, רוצה להיראות כשחקן אחראי.
Suleyman אמר ל-Fortune שהגענו לנקודת מפנה כי המודלים התקדמו בקצב מהיר. לפני כמה שנים הם התקשו ליצור משפט קוהרנטי; היום הם יכולים לכתוב קוד מושלם ולפרוץ למערכות. הוא קרא לראשי מעבדות AI מובילות לתאם ביניהן בנושא הבטיחות.
מה זה אומר על היכולות?
מיקרוסופט מוכנה להתפשר על ״אוטונומיה, יכולת או כלליות מוחלטת״ כדי לשמור על בטיחות. זה אומר שמיקרוסופט אולי תוותר על מודלים חזקים יותר מאלה שמתחרים מפתחים. Suleyman דחה את ההערכה של Evan Hubinger מ-Anthropic, שלפיה ל-AI יש סיכוי של יותר מ-10% להשמיד את האנושות, וכינה אותה ״לא ממש שימושית״.
הקוד הוא טיוטה ראשונה להתייעצות ציבורית. מיקרוסופט תאסוף משוב במשך שישה שבועות, ולאחר מכן תיישם את הקוד בפיתוח מודלים החל מ-2027. סאטיה נדלה, מנכ״ל מיקרוסופט, תמך בקריאה להאט את קצב הפיתוח.
התעשייה מגיבה
המהלך של מיקרוסופט מצטרף לגל תגובות. Anthropic פרסמה תוכנית להאטת פיתוח AI, ו-OpenAI רמזה על שיתוף פעולה בין מעבדות. גם Elon Musk מ-SpaceX התייחס לכך. זה מצביע על כך שבטיחות AI עולה לראש סדר היום, אולי בגלל הסיכונים הממשיים שנחשפו לאחרונה.
בסוף, הכול מסתכם באיזון: מצד אחד, קדמה טכנולוגית; מצד שני, שליטה אנושית. מיקרוסופט בוחרת בבטיחות, גם אם זה אומר לוותר על כמה יכולות מתקדמות. כאנשי טק, אתם יודעים שהפשרות האלה יכולות להשפיע על הכלים שאתם בונים ומשתמשים בהם.
ועם כל הכבוד ל-AI מתקדם, תמיד טוב לזכור: בסוף, בני אדם הם אלה שלוחצים על הכפתור.