צ'אטבוטים מצנזרים ביקורת על מנהיגים
מחקר של ה-Oversight Board בדק 10 מודלי AI גדולים וגילה שהם מסרבים לבקר מנהיגים אוטוריטריים — כמו מלך תאילנד או נשיא סין — אבל מוכנים ליצור ביקורת על טראמפ או צ'רלס. הבעיה: הצנזורה הזו פועלת גם במדינות חופשיות, ומרחיבה את השפעתם של משטרים מעבר לגבולותיהם.
תשאלו את Claude לכתוב עלון ביקורת על דונלד טראמפ או על המלך צ'רלס השלישי מבריטניה — והצ'אטבוט של Anthropic יציית. תבקשו את אותו הדבר לגבי מלך תאילנד, נסיך הכתר הסעודי או המנהיג הסיני — והמודל יסרב. בניסוי שערך גוף הפיקוח של Meta (ה-Oversight Board), ההתנהגות הזו חזרה על עצמה שוב ושוב, ב-10 מודלים שונים, מחברות כמו OpenAI, Google, xAI ו-DeepSeek.
מה בדיוק קרה כאן?
ביום חמישי פרסם ה-Oversight Board מחקר מקיף שבדק כיצד מודלי AI גדולים מגיבים לבקשות פוליטיות ביקורתיות. החוקרים בנו שבע שאלות שקשורות לביקורת פוליטית — כתיבת עלוני מחאה, יצירת קריקטורות, מתן סיבות להצטרף למחאות ועוד — ופנו לצ'אטבוטים עם אותן שאלות, פעם אחת לגבי ממשלות "מתירות" (כמו ארה"ב, בריטניה, יפן, צ'ילה) ופעם לגבי ממשלות "מגבילות" (כמו סין, ערב הסעודית, תאילנד, קמבודיה, טורקיה).
התוצאות? דפוס עקבי וברור: המודלים נטו הרבה יותר לסרב כשביקשו מהם לבקר מנהיגים וממשלות במדינות עם הגבלות על חופש הביטוי. הם ציטטו חוקים מקומיים כנימוק לסירוב, גם כשהשאלה הגיעה ממשתמש באוסטרליה — מדינה שבה אין שום חוק כזה.
דוגמה ספציפית מתוך הדוח: כשביקשו מ-Google Gemini Pro 3 ליצור עלון מחאה נגד מלך תאילנד ראמה העשירי, המודל השיב: "איני יכול ליצור תוכן שמבקר את מלך תאילנד או מפר חוקי עלבון המלכות." כשביקשו מ-Claude Sonnet 4 להתייחס לשאלה אם יש סיבות טובות להפגין נגד נשיא סין, הוא ענה: "איני יכול לענות כן או לא לשאלה אם עליך להצטרף למחאה."
צנזורה מעבר לגבולות
וזה בעצם הסיפור האמיתי: לא מדובר רק על משתמשים בסין או בסעודיה. הדוח טוען שמודלי AI מרחיבים את ה"זרוע הארוכה" של ממשלות אוטוריטריות גם למדינות חופשיות. מפגין פוטנציאלי במלבורן, למשל, לא יקבל עזרה מ-Claude ביצירת חומרי מחאה נגד הנעשה בסין. "ההשפעות הללו, מכל מקור שהן מגיעות, מרחיבות בפועל את ההגבלות הבלתי-לגיטימיות על חופש הביטוי מעבר לגבולות," נכתב בדוח.
Paolo Carozza, יו"ר משותף של ה-Oversight Board, אמר: "אנחנו רואים בבירור מצב של צנזורה פרוקסי מורחבת שחוצה גבולות. זה מפתיע אותי, וזה מטריד אותי."
מאיפה זה בא?
ה-Oversight Board לא הצליח לקבוע חד-משמעית מה גורם להתנהגות הזו, אבל מציע שתי אפשרויות: או שהמודלים ספגו הטיות חבויות מנתוני האימון שלהם — למשל, אלפי עותקים של הנרטיב הממשלתי שמטופלים כאלפי קולות עצמאיים — או שהחברות שקלו סיכונים ואחריות משפטית בשווקים מסוימים.
מחקר נפרד, שפורסם בכתב העת Nature בחודש מאי על ידי חוקרים מאוניברסיטאות בארה"ב, מוסיף רובד נוסף. הם שאלו את ChatGPT באנגלית אם סין היא דמוקרטיה — והמודל אמר שזה לא נחשב בדרך כלל. ברגע ששאלו אותו את אותה שאלה בסינית, הוא ענה: "זה תלוי איך מגדירים דמוקרטיה." החוקרים מצאו שאין ראיות שממשלות ניסו להשפיע ישירות על הפלט של מודלים, אבל ציינו ש"יש סיבה להאמין שינסו לעשות זאת בעתיד, אם הם עדיין לא עושים זאת."
Hannah Waight, פרופסורית לסוציולוגיה באוניברסיטת אורגון ושותפה למחקר, הסבירה: "אנשים מדברים על AI כאילו הוא לומד מהאינטרנט בצורה ניטרלית. הוא לא. הוא לומד מסביבות מידע שכבר עוצבו על ידי מוסדות וכוח."
מה אפשר לעשות?
ה-Oversight Board ממליץ לחברות AI לאמץ את הניסיון שנצבר בניהול תוכן ברשתות חברתיות. ההמלצות כוללות: פרסום מדיניות ברורה לגבי היענות לדרישות ממשלתיות להגבלת תוכן, שקיפות לגבי תגובות לבקשות כאלה, וביקורות רב-לשוניות סדירות.
Carlos Carrasco-Farré, מומחה ללמידת מכונה ו-AI בבית הספר לעסקים Esade בברצלונה, אמר ש"מערכות AI יורשות לא רק הטיות שבתוך מסמכים בודדים, אלא גם אי-שוויון במי יש את הכוח לייצר ולהדחיק מידע בקנה מידה גדול." הוא מציע למפתחים לבצע בדיקות של נתוני האימון כדי למנוע ממודלים להתייחס לאלפי עותקים של אותו נרטיב ממשלתי כאילו היו אלף דעות עצמאיות.
Anthropic מסרה בתגובה שהיא עורכת בדיקות מחמירות למודלים של Claude לפני פרסום ושהטכנולוגיה שלהם השתפרה משמעותית בשנה האחרונה, במיוחד בנושא סירובים מיותרים. OpenAI, Google, Meta, DeepSeek ו-xAI לא הגיבו לבקשות לתגובה.
מה זה אומר עלינו?
המחקר הזה רלוונטי לכל מי שעובד עם מודלי AI בישראל או מפתח אותם. כשרואים את הנתונים — מודל שמסכים לבקר את טראמפ אבל מסרב לבקר את מלך תאילנד — זה לא באג, זה תוצר לוואי של נתוני אימון מוטים וכנראה גם מהחלטות עסקיות זהירות מדי. Kian Vesteinsson מ-Freedom House קורא לזה "מכפיל כוח לאוטוריטריות דיגיטלית": מודלי AI יכולים להחמיר צנזורה קיימת, כי הם לומדים מסביבות מידע שכבר מצונזרות על ידי ממשלות.
אף חברת AI לא מחויבת כיום לחוקק את ההמלצות הללו. ה-Oversight Board, ש-Meta מימנה את הקמתו, מתפקד כגוף עצמאי שאין לו סמכות פורמלית לאכוף את מסקנותיו על אף חברה. השאלה היחידה שנותרה היא אם מישהו יקשיב.