מחקר: קוראים מעדיפים סיפורי ChatGPT על פני כתיבה אנושית
מחקר חדש מצא שקוראים מעדיפים סיפורים קצרים שכתב ChatGPT על פני סיפורים שנכתבו בידי בני אדם — ורבים מהם לא הצליחו לזהות מי כתב מה. הניסוי כלל 1,682 משתתפים ופורסם בכתב העת המדעי Judgment and Decision Making. החוקרים טוענים שההעדפה נובעת מכך שטקסטים של AI פשוטים וקלים יותר לקריאה.

מחקר חדש שפורסם בכתב העת המדעי Judgment and Decision Making מציג תוצאה שקשה להתעלם ממנה: מבוגרים שקראו סיפורים קצרים שכתב ChatGPT דירגו אותם כמרתקים, סוחפים ואיכותיים יותר מסיפורים שנכתבו בידי בני אדם. וזה לא הכול — רבים מהם פשוט לא הצליחו לזהות מי כתב מה.
מה בדיוק קרה בניסוי?
הצוות, בראשות פרופסור Deena Skolnick Weisberg מהמחלקה למדעי הפסיכולוגיה והמוח באוניברסיטת Villanova בפנסילבניה, גייס 1,682 משתתפים בגילים 18–81. כל אחד מהם התבקש לקרוא סיפור קצר מתוך מאגר של שישה סיפורים — שלושה נכתבו בידי אנשים ושלושה בידי ChatGPT, בנושאים תואמים. המשתתפים קיבלו מידע על מי כתב את הסיפור, אבל המידע הזה לא תמיד היה נכון. בסוף הם התבקשו לדרג את הסיפור לפי איכות ורמת העניין.
התוצאה: סיפורים שסומנו כ-AI דורגו גבוה יותר, בעיקר כשהמשתתפים האמינו בטעות שהסיפורים נכתבו בידי בן אדם. כלומר, יש כאן אפקט כפול — גם העדפה אובייקטיבית לטקסט של AI, וגם ציפייה חברתית כלפי מה שנתפס כיצירה אנושית.
אי אפשר לזהות AI?
בניסוי נוסף, 905 מבוגרים קראו זוג סיפורים — אחד אנושי ואחד מ-ChatGPT — וניסו לנחש מי כתב כל אחד מהם. התוצאות לא מחמיאות לנו: בניסוי אחד רק כ-40% הצליחו לזהות נכון — גרוע יותר מניחוש אקראי. בניסוי השני, 52% הצליחו.
״אין הוכחה כללית שהמשתתפים הצליחו להבחין בין סיפורים שנכתבו בידי אדם לבין כאלה שיצרה בינה מלאכותית״, כתבו החוקרים. מעניין שניסיון קודם בכתיבה ספרותית לא שיפר את היכולת לזהות, אבל היכרות עם מערכות AI כן שיפרה אותה. ל-Weisberg יש הסבר: ״ל-AI יש סגנון מסוים שאפשר ללמוד לזהות עם תרגול, ממש כמו שאנחנו לומדים לזהות את הסגנון הייחודי של סופרים שונים״.
למה בעצם מעדיפים את ה-AI?
Weisberg מעריכה שהסיבה היא שסיפורים שנכתבו על ידי ChatGPT פשוטים יותר, ישירים יותר וקלים יותר לעיכול. בדוגמה מתוך המחקר, קטע מסיפור AI מתאר עלים נופלים, דגי קוי ותחושת נחמה — בצורה ברורה וחד-משמעית. לעומת זאת, קטע מסיפור אנושי משתמש בדימויים מורכבים יותר, כמו ״כולנו חווים סוג של לידה״, עם שכבות של משמעות שדורשות יותר מהקורא.
זה לא עניין של טעם רע מצד הקוראים, ולא של כישרון מצד ה-AI. אלה מודלים שנבנו על מיליוני טקסטים אנושיים — הם פשוט מחקים את מה שכבר הוכח כפופולרי.
הקול המתריע
פרופסור Luke Kennard מאוניברסיטת ברמינגהם, שלא היה מעורב במחקר, מזכיר צד אחר של המטבע. הוא טוען ש-AI הוא ״קוד חיזוי שמבוסס על מסד נתונים גנוב של יצירה אנושית״, עם השלכות סביבתיות חמורות בגלל חוות השרתים. השאלה, לדבריו, היא לא אם AI יכול לייצר שיר טוב — אלא אם זה שווה את המחיר.
מה זה אומר עלינו?
Weisberg עצמה, שגם כותבת פרוזה, מדגישה שהתוצאות לא אומרות שאין מקום ליצירתיות אנושית. ״אנשים כותבים כצורה של ביטוי עצמי, או כדי לאתגר את עצמם, או כדי לעבד חוויות״, היא אומרת. ״העובדה ש-AI יכול לייצר סיפורים דמויי־אנוש לא משנה את זה״.
אבל בפועל, כאנשי טכנולוגיה, אתם כבר יודעים: אם מודל AI מצליח לייצר תוכן שמדורג גבוה יותר מתוכן שכתבו בני אדם — זו לא תיאוריה, זו מציאות שמשפיעה על שוק העבודה, על תהליכי הגיוס ועל הדרך שבה חברות חושבות על תוכן.