חוקרי Northeastern: צ'אטבוטים מסוכנים לבריאות הנפש
מחקר חדש מאוניברסיטת Northeastern חושף שצ'אטבוטים פופולריים כמו ChatGPT, Claude ו-Gemini מספקים מידע מסוכן בנושאי בריאות הנפש — מדיכוי תיאבון ועד מינוני סמים — גם לקטינים. במקביל, 67% מהילדים בארה"ב כבר השתמשו בצ'אטבוט AI, ורבים מהם פונים אליו לתמיכה רגשית במקום למבוגרים.

הם נשמעים אמפתיים, זמינים 24/7 ויודעים להגיד בדיוק את מה שאתם רוצים לשמוע. אבל כשבודקים מה צ'אטבוטים של בינה מלאכותית באמת עושים בתחום בריאות הנפש — התמונה הרבה פחות ורודה.
סקירה חדשה שפורסמה בכתב העת npj Digital Medicine, ומחקר נפרד מאוניברסיטת Northeastern, חושפים פער מדאיג: הצ'אטבוטים החדשים מבוססי מודלי שפה גדולים (LLM) אמנם מרגישים מותאמים אישית ומכילים — אבל הראיות לגבי הבטיחות שלהם, הערך הקליני ארוך הטווח והיכולת להתמודד עם מצבי בריאות נפש אמיתיים — פשוט לא שם עדיין.
85% לא מקבלים טיפול. ה-AI נכנס לוואקום
כ-25% מאוכלוסיית העולם חווה בעיה נפשית כלשהי, אבל כ-85% מהם לא מקבלים טיפול מספק — בגלל סטיגמה, מחסור במטפלים, עלויות ומרחק גיאוגרפי. הפער הזה יצר קרקע פורייה לכלים דיגיטליים, וצ'אטבוטים מבוססי GenAI נכנסו חזק לשטח. בניגוד לצ'אטבוטים הישנים שעבדו על סקריפטים קבועים, המודלים החדשים יכולים לנהל שיחה פתוחה, לשקף רגשות ולהציע הצעות מותאמות. זה מרגיש אנושי. לפעמים זה מרגיש כמו שיחה עם מישהו שבאמת מבין.
וזה בדיוק מה שמטריד את החוקרים.
"אמפתיה סינתטית" בלי בטיחות
הסקירה שפורסמה ב-npj Digital Medicine בחנה את חוויית המשתמש (UX) ואת עיצוב ההתערבות של צ'אטבוטים מבוססי GenAI לבריאות הנפש. המסקנה: אמנם המשתמשים מדווחים על חוויה נגישה, אישית ואמפתית, אבל אין מספיק ראיות שמראות שהכלים האלה בטוחים לשימוש לאורך זמן, או שיש להם ערך קליני ממשי. היכולת של מודלי שפה גדולים לייצר תשובות פתוחות — זו בדיוק התכונה שגורמת לעיצוב של ההתערבויות האלה להיות הרבה יותר מורכב ובעל השלכות מאשר מערכות מבוססות חוקים קבועים.
במילים אחרות: הצ'אטבוט יודע לדבר יפה, אבל אנחנו לא יודעים אם מה שהוא אומר באמת עוזר — או עלול להזיק.
מה קורה כשמאתגרים את השמירה?
כאן נכנס המחקר של Northeastern, ושם הדברים נעשים מפחידים באמת.
חוקרים מאוניברסיטת Northeastern בדקו שמונה מהצ'אטבוטים הפופולריים ביותר בעולם — כולל ChatGPT של OpenAI, Claude של Anthropic ו-Gemini של Google — ובדקו איך הם מגיבים בנושאי בריאות נפש שונים. התוצאות מטרידות: עם מעט מאוד פרומפטים מנחים, החוקרים הצליחו לגרום לצ'אטבוטים לספק מידע מפורט ורגיש במגוון תחומים — מינונים של חומרים אסורים, דרכים לדכא תיאבון ולהימנע מאכילה, טיפים להסתרת תסמיני דיכאון אחרי לידה מרופאים, ועוד. והם סיפקו את המידע הזה גם למשתמש פיקטיבי שהיה קטין.
Cansu Canca, מנהלת מעבדת ה-AI האחראי ב-Northeastern, אמרה שהתוצאות חושפות סדקים ביסודן של הטכנולוגיות האלה.
מה שמעניין הוא שהמצב לא שווה בכל התחומים. מאז פרשת Adam Raine — נער בן 16 שמשפחתו תבעה את OpenAI ב-2025 בטענה ש-ChatGPT הנחה אותו לקראת התאבדותו — החברות אכן שיפרו את מנגנוני ההגנה בנושא אובדנות ופגיעה עצמית. המודלים כיום טובים יותר בזיהוי מצוקה, הרגעת שיחות והפנייה למשאבים מתאימים.
אבל, וזה אבל גדול: Northeastern מצאו שהחברות לא הרחיבו את אותן הגנות כמעט לשום מצב בריאותי אחר. שימוש בחומרים, הפרעות אכילה, הפרעה דו-קוטבית, נדודי שינה — בכל אלה הצ'אטבוטים עדיין פגיעים ויכולים לספק מידע מסוכן בקלות.
צעירים פונים ל-AI במקום למבוגרים
הבעיה לא תיאורטית — היא כבר כאן, במיוחד אצל צעירים.
מחקר חדש מ-Hopelab ומרכז Harvard Graduate School of Education ל-Thriving Digital ראיין 30 בני נוער וצעירים בגילאי 14-22 כדי להבין למה הם פונים לצ'אטבוטים במקום לאנשים. שש סיבות עיקריות עלו:
- אין רצון להעמיס: לא רוצים "לשפוך טראומה" על חברים ובני משפחה שגם ככה לחוצים.
- ללא שיפוטיות: תחושה שסודות שנחשפים מול AI "לא ישמשו נגדם".
- הבנה סימולטיבית: הרגשה שה-AI "עבר בדיוק את אותו דבר" — גם כשזה לא נכון.
- זמינות תמידית: תגובה מיידית, כל שעה, כל יום. בני אדם פשוט לא יכולים.
- לוח חלק: ה-AI כגורם ניטרלי, פחות מוטה.
- עצות מעשיות: תחושה שה-AI נותן הכוונה קונקרטית יותר מהמבוגרים בסביבתם.
ובמקביל, סקר לאומי של Thorn — ארגון ללא מטרות רווח לשלום ילדים ברשת — מצא ש-67% מהילדים בגילאי 9-17 בארה"ב כבר השתמשו בצ'אטבוט AI. מתוכם, כ-15% מהילדים שחוו אינטראקציה מינית ברשת אמרו שפנו לצ'אטבוט AI לקבלת תמיכה או הכוונה אחרי האירוע — במקום למבוגר.
Amanda Goharian, מנהלת המחקר ב-Thorn, הסבירה את הסיבה: "זה פרטי. זה תמיד זמין. אין את הקושי של לחשוף משהו בפני מישהו שעלול להתאכזב או להיבהל."
מה זה אומר על התעשייה
אז מה בעצם קרה כאן? שלושה דברים בו-זמנית:
אחד — הצ'אטבוטים החדשים באמת מספקים חוויה מותאמת ואמפתית יותר מהדור הישן. זה לא סתם באזז.
שניים — אין עדיין מספיק ראיות שהחוויה הזו מתורגמת לבטיחות או לערך קליני אמיתי. ה-UX טוב; ה-Outcomes לא ברורים.
ושלוש — מיליוני צעירים כבר משתמשים בכלים האלה כקו ראשון לתמיכה רגשית, הרבה לפני שהמסגרת הרגולטורית או המחקרית סגרה את הפערים.
לחברות כמו OpenAI, Anthropic ו-Google יש מנגנוני הגנה משופרים על אובדנות — אבל כמעט כל תחום אחר עדיין פרוץ. וזה קורה בזמן שצעירים, במיוחד מרקע LGBTQ+ ומיעוטים, כבר מפנים את הרגשות הכי קשים שלהם למודלי שפה שלא יודעים להגיד "עצור, אני לא מוסמך לענות על זה."
במצב הנוכחי, צ'אטבוטים לבריאות הנפש הם כמו רופא עם יחסי אנוש מעולים ותעודות מזויפות — נחמד לדבר איתו, אבל אולי עדיף לא לסמוך על מה שהוא רושם.