חוק ה-AI האירופי מאלץ את OpenAI להוסיף סימני מים ל-ChatGPT
OpenAI מתחילה לסמן טקסטים שנוצרו ב-ChatGPT וב-Codex באיחוד האירופי כדי לעמוד בחוק ה-AI החדש. הסימון באמצעות textGrain אינו מושלם – הוא פחות אפקטיבי בטקסטים קצרים, במתמטיקה או אחרי עריכה ידנית. גם Anthropic ביצעה מהלך דומה לאחרונה, והגישה לכלי הזיהוי מוגבלת כרגע לחוקרים.

אז מה בעצם קרה כאן? הלחץ הרגולטורי באירופה מתחיל להשפיע על חברות ה-AI הגדולות. OpenAI הודיעה שתוסיף סימני מים בלתי נראים לטקסטים שנוצרים ב-ChatGPT וב-Codex (כלי התכנות שלה) עבור משתמשים באיחוד האירופי. המהלך נועד לציית לחוק ה-AI החדש של האיחוד, שמחייב לזהות בבירור תכנים שנוצרו על ידי מודל AI.
הטכנולוגיה, שנקראת textGrain, עובדת על ידי הוספת אות סטטיסטי לבחירת המילים של המודל. זה מאפשר לכלי זיהוי ייעודיים לזהות טקסטים שמגיעים מ-OpenAI. החברה מציינת שהביצועים טובים יותר מגישות אחרות שנבחנו, אבל יש מגבלות משמעותיות שחשוב להכיר.
איפה זה עובד פחות טוב? קודם כל, בטקסטים קצרים. לדוגמה, בבדיקות של OpenAI, בשיעור שלילי כוזב של 1%, הם זיהו סימני מים ב-80% מהפסקאות של 200 טוקנים (יחידת תפוקה של מודל), לעומת 95% בפסקאות של 400 טוקנים. במתמטיקה, שבה בחירת המילים פחות גמישה, שיעורי הזיהוי נמוכים יותר. שנית, עריכה ידנית מפחיתה את היעילות: החלפת 10% מהמילים במילים נרדפות הורידה את שיעור הזיהוי מ-92% ל-66%, והחלפת 25% הורידה אותו ל-17%. כלומר, אם מישהו מעתיק טקסט AI ועורך אותו קצת, קשה הרבה יותר לתפוס אותו.
המהלך של OpenAI מגיע חודשיים אחרי ש-Anthropic ביצעה צעד דומה, גם בתגובה לחוק ה-AI של האיחוד. כרגע, OpenAI תספק גישה לכלי הזיהוי רק לחוקרים וארגונים מאושרים, כדי להעריך את האמינות. עבור משתמשי API ברחבי העולם, הפיצ'ר יהיה אופציונלי.
בסופו של דבר, בעולם שבו כל אחד יכול לערוך טקסט בקלות, ייתכן שסימני המים האלה יישארו יותר הצהרה מאשר כלי מעשי מושלם.