מחקר Pew: יותר משליש מדפי האינטרנט החדשים מראים סימני AI
מחקר חדש של Pew Research חושף ש-35% מהדפים שפורסמו באינטרנט מאז השקת ChatGPT מראים סימנים ברורים לכך שנכתבו באמצעות AI. המחקר התבסס על ניתוח של קרוב ל-500,000 דפי אינטרנט. הפער בולט במיוחד בדומיינים מסחריים (.com), שבהם השיעור גבוה פי עשרה מזה שבאתרים ממשלתיים או אקדמיים.

שליש. זה שיעורם של דפי האינטרנט החדשים שפורסמו מאז השקת ChatGPT, ומראים סימנים ברורים לכך שנכתבו או נערכו בצורה משמעותית באמצעות בינה מלאכותית. כך עולה ממחקר חדש ומקיף של מרכז המחקר Pew Research Center, שפורסם ביממה האחרונה, והוא מצטרף לנתון מדהים נוסף: אולי אתם זוכרים ש-Cloudflare דיווחה לאחרונה שתעבורת הבוטים ברשת עקפה את תעבורת הגולשים האנושיים. עכשיו מתברר שגם התוכן שהם קוראים נכתב לעיתים על ידי בוטים אחרים.
החוקרים בחנו, באמצעות כלי זיהוי AI בשם Open Pangram, קרוב ל-500,000 דפי אינטרנט באנגלית מתוך ארכיון האינטרנט Common Crawl, מסוף 2020 ועד לאחרונה. במדגם אקראי של 10,000 דפים מיולי 2026, כ-10% הראו סימנים משמעותיים לכתיבת AI. אבל — וזה אבל גדול — המדגם הזה כלל גם דפים ישנים יותר, מלפני עידן ה-AI היצרני.
כשסיננו החוקרים את הדפים שפורסמו אך ורק לאחר נובמבר 2022 (מועד השקת ChatGPT), המספרים קפצו דרמטית: 35% מהדפים הללו הראו סימנים ברורים לכתיבת AI. זה כבר נתון שאי אפשר להתעלם ממנו.
איפה נכתב כל התוכן הזה?
כאן נכנס הפיצול המעניין: דומיינים בעלי הסיומת .com הם בעלי הסיכוי הגבוה ביותר להכיל תוכן שנכתב באמצעות בינה מלאכותית — בשיעור הגבוה פי עשרה מזה שבדומיינים אקדמיים (.edu) או ממשלתיים (.gov), שבהם רק כ-1% מהתכנים נושאים סימנים כאלה. סיומת .org נמצאת איפשהו באמצע, עם 4.6%.
מה אנחנו יכולים לקחת מפה?
- הכלים האלה לא מושלמים. כלי זיהוי ה-AI עלולים לטעות. אבל בכמות הזו — מאות אלפי דפים — הכיוון הכללי כנראה נכון.
- האינטרנט הופך לשדה ניסוי. אם אתם עוסקים ביצירת תוכן, בקידום או אפילו במחקר — אתם כבר מתמודדים עם מציאות שבה חלק גדול ממה שאתם קוראים אינו אנושי לגמרי.
ונקודה למחשבה, כמעט היתולית, מהמחקר: החוקרים מצאו שימוש מוגבר במקפים ארוכים (em dashes), בפסיק אוקספורד ובביטויים בנוסח "זה לא X, זה Y". עכשיו שימו לב למאמרים שאתם קוראים.