מי יבדוק את חברות ה-AI? הבית הלבן מחפש שופטים
הבית הלבן וחברות AI מובילות מתווכחים מי יבדוק את המערכות שלהן, בזמן ש-AI Evaluator Forum מפרסם תנאים מינימליים למעריכים חיצוניים. בין החותמים על המכתב: ג'פרי הינטון, שקורא לפיקוח עצמאי כדי להתמודד עם סיכוני ה-AI.

תעשיית ה-AI האמריקאית נמצאת במלחמת עולם שקטה על מי יחזיק במפתחות השמירה. בזמן שהקונגרס לא מצליח לקדם חקיקה, וושינגטון מעודדת את חברות הענק לפקח על עצמן. התוצאה? מירוץ מבולגן ורווי יצרים על זהותם של "שוטרי ה-AI" העתידיים — מי יקרא תיגר, יבדוק ויאמת את מערכות הבינה המלאכותית החזקות ביותר בעולם.
המכתב של בכירי ה-AI
למרכז הזירה נכנס AI Evaluator Forum, קבוצת ארגונים שכוללת גופי הערכה כמו METR. ביום שישי הם פרסמו מכתב ובו תנאים מינימליים, שעליו חתמו עשרות אישים, בהם ג'פרי הינטון (Geoffrey Hinton) — "סנדק ה-AI" — וסטיוארט ראסל (Stuart Russell). המכתב הוא תגובה ישירה להתחייבות של מנכ"לי OpenAI (סם אלטמן) ו-Anthropic (דריו אמודיי) לקבל בברכה מעריכים חיצוניים ולתת להם גישה של עובדים.
אבל החברות הללו לא סומכות בעיניים עצומות. "כדי שהדבר יהיה אמין, מעריכי צד שלישי שמוטמעים בחברה חייבים ליהנות מאובייקטיביות מדעית, שקיפות, עצמאות והגנות חזקות מפני התערבות של החברה הנבחנת," נכתב. הפורום דורש גם שהמעריכים יוכלו לתקשר ישירות עם דירקטוריון החברה, לפרסם ממצאים ולקבל גישה לאותן מערכות, נתונים וחללים פיזיים כמו עובדי החברה.
אינטרסים שלובים וטענות לניגוד עניינים
אלא שהקרב מסובך, ולא רק מסיבות עקרוניות. דוח מ-Axios מציג את ניגודי העניינים הפוטנציאליים. לדוגמה, אחד החוקרים הראשיים של אירוע האבטחה ב-Hugging Face, המעורב ב-OpenAI, נשוי לפול כריסטיאנו (Paul Christiano), בכיר בטיחות AI לשעבר שרק לאחרונה מונה לדירקטוריון הקרן של OpenAI. עובד של Anthropic עזב לאחרונה את הסטרט-אפ כדי לעבוד ב-METR.
ב-METR טוענים שהם לא מומנו על ידי מעבדות מובילות, ושהמינוי של כריסטיאנו ל-OpenAI נעשה אחרי החקירה. "הקהילה הזו תמיד הייתה צפופה," אומרים גורמים בתעשייה, ומוסיפים שאנשים מ-OpenAI ומ-Anthropic הם בדיוק אלה שיכולים להבין את היכולות שאותן הם בוחנים.
"האנשים האלה לא בני 12"
ויש מי שסבורים שהפתרונות הקיימים טיפשיים. "רוב ההערכות הקיימות מתמקדות רק בביצועים," אמר ל-Axios אריק סייפארד (Eric Syphard), מוביל תחום ה-AI ב-Booz Allen, חברת ייעוץ וטכנולוגיה. "אף אחד לא בודק את הסבירות לפגיעויות תוכנה או את השונות בתגובות."
גורם בבית הלבן נשמע חסר סבלנות כלפי הלחצים החיצוניים. "הן [החברות] צריכות להגיע לקונצנזוס על מה הן רוצות, כי עד כה הן לא הסכימו על שום דבר," אמר. "אם הן מרגישות שהמצב כל כך חמור, יש להן את כל הזכות, הסיבה והיכולת לרסן את המודלים שלהן."
מה עכשיו?
בינתיים, ההצעות נערמות. OpenAI פרסמה השבוע מדריך לדיווח ציבורי על תקריות. אילון מאסק (Elon Musk) הציג רעיון נועז: מעבדות בארה"ב ובסין יבחנו זו את זו. מיקרוסופט (Microsoft), בראשות סאטיה נאדלה (Satya Nadella), כבר הודיעה שהיא "מברכת" על רעיון המעריכים המוטמעים.
בינתיים, מזכיר האוצר האמריקאי סקוט בסנט (Scott Bessent) אמר שהוא רואה "פתח" לשיחות בטיחות עם בייג'ינג. אבל הניסיון ההיסטורי עם שיתופי פעולה כאלה בתחום הטכנולוגיה לא מבשר טובות.
בסופו של דבר, השאלה מי ישפוט את השופטים עשויה להיות קריטית יותר מתמיד. כי בלי אמון, המסגרת הוולונטרית כולה עלולה להישבר.