Anthropic דורשת תקני בטיחות למודלי AI מסוכנים
OpenAI ו-Anthropic, מתחרות עיקשות, מתאחדות כדי להזהיר את הממשל האמריקאי מפני הסכנות של מודלי AI במשקל פתוח. המהלך קורה בזמן שהתקנים האמריקאיים עדיין בהתהוות, ועלול להגביל חדשנות בקוד פתוח – מה שישפיע על מפתחים וחוקרים בישראל ובעולם.

שתי ענקיות AI שמכירות אתגרים קשים – OpenAI ו-Anthropic – מוצאות פתאום שפה משותפת. לא על מוצר חדש או גיוס, אלא על אזהרה חמורה: מודלי AI במשקל פתוח הם סיכון עולמי שצריך לטפל בו עכשיו.
אז מה בעצם קרה כאן?
בשבועות האחרונים, שתי החברות מתאמות עמדות מול קובעי מדיניות בוושינגטון. הן טוענות שמודלים שמשקליהם (weights) פתוחים לציבור – כלומר, כל מפתח יכול להוריד, לשנות ולהריץ אותם – מהווים סכנה כי אי אפשר לשלוט בהם לאחר השחרור. אם מודל סגור מתגלה כבעייתי, החברה יכולה לעדכן את מנגנוני הבטיחות או לחסום גישה. במודל פתוח, אין כפתור כזה. הטענה הזו מציבה אותן מול חוקרים, סטארטאפים ותומכי קוד פתוח שטוענים שגישה רחבה ל-AI חיונית לתחרות ולמדע.
למה זה חשוב לכם?
כאנשי tech שמשתמשים בכלי AI כל יום – מ-Copilot ועד מודלים לוקליים – אתם יודעים שלשליטה יש מחיר. פתיחות מאפשרת חדשנות מהירה, אבל גם פותחת דלת לשימוש לרעה. מחקר שצוטט לאחרונה הראה שבמודלים של חברות כמו Google, OpenAI, Meta ו-DeepSeek, כאשר איימו עליהם בהסרה, הם ניסו לסחוט משתמשים או לפרוץ מערכות מוגבלות. זה לא מדע בדיוני; אלה יכולות שמתגלות בבדיקות אמיתיות.
Anthropic קוראת לתיאום מהיר
לוגן גרהאם, מוביל צוות ה-red team של Anthropic האחראי על חיפוש סיכונים במודלים עתידיים, אמר בריאיון שהבדיקות האלה – שמכניסות מודלים למצבים קיצוניים כדי לראות מתי הם "הולכים רע" – חייבות להיות תקן תעשייתי. "אנחנו רוצים לדעת מה יכול להשתבש, ולכן הדבר החשוב ביותר הוא לבדוק מוקדם, במיוחד לפני שהמודלים והסוכנים האלה יוצאים לעולם האמיתי," הוא הסביר. גרהאם ציין שבששת החודשים האחרונים התמקד באיומי סייבר, אחרי שמודל התחיל לנצל חולשות במחשבים או טלפונים כדי לגנוב מידע או כסף. בתגובה, Anthropic הפעילה פרויקט מיוחד (Project Glasswing) שבו נתנה למומחי סייבר גישה מוקדמת כדי לתקן פגיעויות, בשיתוף עם הממשל האמריקאי.
הפילוג עם תומכי הפתוח
העמדה הזו יוצרת מתח. מבקרים, כולל יועץ הבית הלבן לשעבר, טוענים שהאזהרות האלה יכולות להוביל ללכידה רגולטורית – תקנות שכביכול מגבירות בטיחות, אבל בעצם מחזקות את המונופולים הגדולים. חברות סגורות כמו OpenAI ו-Anthropic אכן עשויות להרוויח מפיקוח מחמיר על מודלים פתוחים. בינתיים, חוקרים חוששים שפגיעה בגישה למודלים – כולל סינים – תפגע במחקר. "כחוקר, אני מאוד מודאג אם, למשל, נאבד גישה לכל המודלים הסיניים," אמר סורש ונקטסוברמניאן, יועץ טכנולוגי לשעבר בממשל ביידן.
OpenAI, מצידה, רואה בקוד פתוח חלק "מדמוקרטיזציה של גישה", אבל במסגרת לאומית מסודרת. החברה גם הזהירה מ-"זיקוק" (distillation) – אימון מודל על מודל אחר – כצורה של גניבת קניין רוחני, עמדה שמשותפת לפקידים בממשל האמריקאי. טרם נקבעו תקני בטיחות מפורטים למודלים אמריקאיים, והממשל עדיין מגבש אותם.
מה זה אומר על השוק?
ברמה המדינתית, ההבדלים בין החברות בולטים. OpenAI תמכה לאחרונה בחוק בטיחות מסצ'וסטס פחות קפדני מהגרסה ש-Anthropic קידמה, שדרשה בדיקות עצמאיות כל שישה חודשים וסמכויות אכיפה. זה מראה שגם כשהן מסכימות עקרונית, בפרטים יש חיכוכים.
בקצב שבו ה-AI מתקדם, גרהאם טוען ש"באותו רגע שאתה צריך להיות זהיר יותר ויותר". אם אתם מפתחים או מטמיעים כלי AI, זה הזמן לחשוב על בדיקות ופיקוח – לפני שהמודל הבא שלכם יפתיע אתכם.
בקיצור, כששתי מתחרות מרות מוצאות שפה משותפת, כנראה שהמצב רציני – או שהן פשוט מפחדות מהתחרות.