Claude מוביל 26% ממחקר ופיתוח ה-AI
Anthropic מפרסמת שלושה מדדים לניטור קצב פיתוח AI, כולל מדד שלפיו Claude מוביל 26% מעבודת המו״פ בחברה. הצעד מגיע לאחר קריאתו של המנכ״ל דריו אמודיי להאטה מתואמת בתעשייה, והוא כולל גם פיקוח על 30,000 סוכני AI פעילים כדי למנוע מעבר ל-AI אוטונומי מדי.

Anthropic, החברה שפיתחה את Claude, החליטה לחשוף כמה מהר ה-AI שלה מתקדם במחקר ופיתוח – ולמה זה חשוב לכם. בעולם שבו מודלים מתקדמים משפרים את עצמם, הפער בין מה שהמעבדות יודעות לבין מה שהציבור מבין עלול להיות מסוכן. אז Anthropic פרסמה שלושה מדדים חדשים לניטור קצב פיתוח ה-AI, מתוך רצון להגביר שקיפות ולהגיב לקריאתו של המנכ״ל דריו אמודיי להאטה מתואמת בתעשייה.
מה בעצם Anthropic מודדת?
המדד הראשון מתמקד במחקר ופיתוח בהובלת AI – כלומר, כמה מעבודת המחקר והפיתוח בתחום ה-AI נעשית על ידי Claude עצמו. Anthropic מצאה ש-Claude מוביל 26% מעבודת המו״פ שלה, מה שאומר שהוא מסוגל להשלים משימות מקצה לקצה עם פקודה ברמה גבוהה, בעוד אדם מפקח עליו. זה נתון מדהים בהתחשב בקצב השינויים. בנוסף, הם מדווחים ש-AI מבצע לפחות חלקים גדולים מהעבודה המחקרית שלהם ביותר מ-90% מהמקרים, כולל אותם 26% ש-Claude מוביל. בקיצור, ה-AI כבר נוגע ברוב העבודה שעובדי Anthropic מבצעים.
פיקוח על סוכנים ומשאבי מחשוב
המדד השני עוסק בפיקוח על פעולות של סוכני AI. Anthropic בנתה מערכת לניטור והתערבות בפעולות של סוכנים, וגילתה שבכל רגע נתון כ-30,000 סוכנים עוסקים בעבודת מחקר והנדסה בפלטפורמה הפנימית ביותר שלה. הסיכון הוא שנעבור משלב שבו ה-AI משתף פעולה עם בני אדם לשלב שבו הוא מוביל – ומקבל החלטות משמעותיות יותר, כמו לאיזה כיוון לקדם את מחקר ה-AI.
המדד השלישי בודק הקצאת כוח מחשוב. Anthropic מדדה צילום מצב של השימוש בכל המחשוב שלה בין 13 ל-20 ביולי. כוח מחשוב הוא הדלק העיקרי של ה-AI, ולכן הבנה של האופן שבו הוא מוקצה עוזרת לראות לאן המאמצים מתמקדים ואיך זה משתנה עם הזמן. זה גם קל יחסית לאמת, מה שהופך אותו למדד מפתח לקצב הפיתוח העתידי.
למה זה קרה עכשיו?
היוזמה הזו מגיעה ימים ספורים לאחר שאמודיי פרסם מאמר שבו קרא לתעשיית ה-AI להאט את קצב שיפור המודלים המתקדמים. ההצעה שלו זכתה לתמיכה מהירה של בכירים כמו סם אלטמן מ-OpenAI, אילון מאסק מ-SpaceX ו-Demis Hassabis מ-Google DeepMind, אם כי מנכ״לי Nvidia ו-Meta התנגדו. ברקע, חוקרים כמו Evan Hubinger מ-Epoch AI הזהירו מפני סיכונים קיומיים מה-AI, מה שהוסיף דחיפות לדיון.
Anthropic מסבירה שהיא מודדת את המדדים האלה כי המעבדות המתקדמות נוטות להשתמש ב-AI עצמו כדי לפתח מודלים חזקים יותר, מה שעלול להוביל לכך שבני אדם לא יבינו עד כמה הם מסוכנים. הם מקווים ששקיפות כזו תקל על התגובה לפיתוח AI ללא שליטה, או לפחות תאפשר לציבור מבט ברור יותר.
מה זה אומר על התעשייה?
עבור חברות AI אחרות, המדדים האלה הם קריאה לשקיפות – Anthropic פרסמה את המתודולוגיה שלה כדי שארגונים אחרים יוכלו למדוד דברים דומים. זה גם עוזר לענות לקריאה של אמודיי להאטה מתואמת, עם תוכנית בשלושה שלבים שפורסמה בסוף השבוע. עדיין לא מדובר בהפסקה או דחייה של מודל ספציפי, וגם הבית הלבן כבר אמר לא להאטה ממשלתית כפויה.
משקיעים, לעומת זאת, הרגישו את הלחץ: מניות שבבי ה-AI ירדו בשבוע האחרון, עם SMH בירידה של 5.5% ו-SMHX ב-5.1%. אבל אף אחד לא מציע לקצץ בהוצאות או לעכב תוכניות משמעותיות, אז הירידה עשויה להיות זמנית.
סיכום
Anthropic מנסה להוביל בשקיפות, עם מדדים שמודדים כמה מהר ה-AI מתקדם ועד כמה בני אדם מעורבים. הנתון ש-Claude מוביל 26% מהמו״פ מראה שה-AI כבר חלק משמעותי בעבודה הפנימית שלהם. בינתיים, המדדים האלה הם רק צעד ראשון – השאלה האמיתית היא אם שאר התעשייה תצטרף למסיבה או שהכול ימשיך כרגיל.