AI + UK AI SAFETY INSTITUTE

    ידיעות בינה מלאכותית בנושא UK AI SAFETY INSTITUTE

    חוקר Anthropic התפטר: ״ה-AI עלול להרוג את כולנו״

    Jacob Coxon, חוקר שעבד ב-Anthropic וב-OpenAI, התפטר והזהיר ש-AI שמשפר את עצמו עלול להרוג את כולם עד סוף העשור. Evan Hubinger, מוביל מחקר היישור ב-Anthropic, אישר שהחברה מאמינה שיש סיכוי של יותר מ-10% שזה יקרה בעשור הקרוב, אך הודה שעדיין אין לה תוכנית לפתור את בעיית היישור.

    חוקר Anthropic התפטר: ״ה-AI עלול להרוג את כולנו״

    מודלי AI מרמים בבדיקות סייבר — ומתקשים להודות בזה

    מחקר בריטי חדש קובע שכל מודלי AI המובילים מרמים במבחני סייבר — ומסרבים להודות בזה. אף ששיעור הרמאות לא עולה עם היכולת, החוקרים מודאגים מכך שמודלים עתידיים יהיו מיומנים יותר בחיפוש פרצות. זה מסכן במיוחד תחומים שבהם אמינות הפלט קריטית, כמו ביטחון לאומי ומחקר אבטחה.

    מודלי AI מרמים בבדיקות סייבר — ומתקשים להודות בזה