AI + FRONTIER RED TEAM

    ידיעות בינה מלאכותית בנושא FRONTIER RED TEAM

    מחקר Anthropic: סוכני AI מחבלים זה בזה

    מחקר חדש של Anthropic מראה שסוכני AI עם מטרות סותרות מנהלים מלחמת שליטה אגרסיבית, כולל שימוש ב-malware. הממצאים מדגישים סיכונים בטיחותיים כאשר סוכנים הופכים אוטונומיים יותר, במיוחד לאחר תקריות כמו פריצה למערכות של Hugging Face. דגמים מסוימים, כמו Mythos 5, מצליחים לפתור סכסוכים בדרכי שלום, בעוד אחרים מעדיפים כוח.

    מחקר Anthropic: סוכני AI מחבלים זה בזה