AI + AGENT'S LAST EXAM

    ידיעות בינה מלאכותית בנושא AGENT'S LAST EXAM

    מחקר: אף מודל AI לא עובר רבע ממשימות העבודה

    מחקר מקיף של אוניברסיטת ברקלי בחן למעלה מ-1,500 משימות מקצועיות אמיתיות מ-55 תחומים שונים. הממצאים מראים ששום מודל AI, כולל המתקדמים ביותר, לא הצליח לבצע אפילו רבע מהן. במשימות המורכבות ביותר כל המודלים נכשלו לחלוטין, מה שמוכיח שה-AI הנוכחי עדיין רחוק מלהחליף עובדים אנושיים בתפקידים שדורשים קבלת החלטות גמישה בעולם האמיתי.

    מחקר: אף מודל AI לא עובר רבע ממשימות העבודה