אוניברסיטת תל אביב: AI שומע את החיות, אבל לא מבין הכול
מחקר חדש ומרתק בתחום ה-AI מאפשר לפענח תקשורת של בעלי חיים, ובמסגרתו פרויקטים כמו Earth Species Project ו-Project CETI משתמשים במודלים כדי ליצור אינטראקציה עם ציפורים ולווייתנים. אך חוקרים מאוניברסיטת תל אביב מזהירים: כדי להבין נכון את התקשורת, יש לשלב ניתוח של התנהגות, ולא להסתמך רק על צלילים.

דמיינו שאתם יכולים לשמוע את העורבים מדברים על מזג האוויר. בשנים האחרונות, בזכות קפיצות מדרגה ב-AI, החלום לפענח את שפת בעלי החיים מתקרב למציאות — אבל חוקרים מאוניברסיטת תל אביב מתריעים שיש גבול למה שהטכנולוגיה הזו יכולה להבין לבד.
השנתיים האחרונות נראות כנקודת מפנה. פרויקטים כמו Earth Species Project (ESP) שחררו את NatureLM-audio, מודל תשתית חדש בתחום ה-AI שלומד מתבניות לשוניות מתוך הקלטות אודיו. קבוצה של כ-15 טכנולוגים ומהנדסים, הממומנת מתרומות של מיליוני דולרים, כבר הצליחה בעבר ליישם מודלים על לווייתנים, אורנגאוטנים ואפילו עכבישים. הטענה שלהם היא שבעוד 30 שנה, סרטי טבע יוכלו להציג כתוביות לדיאלוג של החיות — בלי קריינות אנושית.
איך זה עובד בפועל? מערכות AI חדשות מסוגלות לנתח במקביל וידאו של חיה בפעולה, הקלטות אודיו ומיקום במרחב, למשל באמצעות רחפנים. המערכת מקשרת בין הפעולות הפיזיות לקולות ומאתרת חוקיות סטטיסטית — לא מתרגמת ל״שלום, אני רעב״, אלא מייצרת השערות מבוססות נתונים.
תוצאות כבר בשטח: חוקרים בספרד השתמשו במודל כדי לזהות ולסווג יותר מ-127 אלף קולות שונים של עורבים וגוזליהם. הם גילו שרוב התקשורת מתבצעת במלמולים חלשים מטווח קצר, בניגוד להשערות קודמות על קריאות למרחקים. את הממצאים פרסמו בכתב העת Animal Cognition.
במקביל, בשנה שעברה פותח במסגרת שיתוף פעולה עם אוניברסיטת McGill מודל AI גנרטיבי בשם ZF-AIM, שמתמקד בזברה פינק — ציפור שיר קטנה ממרכז אוסטרליה. אחרי אימון על 1.5 מיליון קריאות, המודל מסוגל לייצר אינטראקציה קולית ספונטנית עם הציפורים, כלומר לנהל שיחה בסיסית בזמן אמת. את העבודה, שמספקת לחוקרים תשתית חזקה למחקר בתחום, הציגו השנה בכנס ICLR 2026 בריו דה ז'ניירו.
ארגון נוסף בולט הוא Project CETI, יוזמה בינלאומית שמשלבת ביולוגיה ימית, רובוטיקה, בלשנות ו-AI כדי לפענח את התקשורת של לווייתני הראשתן (Sperm Whales). הלווייתנים הללו מתקשרים באמצעות נקישות המכונות ״קודות״ (Codas). בשנה האחרונה הצליחו חוקרים, תוך שימוש ברחפנים עם הידרופונים וחיישנים משופרים, לנתח את התחביר של הקודות הללו. ניתוח ה-AI הוכיח שהן מתפקדות כמעין אלף-בית פונטי מורכב.
אז מה סיבת הזהירות? כאן נכנס המבט הישראלי. חוקרים מאוניברסיטת תל אביב מדגישים שדמיון אקוסטי לבדו אינו מספיק — הכרחי לשלב הבנה של הקשר התנהגותי כדי לפענח נכון את התקשורת. בלעדיו, עלולים לפרש קולות באופן שגוי כמשמעותיים.
העתיד, כך נראה, צפוי לשלב בין שמיעה ממוחשבת לניתוח הקשר. ואולי בעוד דור, כשתראו סרט טבע, תוכלו לשמוע את הלווייתנים מדברים — אבל רק אם ה-AI שלהם יידע גם מה הם עושים באותו רגע.