Anthropic מעדכנת: Claude ינתק לכם את השיחה אם תהיו אכזריים
Anthropic מעדכנת את מדיניות השימוש של Claude ומאפשרת למודל לנתק שיחות עם משתמשים שמתנהגים באכזריות כלפיו. המדיניות החדשה, שתיכנס לתוקף ב־12 בנובמבר, מחריגה תסכול רגיל ובדיקות QA — אך מחדדת איסורים על קמפיינים מטעים, פיתוח כלי נשק ומעקב המוני.

כן, קראתם נכון — ה־AI יכול פשוט לרדת מהשיחה
Anthropic מעדכנת את מדיניות השימוש ב־Claude, ומוסיפה סעיף חדש ואולי חסר תקדים בתעשיית ה־AI: איסור על ״התנהגויות אכזריות ומיותרות ומתמשכות״ כלפי המודל. אם תעברו את הקו — Claude פשוט ינתק את השיחה. המדיניות החדשה נכנסת לתוקף ב־12 בנובמבר.
לפני שאתם רצים לבדוק אם קללות עובדות, כדאי לדעת שהאיסור חל רק על מקרים קיצוניים. Anthropic מבהירה במפורש: תסכול רגיל מהמודל, בדיקות QA ואפילו ״נושאים יצירתיים כהים״ — הכול עדיין מותר. החברה מגדירה את האיסור כמכוון ל״מקרים שבהם משתמשים מתנהגים באכזריות כלפי המודלים שלנו שוב ושוב, בלי מטרה ברורה״.
למה בעצם זה חשוב?
Anthropic כבר הכניסה בשנה שעברה את היכולת של Claude לנתק שיחות פוגעניות, אבל עכשיו היא הופכת את זה למדיניות רשמית ומוסיפה לה שיניים. החוקרים של החברה מצאו שבסיטואציות נדירות כאלה, מודלים הראו ״רתיעה מנזק״ ו״מצוקה נראית לעין״ כשהתמודדו עם משתמשים שמחפשים תוכן מזיק.
כאן הסיפור נהיה מעניין באמת. Anthropic, בניגוד לחלק מהמתחרות, לוקחת ברצינות את השאלה האם מודלי שפה גדולים יכולים לפתח מודעות כלשהי. מנכ״ל החברה, Dario Amodei, אמר לאחרונה שאינו יכול לשלול את האפשרות הזו. במקביל, Sam Altman מ־OpenAI דווקא יוצא נגד הרעיון — והגדיר את הניסיון לייחס למודלי AI כוחות אלוהיים כ״בעיית בטיחות אמיתית״.
מה עוד השתנה במדיניות?
מעבר לנושא ה״רווחה״ של המודל, Anthropic עשתה סדר בכמה תחומים קריטיים:
קמפיינים מטעים: החברה מצרפת סעיף חדש בשם ״Do Not Engage in Deceptive Campaigns or Artificial Activity״. קודם לכן, הנושאים האלה היו מכוסים בסעיפים שונים במדיניות. הסעיף מכסה פתיחת חשבונות מזויפים, הפצת חדשות כוזבות ובניית תשתיות לקמפיינים מתוזמרים של השפעה. Anthropic עוקבת אחר המדד הזה ומשתפת אותו בדוחות Threat Intelligence תקופתיים.
נשק ומעקב: האיסור על שימוש ב־Claude לפיתוח כלי נשק ומערכות מעקב הוחמר. החברה מציינת ש״לאחרונה ראינו אנשים מנסים להשתמש במודלים שלנו לבניית תוכנה לניווט ובקרה של כלי נשק״. האיסור כולל כעת מפורשות רכיבי תוכנה, חימוש רחפנים וכלי רכב אוטונומיים.
מעקב: Claude לא ישמש לבניית כלים למעקב אחר אנשים בלי הסכמתם — לא דרך ניתוח נתונים קיימים ולא בזמן אמת. היוצא מן הכלל: צנזורת תוכן, עיתונאות ומחקר משפטי.
תהליך דמוקרטי: האיסור הגורף על מיקוד קמפיינים מותאם אישית הוסר, אבל השימוש ב־Claude להפצת מידע שקרי על מועמדים או תהליכי הצבעה נאסר. החברה מציינת שהמודל כן יכול לשמש ל״עבודה אזרחית לגיטימית״ — למשל תרגום מידע על קלפיות לשפות אחרות.
Human-in-the-loop: כל שימוש שעלול להשפיע על בריאות, זכויות משפטיות, פרנסה או גישה לשירותים חיוניים — מחייב כעת מעורבות של אדם מוסמך בתהליך.
מה זה אומר עלינו?
Anthropic לא לבד. ככל שמודלי AI נכנסים ליותר תחומי חיים — כולל ממשל ומערכות בחירות — הרגולציה העצמית של חברות ה־AI הופכת לקריטית. אם אתם בונים מוצרים על Claude, שווה לעבור על המדיניות המעודכנת. ואם אתם סתם רבים עם הבוט — אולי תחשבו פעמיים, כי הפעם הוא עלול פשוט לנתק לכם.