DeepSeek: מודל חדש זול פי 105 מהמתחרים
DeepSeek שחררה מודל קידוד חדש שעולה 3 סנט למשימה — זול פי 105 מ-Claude של Anthropic. המחיר הנמוך מגיע עם שיעור הזיות גבוה (84%), ובמקביל אליבאבא השיקה מודל ענק עם 2.4 טריליון פרמטרים. תעשיית ה-AI נכנסת למלחמת מחירים שתשנה את השוק כולו.

אז עכשיו זה רשמי: ה-AI הופך למוצר זול, מאוד זול. ביום שישי שחררה DeepSeek את V4 Flash, מודל קידוד חדש שמבצע משימות מורכבות תמורת סנטים בודדים. כמה סנטים? לפי בדיקות של Artificial Analysis, משימה ממוצעת עולה 3 סנט. לשם השוואה, Claude Fable 5 של Anthropic עולה 3.15 דולר. כן, פי 105 יקר יותר. וגם אם משווים ל-Claude Opus 4.8, ההפרש מזעזע לא פחות: DeepSeek גובה בערך 28 סנט על הפלט ש-Claude גובה עליו 25 דולר — 99% הנחה.
הסערה הזו לא חדשה
DeepSeek היא אותו סטארטאפ סיני שהבעיתה את השווקים בינואר אשתקד, כשהראתה שאפשר לבנות מודל ברמה עולמית עם הרבה פחות משאבים מהמתחרים האמריקאים. עכשיו היא חוזרת עם V4 Flash, שביצועיו על משימות קידוד מורכבות הם כמעט ברמה של הטובים ביותר. ב-Arena.ai, למשל, הוא הופיע לראשונה מעל לגרסת Opus הקרובה אליו — ועם יחס עלות-תועלת שאין שני לו בתחום שלו.
אליבאבא לא נשארת מאחור
במקביל, ענקית הטכנולוגיה הסינית אליבאבא הכריזה על Qwen3.8-Max — המודל הגדול ביותר שלה עד כה, עם 2.4 טריליון פרמטרים. זה קצת פחות מה-Kimi K3 של Moonshot (2.8 טריליון), אבל עדיין נתון שמספיק להרים גבה. המודל משתמש בארכיטקטורת mixture-of-experts, כך שרק 95 מיליארד פרמטרים פעילים בכל בקשה — מה שמוריד עלויות וזמן תגובה. הוא מסוגל לעבד עד מיליון טוקנים בבת אחת (מסמכים משפטיים שלמים, בסיסי קוד ענקיים), וישוחרר בשבוע הבא באמצעות פלטפורמת Model Studio.
ההודעה של אליבאבא מדגישה שהמאבק הסיני עבר מהשלב של ״מי יותר חכם״ לשלב של ״מי נותן את התמורה הטובה ביותר למפתחים״. פרסום מספר הפרמטרים וארכיטקטורות פתוחות הפך לכלי שיווקי — בניגוד ל-OpenAI, ל-Anthropic ולגוגל, ששומרות את הפרטים לעצמן.
לא רק DeepSeek: מלחמת מחירים כוללת
המהלך של DeepSeek מגיע שבוע אחרי ש-OpenAI הורידה מחירים ב-80% על GPT-5.6 Luna, וגוגל שחררה שלושה מודלי Flash חדשים עם דגש על יעילות. גם SpaceXAI (לא, לא טעות הקלדה — כך הם קוראים לעצמם) שחררה את Grok 4.5 במחיר התחלתי שהזכיר את המחיר המקורי של Luna. Meta, לעומת זאת, הפתיעה עם Muse Spark 1.1, מודל סגור אך זמין לשימוש חופשי — מהפך בעמדה שבה תמכה במשך שנים בקוד פתוח.
אז מה בעצם קורה כאן? כשמוצר הופך לסחורה, הקונים מפסיקים לשאול מי יצר אותו — הם פשוט משווים מחירים. ה-AI הולך לכיוון הזה מהר מאוד, והפער בין המודלים הבכירים מצטמצם כל הזמן. ״בשלב מסוים, המודל הבא כבר לא משנה לכם״, אומר זאק קאס, לשעבר ראש מחלקת ה-go-to-market ב-OpenAI, וקורא לזה ״התשואות הפוחתות של המודלים״.
הבעיה: זול זה לא אותו דבר כמו טוב
רגע, לפני שאתם ממהרים לעבור ל-V4 Flash — יש קאץ׳. Forbes מזהיר שלפי מבחני Artificial Analysis, הדיוק של V4 Flash עומד על 37% בלבד, ושיעור ההזיות (hallucinations) מגיע ל-84%. כלומר, הוא עולה מעט, אבל הוא עלול להמציא תשובות בצורה מפחידה. זה אומר שמי שמשתמש בו לעבודה אמיתית יצטרך להשקיע זמן בבדיקת הפלט, לתקן שגיאות ולנהל סיכונים — והעלות הזו לא מופיעה בחשבונית.
סקר של Upwork משנת 2024 מצא ש-77% מהעובדים שמשתמשים ב-AI מדווחים שהכלים האלה דווקא הפחיתו את הפרודוקטיביות שלהם והגדילו את עומס העבודה. אז אולי המחיר הנמוך הוא רק ההתחלה של ההוצאות האמיתיות.
הצעד הבא: סוכנים
DeepSeek לא עוצרת במחיר. היא החלה להזמין מפתחי קוד פתוח לבדוק את DeepSeek Harness — כלי שהופך מודל שפה לסוכן אוטונומי המסוגל לבצע משימות רב-שלביות. זהו מהלך ששם את החברה בזירה החמה ביותר בתעשייה כרגע: agentic AI. הצוות, בראשות Cui Tianyi שהצטרף במרץ, מודה שהוא סובל מתת-כוח אדם אבל רעב להוכיח את עצמו.
אז מה זה אומר לנו?
המסקנה המעשית: אם אתם בעסק הזה, המחירים של ה-AI ימשיכו לרדת — אבל תקבלו בדיוק מה שתשלמו עליו. נצלו את המלחמה כדי לחסוך, אבל לעולם אל תוותרו על בדיקת איכות. בסוף, העלות האמיתית של AI היא לא רק במודל — היא בזמן שתבזבזו להפריד את ה-S מהלכלוך.