מודלי GPT-5.6 חוסכים 82% בעלויות פיתוח
OpenAI משיקה את משפחת GPT-5.6 עם שלושה מודלים (Sol, Terra ו-Luna), שנכנסים ישירות ל-Kiro, סוכן הפיתוח של AWS. הבדיקות מראות חיסכון של 82% בעלויות פיתוח קוד — ובמקביל, Meta ו-SpaceXAI משחררות מודלים מתחרים עם תמחור אגרסיבי. קבלת ההחלטות בארגונים עוברת יותר ויותר מה-CTO ל-CFO, וזה משנה את כללי המשחק.

OpenAI הכריזה רשמית על משפחת המודלים GPT-5.6, והיא כבר זמינה ב-Kiro — סוכן הפיתוח של AWS שמיועד לעבודת קוד בסקייל. אם אתם עובדים על פרויקטי פיתוח עם AI, העדכון הזה רלוונטי במיוחד: שלושה מודלים חדשים (Sol, Terra ו-Luna) נכנסים ישירות לתוך ה-workflows שלכם — משלב התכנון דרך ה-build, ה-review והבדיקות.
אז מה בעצם קרה כאן?
השורה התחתונה היא יעילות במחיר. לפי בדיקות שבוצעו ב-Kiro על Terminal-Bench 2.1, מודל Terra השלים בהצלחה משימות עם חיסכון של כ-82% בעלויות. סם אלטמן, מנכ"ל OpenAI, ציין בראיון ל-CNBC שהמודל הבכיר Sol יעיל ב-54% יותר מבחינת צריכת טוקנים במשימות agentic coding — נתון משמעותי כשמבינים שכל טוקן חוסך כסף אמיתי בסוף החודש.
שלושה מודלים, שלוש רמות מחיר
המשפחה החדשה מגיעה בשלוש דרגות:
- Sol — הדגם הבכיר: 5 דולר לקלט ו-30 דולר לפלט למיליון טוקנים
- Terra — מאוזן: מחצית ממחירו של Sol
- Luna — חסכוני: דולר אחד לקלט ו-6 דולר לפלט למיליון טוקנים
מדובר במחירים תחרותיים באופן משמעותי מול מה שהיה מקובל עד לאחרונה, וזה לא קורה בחלל ריק.
המרוץ לעלות-תועלת
OpenAI לא לבד. Meta עדכנה השבוע את מודל Muse Spark שלה למשימות coding ו-agentic — עם תמחור "אגרסיבי מאוד", לדברי מנהל ה-AI הראשי שלה (1.25 דולר לקלט, 4.25 דולר לפלט למיליון טוקנים, כולל קרדיט של 20 דולר למשתמשים חדשים). SpaceXAI של אילון מאסק שחררה את Grok 4.5, וגם שם הדגש הוא על מהירות ויעילות טוקנים.
מי מחליט עכשיו בפנים?
לפי אנליסטים של JPMorgan Asset Management, מקבלי ההחלטות בנושא AI בארגונים עוברים מה-CTO ל-CFO — כלומר, יותר ויותר CFOs מתערבים בהחלטות השימוש ב-AI. "צריך לנהל את העלויות, לא פשוט לתת לכולם להשתמש כמה שרוצים", אמר טאי הוי, האסטרטג הראשי של JPMorgan לאזור אסיה-פסיפיק.
נתוני Sensor Tower מראים ששוק ה-AI בתשלום חזק במיוחד ב-coding: Anthropic מפיקה הכנסה חודשית של כ-$2.76 למשתמש, לעומת $1.76 אצל OpenAI. נתח השוק של ChatGPT ירד לכ-46% במאי האחרון, כשאלטרנטיבות כמו Claude צומחות.
מה זה אומר לכם?
עבור צוותי פיתוח, Kiro מאפשר לקחת רעיונות ברמת מוצר ולהפוך אותם לתוכניות מימוש מסודרות, לעבוד על משימות קוד מורכבות עם יותר עקביות, ולבדוק נכונות באמצעות property-based testing — הכול עם קונטקסט מה-repository שלכם.
ה-NDA לא מאפשר לדעת מה יקרה ב-sprint הבא, אבל אם המחיר לטוקן ימשיך לרדת ככה — אולי סוף סוף ה-CFO יפסיק לנשום לכם בעורף.