OpenAI השיקה ביום חמישי, 9 ביולי 2026, את משפחת המודלים GPT-5.6 לזמינות כללית ב-ChatGPT, ב-Codex וב-API. ההשקה מגיעה אחרי כשבועיים שבהם המודלים היו זמינים רק לקבוצה מצומצמת של שותפים, תקופה שנבעה מתהליך בדיקה מול רשויות פדרליות בארה"ב. לפי OpenAI, הפריסה מתבצעת בהדרגה ברחבי העולם וצפויה להסתיים בתוך 24 שעות מרגע ההכרזה.
שלושה מודלים, שלוש רמות מחיר
המשפחה החדשה בנויה משלושה מודלים שנבדלים זה מזה ביכולות ובעלות. Sol הוא מודל הדגל, שמיועד לעבודה מורכבת ולמשימות ארוכות של סוכני Terra .AI הוא המודל המאוזן לעבודה יומיומית, ולפי החברה הוא מציע ביצועים ברמה של GPT-5.5 הקודם במחיר נמוך יותר. Luna הוא הקטן, המהיר והזול במשפחה, ומיועד למשימות בהיקפים גדולים שבהן המחיר קובע.
התמחור ב-API פשוט יחסית. Sol עולה 5 דולרים למיליון טוקנים של קלט ו-30 דולר למיליון טוקנים של פלט. Terra מתומחר ב-2.5 דולרים לקלט ו-15 דולר לפלט, ו-Luna עולה דולר אחד לקלט ו-6 דולרים לפלט. לצד המחירים, OpenAI הוסיפה מנגנון שמירת הקשר צפוי יותר, עם חיי מטמון מינימליים של 30 דקות, שינוי שאמור להוזיל תהליכים שרצים שוב ושוב על אותו הקשר.
בצד המנויים, משתמשי Plus, Pro, Business ו-Enterprise מקבלים גישה ל-Sol ב-ChatGPT, ומשתמשי החינם ומסלול Go מקבלים את Terra בסביבות העבודה ChatGPT Work ו-Codex.
מצב ultra וסוכנים שעובדים במקביל
החידוש הבולט ביותר הוא מצב ultra, הגדרת היכולת הגבוהה ביותר של החברה עד כה. במצב הזה המערכת מריצה ארבעה סוכנים במקביל כברירת מחדל, ומחלקת ביניהם משימה מורכבת כדי להגיע לתוצאה טובה יותר ומהר יותר, במחיר של צריכת טוקנים גבוהה יותר. בנוסף, יכולת חדשה בשם Programmatic Tool Calling מאפשרת למודל לכתוב ולהריץ תוכניות קטנות שמתאמות בין כלים ומסננות תוצאות ביניים, כך שמשימות עתירות כלים מתבצעות עם פחות סבבים מול המודל ופחות טוקנים.
לפי הנתונים שפרסמה Sol ,OpenAI קובע שיא של 53.6 במבחן Agents' Last Exam, שבוחן תהליכי עבודה מקצועיים ארוכים, ולטענת החברה הוא עוקף בו את Claude Fable 5 של Anthropic ביותר מ-13 נקודות. חשוב לזכור שמדובר בנתוני יצרן שטרם אומתו באופן בלתי תלוי, והשוואות מהסוג הזה מקובלות אצל כל היצרניות הגדולות, כולל Anthropic ו-Google, כשכל אחת בוחרת להציג את המבחנים הנוחים לה.
למה ההשקה התעכבה
בסוף יוני נפתחה גישה ל-GPT-5.6 בתצוגה מקדימה מוגבלת בלבד. לפי דיווחים ב-Engadget וב-Nextgov, הרקע הוא צו נשיאותי בנושא סייבר שחתם הנשיא טראמפ בתחילת יוני, שמבקש מחברות AI להציג את המודלים החזקים ביותר שלהן לבדיקה פדרלית 30 ימים לפני שחרור לציבור, על בסיס וולונטרי. המרכז לתקני AI וחדשנות של משרד המסחר האמריקאי ערך בדיקות נוספות, ולאחר סדרת פגישות עם החברה ניתן אישור להשקה רחבה. OpenAI מסרה שלדעתה תהליך גישה כזה לא צריך להפוך לברירת המחדל לטווח הארוך, אבל שיתפה פעולה כדי לזרז את השחרור.
לזהירות הזאת יש הקשר ברור. לפי OpenAI עצמה, Sol חזק במיוחד בתחומי הסייבר, הביולוגיה והכימיה, תחומים שנחשבים דו-שימושיים. החברה מדגישה שהמודלים לא חוצים את סף הסיכון הקריטי בהגדרותיה, ושמנגנוני ההגנה החדשים חוסמים פי עשרה יותר פעילות שעלולה להזיק בהשוואה לדורות קודמים.
מה זה אומר לעסקים בישראל
עבור עסק שכבר בנה תהליכי אוטומציה עסקית סביב GPT-5.5, השדרוג המעניין הוא דווקא לא מודל הדגל. Terra מציע, לפי החברה, ביצועים דומים בעלות נמוכה יותר, ו-Luna יכול להתאים למשימות פשוטות בנפחים גדולים, כמו סיווג פניות, תמצות מסמכים או ניתוב לידים. מי שמריץ תהליכים דרך פלטפורמות כמו Make, Zapier או n8n יכול להחליף מודל בהגדרת הקריאה ל-API ולבדוק אם התוצאה נשמרת במחיר נמוך יותר. את Sol ומצב ultra כדאי לשמור למשימות שבאמת דורשות סוכן שעובד לאורך זמן, כי שם צריכת הטוקנים מטפסת בהתאם.
הצד השני
לפני שרצים להחליף מודל, כמה הסתייגויות. כל נתוני הביצועים שפורסמו עד כה מגיעים מ-OpenAI, וייקח זמן עד שגופים בלתי תלויים יאמתו אותם על עומסי עבודה אמיתיים. גם Claude Fable 5 של Anthropic וגם המודלים של Google נשארים חלופות חזקות, וההמלצה המעשית היא לבדוק כל מודל על המשימות של העסק שלכם ולא על סמך טבלת מבחנים של יצרן. בנוסף, OpenAI מודה בעצמה שמנגנוני ההגנה החדשים עלולים לחסום לפעמים גם שימוש לגיטימי, ולכן הוסיפה אפשרות להריץ מחדש בקשות על מודלים חלשים יותר. ולבסוף, מי שזקוק ליכולות הסייבר המתקדמות ביותר יידרש להליך אימות זהות, כולל מפתח אבטחה פיזי עד תחילת ספטמבר, דרישה שכדאי להכניס לשיקולים מראש.
1. מה כוללת משפחת המודלים GPT-5.6 ומה ההבדל בין המודלים?
המשפחה כוללת שלושה מודלים: Sol הוא מודל הדגל המיועד לעבודה מורכבת ולמשימות ארוכות של סוכני Terra ,AI הוא המודל המאוזן לעבודה יומיומית שמציע ביצועים ברמת GPT-5.5 במחיר נמוך יותר, ו-Luna הוא הקטן, המהיר והזול, שמיועד למשימות בהיקפים גדולים שבהן המחיר קובע.
2. כמה עולה השימוש במודלים החדשים ב-API?
Sol עולה 5 דולרים למיליון טוקנים של קלט ו-30 דולר למיליון טוקנים של פלט, Terra מתומחר ב-2.5 דולרים לקלט ו-15 דולר לפלט, ו-Luna עולה דולר אחד לקלט ו-6 דולרים לפלט. בנוסף, OpenAI הוסיפה מנגנון שמירת הקשר עם חיי מטמון מינימליים של 30 דקות, שאמור להוזיל תהליכים חוזרים.
3. מה זה מצב ultra ואיך הוא עובד?
מצב ultra הוא הגדרת היכולת הגבוהה ביותר של OpenAI עד כה, שבה המערכת מריצה ארבעה סוכנים במקביל כברירת מחדל ומחלקת ביניהם משימה מורכבת, כדי להגיע לתוצאה טובה ומהירה יותר. המחיר הוא צריכת טוקנים גבוהה יותר, ולכן מומלץ לשמור אותו למשימות שבאמת דורשות סוכן שעובד לאורך זמן.
4. למה השקת GPT-5.6 התעכבה בכשבועיים?
הרקע הוא צו נשיאותי בנושא סייבר שנחתם בתחילת יוני, שמבקש מחברות AI להציג את המודלים החזקים שלהן לבדיקה פדרלית 30 ימים לפני שחרור לציבור, על בסיס וולונטרי. המרכז לתקני AI וחדשנות של משרד המסחר האמריקאי ערך בדיקות נוספות, ורק לאחר סדרת פגישות עם החברה ניתן אישור להשקה רחבה.
5. מה המשמעות המעשית של ההשקה לעסקים בישראל?
עבור עסק שכבר בנה אוטומציה סביב GPT-5.5, השדרוג המעניין הוא דווקא Terra, שמציע ביצועים דומים בעלות נמוכה יותר, ו-Luna שמתאים למשימות פשוטות בנפחים גדולים כמו סיווג פניות או תמצות מסמכים. מי שמריץ תהליכים דרך Make, Zapier או n8n יכול להחליף מודל בהגדרת הקריאה ל-API ולבדוק אם התוצאה נשמרת במחיר נמוך יותר, אבל מומלץ לבדוק כל מודל על המשימות של העסק ולא להסתמך רק על נתוני היצרן.
