יולי 30, 2026
נהלל 4, חדרה
חדשות

OpenAI חושפת את Jalapeño, השבב הראשון שלה להרצת מודלים

ב-24 ביוני 2026 הכריזו OpenAI ו-Broadcom על שבב חדש בשם Jalapeño, מה שהחברה מכנה ה-Intelligence Processor הראשון שלה. זה הצעד הגלוי הראשון של OpenAI אל תוך עולם החומרה, אחרי שנים שבהן התמקדה בעיקר במודלים ובמוצרים שרצים מעליהם. השבב תוכנן יחד עם Broadcom, שאחראית על מימוש הסיליקון ועל טכנולוגיות הרשת, ועם Celestica שאחראית על הרכבת הלוחות והמערכות. לפי OpenAI, הוא תוכנן מאפס סביב הצרכים הספציפיים של הרצת מודלי שפה גדולים.

מה זה בעצם Jalapeño

בניגוד למעבדי הגרפיקה של Nvidia, שיודעים גם לאמן מודלים וגם להריץ אותם, Jalapeño מיועד למשימה אחת בלבד, הסקה. זה התהליך שבו מודל מאומן מייצר תשובה בתגובה לשאלה של המשתמש, כלומר בדיוק מה שקורה בכל פעם שאתם שולחים הודעה ל-ChatGPT או מריצים משימה ב-Codex. OpenAI אומרת שדגימות הנדסה של השבב כבר רצות במעבדה בתדר ובהספק שמיועדים לייצור, כולל הרצה של מודל בשם GPT-5.3-Codex-Spark.

נקודה אחת שבולטת היא המהירות. לפי OpenAI ו-Broadcom, השבב עבר מהתכנון הראשוני ועד לשלב הייצור בתשעה חודשים בלבד, מה שהן מתארות כאחד ממחזורי הפיתוח המהירים שנראו בתחום השבבים המתקדמים. החברה גם מציינת שהיא השתמשה במודלים שלה עצמה כדי לזרז חלקים מתהליך התכנון, כלומר אותם מודלים ששירתו את המשתמשים עזרו לבנות את התשתית שתריץ את הדור הבא.

למה דווקא הסקה ולא אימון

הבחירה להתמקד בהסקה היא לא מקרית. אימון מודל הוא תהליך כבד וחד פעמי יחסית, אבל הסקה קורית מיליוני פעמים ביום, בכל שאילתה ושאילתה. כל שיפור קטן בעלות, במהירות או ביציבות של ההסקה מתורגם ישירות לחוויה של המשתמש, לתשובה מהירה יותר, למשימה ארוכה יותר ב-Codex, או לשירות יציב יותר בשעות עומס.

צריך לזכור שזה לא אומר ש-OpenAI נפרדת מ-Nvidia. סביר שמשימות כבדות כמו אימון ימשיכו לרוץ על חומרה של Nvidia, ו-OpenAI ממשיכה לעבוד גם עם Cerebras. השבב החדש פשוט נותן לה עוד אופציה ושליטה רבה יותר על שכבה מסוימת בערימה.

הזווית העסקית, פחות עלות לכל טוקן

כאן נמצא הסיפור האמיתי לעסקים. עלות הטוקנים היא אחד הגורמים המרכזיים בכלכלה של כל מי שבונה מוצר מעל ה-API של OpenAI. שבב שמותאם בדיוק לעומסי ההסקה של החברה יכול לשנות את היחס בין צריכת החשמל לבין מספר הטוקנים שמיוצרים, וזה משפיע ישירות על המרווח. אנליסט מהתחום הסביר שהיכולת לייצר טוקנים בזול יותר נותנת ל-OpenAI מרחב תמרון בתמחור, במיוחד אם השוק ייכנס למלחמת מחירים.

מבחינה רחבה יותר, המהלך מצרף את OpenAI למועדון של חברות שמפתחות שבבי AI משלהן. ל-Google יש את ה-TPU, ל-Amazon יש את Trainium, ול-Alibaba יש שבב משלה. בהקשר הזה מעניין לציין ש-Broadcom היא בדיוק השותפה שעזרה ל-Google לבנות את ה-TPU, כך שיש לה ניסיון מוכח בתחום.

מה זה אומר למשתמש הפרטי

עבור מי שלא מנהל עסק, ההשפעה עקיפה אך אמיתית. אם OpenAI אכן מצליחה להוזיל את עלות ההסקה, זה עשוי להתבטא בתשובות מהירות יותר ב-ChatGPT, בפחות מגבלות שימוש, ובשירות שנופל פחות בשעות עומס. שום דבר מזה לא מובטח, אבל זה הכיוון שאליו החברה מכוונת כשהיא מדברת על נגישות רחבה יותר.

הסתייגות, הרבה הבטחות ומעט מספרים

חשוב לקרוא את ההכרזה בעין זהירה. כמעט כל נתוני הביצועים שפורסמו מגיעים מ-OpenAI עצמה ומבדיקות מוקדמות שלה, ולא מגורם חיצוני בלתי תלוי. החברה טוענת שהשבב מספק ביצועים טובים משמעותית ממה שקיים היום, אך דוח טכני מפורט אמור להתפרסם רק בחודשים הקרובים, ועד אז קשה לאמת את הטענות. גם הפרטים הטכניים המלאים על האדריכלות עדיין לא פורסמו, ולא ברור כיצד השבב ישתלב במערכות אחרות.

יש גם שאלה של אורך נשימה. אנליסטים מציינים שכניסה לעולם תשתיות החומרה היא קשה, ודורשת מחזור פיתוח רב שנתי ורב דורי. Nvidia ו-AMD נמצאות בשוק הזה שנים רבות, ולא מובן מאליו ש-OpenAI ו-Broadcom יצליחו לבנות מוצר בר קיימא שיתבגר לאורך כמה דורות. בשלב הזה, לפי אותם אנליסטים, מוקדם מדי לקבוע, גם אם הכיוון נראה טוב.

בשורה התחתונה

Jalapeño הוא צעד אסטרטגי שמסמן ש-OpenAI רוצה לשלוט בכל שכבות הערימה, מהמודל ועד הסיליקון שמריץ אותו. הפריסה הראשונית מתוכננת לסוף 2026 עם שותפות מרכז נתונים כמו Microsoft, והחברה מדברת על מפת דרכים רב דורית ועל פריסה בקנה מידה של גיגה ואט. אם ההבטחות יתממשו, התוצאה יכולה להיות AI זול ומהיר יותר לכולם. אבל בינתיים מדובר בעיקר בהצהרת כוונות מרשימה, שעוד מחכה למספרים שיגבו אותה.


1. מה זה Jalapeño ולמה הוא מיועד?
Jalapeño הוא השבב הראשון של OpenAI, שהחברה מכנה ה-Intelligence Processor הראשון שלה, ותוכנן יחד עם Broadcom. בניגוד למעבדי הגרפיקה של Nvidia שיודעים גם לאמן וגם להריץ מודלים, Jalapeño מיועד למשימה אחת בלבד, הסקה. זה התהליך שבו מודל מאומן מייצר תשובה בתגובה לשאלה של המשתמש, בדיוק מה שקורה בכל פעם ששולחים הודעה ל-ChatGPT.

2. למה OpenAI בחרה להתמקד בהסקה ולא באימון?
אימון מודל הוא תהליך כבד וחד פעמי יחסית, אבל הסקה קורית מיליוני פעמים ביום בכל שאילתה. כל שיפור קטן בעלות, במהירות או ביציבות של ההסקה מתורגם ישירות לחוויה של המשתמש, לתשובה מהירה יותר או לשירות יציב יותר בשעות עומס. חשוב לציין שזה לא אומר ש-OpenAI נפרדת מ-Nvidia, שכן אימון סביר שימשיך לרוץ על חומרה שלה.

3. מה היתרון העסקי המרכזי של שבב ההסקה?
עלות הטוקנים היא אחד הגורמים המרכזיים בכלכלה של כל מי שבונה מוצר מעל ה-API של OpenAI. שבב שמותאם בדיוק לעומסי ההסקה יכול לשנות את היחס בין צריכת החשמל למספר הטוקנים שמיוצרים, וזה משפיע ישירות על המרווח. כך OpenAI מקבלת מרחב תמרון בתמחור, במיוחד אם השוק ייכנס למלחמת מחירים.

4. מדוע כדאי לקרוא את ההכרזה בעין זהירה?
כמעט כל נתוני הביצועים שפורסמו מגיעים מ-OpenAI עצמה ומבדיקות מוקדמות שלה, ולא מגורם חיצוני בלתי תלוי. דוח טכני מפורט אמור להתפרסם רק בחודשים הקרובים, והפרטים הטכניים המלאים על האדריכלות עדיין לא פורסמו. בנוסף, כניסה לעולם תשתיות החומרה היא קשה ודורשת מחזור פיתוח רב שנתי, כך שלפי אנליסטים מוקדם מדי לקבוע אם המהלך יצליח.

5. איך המהלך משפיע על המשתמש הפרטי?
עבור מי שלא מנהל עסק, ההשפעה עקיפה אך אמיתית. אם OpenAI אכן מצליחה להוזיל את עלות ההסקה, זה עשוי להתבטא בתשובות מהירות יותר ב-ChatGPT, בפחות מגבלות שימוש, ובשירות שנופל פחות בשעות עומס. שום דבר מזה לא מובטח, אבל זה הכיוון שאליו החברה מכוונת כשהיא מדברת על נגישות רחבה יותר.

דני מאור

administrator
מפתח תוכנה עם ניסיון של עשרות שנים, שהחל לתכנת בגיל 13. עוסק בפיתוח מערכות, אתרי אינטרנט, אפליקציות מובייל, משחקים ופרויקטים בתחום החומרה וה-Maker, ומשלב בין חשיבה הנדסית ליצירתיות טכנולוגית.

כתיבת תגובה

האימייל לא יוצג באתר. שדות החובה מסומנים *