OpenAI ו-Broadcom חשפו את Jalapeño: שבב ה-AI הראשון שלה ומה זה יכול לעשות לתמחור GPT

⚡ קריאה של 30 שניות
- 1פותח תוך 9 חודשים על תהליך 3 ננומטר של TSMC.
- 2החברה טוענת לחיסכון של כ-50% בעלויות אינפרנס מול GPU כללי.
- 3אין עדיין אימות עצמאי לנתון, והפריסה מתוכננת לסוף 2026.
📄 קריאה של 3 דקות
מה הוכרז
OpenAI ו-Broadcom חשפו ב-24 ביוני שבב ASIC בשם Jalapeño, מותאם לאינפרנס, על תהליך 3 ננומטר של TSMC.
מה ברור ומה לא
דגימות הנדסה כבר מריצות עומסי ML בעוצמת ייצור. נתון החיסכון של 50% עדיין ללא אימות עצמאי.
למה זה משנה
אם OpenAI תוזיל אינפרנס, זה משפיע על מרוץ המחירים מול Anthropic, Google ו-Mistral.
מה עושים עכשיו
כלום מיידי. הפריסה בסוף 2026 לכל המוקדם. שווה לבדוק כמה קריאות API אתם מריצים היום.
OpenAI ו-Broadcom חשפו את Jalapeño: שבב ה-AI הראשון שלה ומה זה יכול לעשות לתמחור GPT
ב-24 ביוני 2026 הכריזו OpenAI ו-Broadcom על Jalapeño, שבב ה-AI הראשון שפיתחה OpenAI לצרכים שלה. זהו ASIC מותאם ספציפית לאינפרנס, כלומר להרצת מודלים קיימים בתגובה לבקשות משתמשים. הפיתוח, לפי ההכרזה, לקח כ-9 חודשים מתכנון ועד לייצור, שפותח על תהליך 3nm של TSMC. אם OpenAI עומדת בהבטחה ושבב זה מגיע לפריסה מלאה, עלויות האינפרנס שלה עשויות לרדת בכ-50%.
ה-"כ" חשובה. הנתון של 50% הוא מנכ"ל Broadcom ובלומברג, לא ממחקר עצמאי. הנדסת ייצור שונה מהרצה בשטח. OpenAI מתכננת פריסה בסוף 2026, בשותפות עם Microsoft, אבל עדיין אין נתוני ביצועים בסביבת ייצור מלאה.
💡 ASIC לעומת GPU: ההבדל שצריך להבין
GPU כמו של Nvidia הוא שבב כללי שמבצע טוב הרבה משימות. ASIC הוא שבב שתוכנן לביצוע משימה ספציפית אחת בלבד. Jalapeño תוכנן רק לאינפרנס של מודלי שפה גדולים, מה שמאפשר יעילות גבוהה יותר, אבל ללא הגמישות של GPU.
למה זה קורה עכשיו
OpenAI מוציאה מיליארדים בשנה על חישוב, וחלק גדול ממנו הולך ל-Nvidia. כשמחפשים מספרים, אפשר להיעזר בהדינמיקה שאנחנו כבר ראינו עם GPT-5.6: OpenAI מנסה לפצות על עלויות גבוהות עם תמחור מדורג. שבב מותאם לאינפרנס הוא דרך אחרת לפתור את אותה בעיה, מצד ההוצאות ולא מצד ההכנסות.
Broadcom, מצדה, הפכה לשותף הסיליקון המועדף על hyperscalers שמכירים את עומסי העבודה שלהם מספיק טוב כדי לא לסמוך רק על GPU כלליים. Google, Meta ו-Apple כבר עשו את המהלך הזה. OpenAI עכשיו עושה את שלה.
מה ברור ומה עדיין לא
ההכרזה מציינת שדגימות הנדסה של Jalapeño כבר מריצות עומסי ML, כולל GPT-5.3-Codex-Spark, בתדר ועוצמה של ייצור. זה שלב מתקדם. הפריסה לסוף 2026 נשמעת ריאלית.
מה שלא ברור: מתי ה-50% ייתורגמו לתמחור שמשווקים ירגישו, אם בכלל. OpenAI לא התחייבה להוריד מחירי . היא גם לא חייבת. החיסכון בעלויות יכול ללכת לרווחיות, לתשתית, או לאסטרטגיה תחרותית. קחו את ה-50% כפוטנציאל, לא כהבטחה.
⚠️ זה לא סיפור עצמאות מ-Nvidia
Jalapeño הוא שבב אינפרנס בלבד. OpenAI עדיין זקוקה ל-Nvidia לאימון מודלים, ואכן כרתה עסקה להתקנת 10 ג'יגאוואט של Vera Rubin. זה לא סיפור של מי ינצח את מי בחומרה, אלא של יעילות כלכלית במשימה אחת ספציפית.
השלכות מעשיות: 4 נקודות שצריך לעקוב אחריהן
מחירי API בסוף 2026
אם פריסת Jalapeño תצליח, OpenAI תוכל להוריד מחירי אינפרנס מבלי לאבד מרווח. זה המקום לעקוב: עמוד תמחור ה-API בנובמבר-דצמבר 2026.
ריבוי קריאות API הופך זול יותר
כל מי שבונה workflow עם מאות קריאות API ביום, כמו אוטומציות תוכן, תגובות שירות לקוחות, ניתוח נתונים, יתאים ביותר מהורדת עלויות אינפרנס.
כוח מיקוח עם ספקים
אם OpenAI תפחית תלות ב-Nvidia לאינפרנס, יש לה יותר גמישות תמחורית. זה לא אוטומטי, אבל הלחץ לעבר תחרות מחיר עולה. Anthropic, Google ו-Meta לא עומדים מהצד.
OpenAI בנתה שבב בעזרת GPT
החברה טוענת שהאיצה את תכנון השבב באמצעות המודלים שלה. זה לא עניין שיווקי, זה signal על לאן הולכות אוטומציות הנדסיות, ולאן יכולות ללכת אוטומציות שיווקיות מורכבות.
הנקודה השלישית חשובה במיוחד ב-2026: נתח השוק של ChatGPT ממשיך לרדת ו-Anthropic, Google ו-Mistral מתחרות על אותו שוק. אם OpenAI תוכל להציע עלויות אינפרנס נמוכות יותר, זו נקודת בידול שיש לה ערך ממשי.
מה עושים עכשיו
כרגע, לא כלום. Jalapeño בשלב פריסה, הנתונים לא עצמאיים, ועוד חצי שנה לפחות עד שמשהו ממשי ישתנה בתמחור. שאלו את עצמכם: כמה קריאות API ה-ChatGPT שלכם מייצרות בחודש? אם התשובה היא "עשרות עד מאות", השינוי לא יהיה משמעותי. אם מדובר ב-workflow שמבצע אלפי קריאות ביום, כדאי לעקוב מקרוב.
בשלב זה, הדבר הנכון הוא לרשום לעצמכם: בדצמבר 2026, לבדוק את עמוד התמחור של OpenAI API ולהשוות לנובמבר 2025.
📌 עיקרי הדברים
- OpenAI ו-Broadcom חשפו את Jalapeño, שבב ASIC לאינפרנס, שפותח ב-9 חודשים על TSMC 3nm
- הטענה: חיסכון של כ-50% בעלויות אינפרנס לעומת GPU כללי. הנתון עדיין לא מאומת עצמאית
- פריסה מתוכננת לסוף 2026 עם Microsoft; עדיין לא ניתן לדעת אם זה יתורגם להוזלת API
- זה לא עצמאות מ-Nvidia: Jalapeño הוא אינפרנס בלבד; לאימון OpenAI עדיין צריכה Nvidia Vera Rubin
- הנקודה לעקוב: תמחור API של OpenAI בנובמבר-דצמבר 2026
📲 כל כתבה חדשה, ישר לטלגרם
בלי אלגוריתם ובלי פיד. עדכון אחד בערוץ בכל פעם שעולה כתבה.
5 עדכונים שחשוב לדעת + ניתוח אחד. אימייל אחד בשבוע, בלי ספאם.

