דלגו לתוכן
קבלו את הפעימה השבועית ←
Marketing AI Pulse Marketing AI Pu se
הדופק של השיווק וה‑AI
חדשות ראשי · חדשות

OpenAI ו-Broadcom חשפו את Jalapeño: שבב ה-AI הראשון שלה ומה זה יכול לעשות לתמחור GPT

מהנדס בחדר שרתים מודרני בוחן מחשב נייד - OpenAI Broadcom Jalapeño chip
כמה זמן יש לך?

OpenAI ו-Broadcom חשפו את Jalapeño: שבב ה-AI הראשון שלה ומה זה יכול לעשות לתמחור GPT

📌 בקצרה: OpenAI ו-Broadcom חשפו ב-24 ביוני 2026 את Jalapeño, שבב ASIC מותאם לאינפרנס, שפותח תוך 9 חודשים על תהליך 3 ננומטר של TSMC. החברה טוענת לחיסכון של כ-50% בעלויות אינפרנס לעומת GPU כללי. הפריסה בשטח מתוכננת לסוף 2026. עדיין אין אימות עצמאי לנתון העלויות.

ב-24 ביוני 2026 הכריזו OpenAI ו-Broadcom על Jalapeño, שבב ה-AI הראשון שפיתחה OpenAI לצרכים שלה. זהו ASIC מותאם ספציפית לאינפרנס, כלומר להרצת מודלים קיימים בתגובה לבקשות משתמשים. הפיתוח, לפי ההכרזה, לקח כ-9 חודשים מתכנון ועד לייצור, שפותח על תהליך 3nm של TSMC. אם OpenAI עומדת בהבטחה ושבב זה מגיע לפריסה מלאה, עלויות האינפרנס שלה עשויות לרדת בכ-50%.

ה-"כ" חשובה. הנתון של 50% הוא מנכ"ל Broadcom ובלומברג, לא ממחקר עצמאי. הנדסת ייצור שונה מהרצה בשטח. OpenAI מתכננת פריסה בסוף 2026, בשותפות עם Microsoft, אבל עדיין אין נתוני ביצועים בסביבת ייצור מלאה.

💡 ASIC לעומת GPU: ההבדל שצריך להבין

GPU כמו של Nvidia הוא שבב כללי שמבצע טוב הרבה משימות. ASIC הוא שבב שתוכנן לביצוע משימה ספציפית אחת בלבד. Jalapeño תוכנן רק לאינפרנס של מודלי שפה גדולים, מה שמאפשר יעילות גבוהה יותר, אבל ללא הגמישות של GPU.

למה זה קורה עכשיו

OpenAI מוציאה מיליארדים בשנה על חישוב, וחלק גדול ממנו הולך ל-Nvidia. כשמחפשים מספרים, אפשר להיעזר בהדינמיקה שאנחנו כבר ראינו עם GPT-5.6: OpenAI מנסה לפצות על עלויות גבוהות עם תמחור מדורג. שבב מותאם לאינפרנס הוא דרך אחרת לפתור את אותה בעיה, מצד ההוצאות ולא מצד ההכנסות.

Broadcom, מצדה, הפכה לשותף הסיליקון המועדף על hyperscalers שמכירים את עומסי העבודה שלהם מספיק טוב כדי לא לסמוך רק על GPU כלליים. Google, Meta ו-Apple כבר עשו את המהלך הזה. OpenAI עכשיו עושה את שלה.

מה ברור ומה עדיין לא

ההכרזה מציינת שדגימות הנדסה של Jalapeño כבר מריצות עומסי ML, כולל GPT-5.3-Codex-Spark, בתדר ועוצמה של ייצור. זה שלב מתקדם. הפריסה לסוף 2026 נשמעת ריאלית.

מה שלא ברור: מתי ה-50% ייתורגמו לתמחור שמשווקים ירגישו, אם בכלל. OpenAI לא התחייבה להוריד מחירי . היא גם לא חייבת. החיסכון בעלויות יכול ללכת לרווחיות, לתשתית, או לאסטרטגיה תחרותית. קחו את ה-50% כפוטנציאל, לא כהבטחה.

⚠️ זה לא סיפור עצמאות מ-Nvidia

Jalapeño הוא שבב אינפרנס בלבד. OpenAI עדיין זקוקה ל-Nvidia לאימון מודלים, ואכן כרתה עסקה להתקנת 10 ג'יגאוואט של Vera Rubin. זה לא סיפור של מי ינצח את מי בחומרה, אלא של יעילות כלכלית במשימה אחת ספציפית.

השלכות מעשיות: 4 נקודות שצריך לעקוב אחריהן

01

מחירי API בסוף 2026

אם פריסת Jalapeño תצליח, OpenAI תוכל להוריד מחירי אינפרנס מבלי לאבד מרווח. זה המקום לעקוב: עמוד תמחור ה-API בנובמבר-דצמבר 2026.

02

ריבוי קריאות API הופך זול יותר

כל מי שבונה workflow עם מאות קריאות API ביום, כמו אוטומציות תוכן, תגובות שירות לקוחות, ניתוח נתונים, יתאים ביותר מהורדת עלויות אינפרנס.

03

כוח מיקוח עם ספקים

אם OpenAI תפחית תלות ב-Nvidia לאינפרנס, יש לה יותר גמישות תמחורית. זה לא אוטומטי, אבל הלחץ לעבר תחרות מחיר עולה. Anthropic, Google ו-Meta לא עומדים מהצד.

04

OpenAI בנתה שבב בעזרת GPT

החברה טוענת שהאיצה את תכנון השבב באמצעות המודלים שלה. זה לא עניין שיווקי, זה signal על לאן הולכות אוטומציות הנדסיות, ולאן יכולות ללכת אוטומציות שיווקיות מורכבות.

הנקודה השלישית חשובה במיוחד ב-2026: נתח השוק של ChatGPT ממשיך לרדת ו-Anthropic, Google ו-Mistral מתחרות על אותו שוק. אם OpenAI תוכל להציע עלויות אינפרנס נמוכות יותר, זו נקודת בידול שיש לה ערך ממשי.

מה עושים עכשיו

כרגע, לא כלום. Jalapeño בשלב פריסה, הנתונים לא עצמאיים, ועוד חצי שנה לפחות עד שמשהו ממשי ישתנה בתמחור. שאלו את עצמכם: כמה קריאות API ה-ChatGPT שלכם מייצרות בחודש? אם התשובה היא "עשרות עד מאות", השינוי לא יהיה משמעותי. אם מדובר ב-workflow שמבצע אלפי קריאות ביום, כדאי לעקוב מקרוב.

בשלב זה, הדבר הנכון הוא לרשום לעצמכם: בדצמבר 2026, לבדוק את עמוד התמחור של OpenAI API ולהשוות לנובמבר 2025.

📌 עיקרי הדברים

  • OpenAI ו-Broadcom חשפו את Jalapeño, שבב ASIC לאינפרנס, שפותח ב-9 חודשים על TSMC 3nm
  • הטענה: חיסכון של כ-50% בעלויות אינפרנס לעומת GPU כללי. הנתון עדיין לא מאומת עצמאית
  • פריסה מתוכננת לסוף 2026 עם Microsoft; עדיין לא ניתן לדעת אם זה יתורגם להוזלת API
  • זה לא עצמאות מ-Nvidia: Jalapeño הוא אינפרנס בלבד; לאימון OpenAI עדיין צריכה Nvidia Vera Rubin
  • הנקודה לעקוב: תמחור API של OpenAI בנובמבר-דצמבר 2026
הבא בתור במסלול חדשות
● אותה קטגוריה שר המסחר מחזיר את Mythos 5 ל-100 ארגונים. Fable 5 נשאר חסום לכולם מכתב Lutnick מ-26 ביוני מחזיר גישה ל-Claude Mythos 5 לארגוני תשתית קריטית אמריקאיים, ויוצר תקדים שחברות AI לא יכולות להתעלם ממנו ⏱ 4 דק' · נדב ברנע

📲 כל כתבה חדשה, ישר לטלגרם

בלי אלגוריתם ובלי פיד. עדכון אחד בערוץ בכל פעם שעולה כתבה.

להצטרפות לערוץ
על הכותב/ת
נדב ברנע

עיתונאי טק לשעבר שעבר לעולם השיווק, ועדיין כותב עם האינסטינקט העיתונאי: מחפש את הסיפור האמיתי מאחורי ההודעה הרשמית. יודע לקרוא press release ולהפריד בין ה-spin לבין מה שבאמת קורה. נדב מסקר חדשות AI, הכרזות של Google, Meta ו-OpenAI, ושינויי אלגוריתמים, ולא מפרגן לחינם.

כל הכתבות של נדב ←
אהבתם? קבלו את הפעימה השבועית

5 עדכונים שחשוב לדעת + ניתוח אחד. אימייל אחד בשבוע, בלי ספאם.

המשך קריאה ←
שר המסחר מחזיר את Mythos 5 ל-100 ארגונים. Fable 5 נשאר חסום לכולם
קראו