⭐ נקודות עיקריות
- חברת OpenAI חשפה את Jalapeño, שבב הסקה עצמאי ראשון המותאם למודלי שפה גדולים.
- השבב פותח בשיתוף פעולה עם ברודקום ויוצר בלוח זמנים מהיר של תשעה חודשים.
- לדברי החברה, בדיקות ראשוניות מציגות יעילות אנרגטית וביצועים לכל וואט הטובים משמעותית מהחלופות בשוק.
- הפריסה הרשמית של הפלטפורמה במרכזי נתונים מתוכננת להתחיל לקראת סוף שנת 2026.
חברת OpenAI הכריזה רשמית על Jalapeño ("חלפיניו"), מעבד ה-AI הראשון בפיתוח עצמי, אשר תוכנן ומיוצר בשיתוף פעולה עם ברודקום (Broadcom).
השבב החדש הוא מאיץ חומרה המיועד ספציפית עבור משימות אינפרנס (הסקה) של מודלי שפה גדולים (LLMs), ומהווה את אחד השינויים הרחבים ביותר באסטרטגיה של OpenAI מאז הקמתה, שנועד להפחית את התלות בחומרה חיצונית ולהוזיל עלויות.
המעבד החדש מסמן למעשה את כניסתה של החברה לתחום חומרת ה-ASIC המותאמת אישית, בדומה למהלכים קודמים שביצעו ענקיות טכנולוגיה כמו גוגל ואמזון עם מאיצי ה-AI שלהן.
החידוש המרכזי בהכרזה נובע מכך ש-OpenAI פיתחה את השבב מאפס על בסיס ארכיטקטורה המותאמת לצרכיה – מהלך המאפשר לחברה לשלוט בכל שכבות הטכנולוגיה, החל מהחומרה, דרך המודלים ועד למוצרי הקצה דוגמת ChatGPT ו-Codex, במטרה להפוך את השירותים למהירים ונגישים יותר.
הכירו את ה-Jalapeño
שבב ה-Jalapeño תוכנן כדף חלק עבור משימות הסקה – התהליך שבו מודל בינה מלאכותית מריץ חישובים כדי לענות לשאלות משתמשים בזמן אמת – ולא כמאיץ כללי שהותאם למשימה בדיעבד.
פיתוח השבב, מהתכנון הראשוני ועד לשלב ה-Tape-out לייצור, נמשך תשעה חודשים בלבד. לדברי החברה, מדובר במחזור הפיתוח המהיר ביותר אי פעם עבור שבב ASIC בתחום המוליכים למחצה בעלי ביצועים גבוהים.
תהליך הפיתוח המהיר התאפשר הודות לשילוב הדוק בין צוותי התוכנה והחומרה של OpenAI, לצד מומחיות ייצור הסיליקון של ברודקום.
החברה מציינת כי מודלי הבינה המלאכותית שלה עצמה סייעו באופן פעיל לחוקרים בתהליכי העיצוב והאופטימיזציה של השבב.
גרסאות הנדסיות (Engineering samples) של השבב כבר מריצות במעבדות החברה עומסי עבודה של מודלים מתקדמים, כולל GPT-5.3-Codex-Spark, בתדר ובצריכת החשמל המיועדים לייצור המוני.
We’ve designed and built our first AI chip: Jalapeño.
Designed from the ground up by OpenAI and brought to production with @Broadcom, Jalapeño is purpose-built for the LLM workloads powering ChatGPT, Codex, the API, and future agentic products.
Chips are foundational to the AI… pic.twitter.com/mHU7DaMMTi
— OpenAI (@OpenAI) June 24, 2026
ארכיטקטורה וטכנולוגיה
הארכיטקטורה של Jalapeño מתמקדת בצמצום תנועת הנתונים ובאיזון משאבי המחשוב, הזיכרון והתקשורת. לצד ברודקום, שהובילה את מימוש הסיליקון ושילבה בשבב טכנולוגיות רשת מבוססות על שבבי Tomahawk, השתתפה בפרויקט גם חברת Celestica. האחרונה סייעה בתכנון ובאינטגרציה של הלוחות, השרתים ומערכות המסד (Racks) הנדרשות לפריסה תעשייתית רחבה במרכזי נתונים.
מבנה השבב הותאם במיוחד להרצת מודלי קוד בזמן אמת, תחום שבו עלויות התפעול משפיעות ישירות על כדאיות המוצרים. בעוד שמשימות כבדות יותר של אימון מודלים (Pre-training) ימשיכו ככל הנראה להתבסס על מאיצים גרפיים של אנבידיה, השבב החדש מיועד להפחית את עלויות ההפעלה השוטפות של שירותי החברה. השליטה המלאה בכל שכבות המחשוב נועדה לייצר ניצול חומרה הקרוב לגבול התיאורטי שלו.
ביצועים
אף שצוותי הפיתוח עדיין מודדים את נתוני הביצועים הסופיים של המעבד, OpenAI מדווחת כי בדיקות ראשוניות מציגות יעילות אנרגטית וביצועים לכל וואט הטובים באופן משמעותי מהחלופות המתקדמות ביותר הקיימות כיום בשוק.
המטרה המרכזית מאחורי האופטימיזציה הארכיטקטונית היא לשלב את כוח העיבוד של מאיצי ה-AI המובילים כיום, יחד עם זמני שיהוי (Latency) נמוכים הדומים למערכות הסקה ייעודיות וצרות. שיפור זה צפוי להתבטא במהירות התגובה של יישומים אינטראקטיביים מבוססי מודלי שפה גדולים הפועלים בקנה מידה רחב.
לוחות זמנים
פלטפורמת המחשוב החדשה מיועדת להתחיל בפריסה מסחרית ראשונית לקראת סוף שנת 2026. לפי החברה, השבבים ישולבו במרכזי נתונים בהספקי ענק של ג'יגה-וואט (Gigawatt scale) בשיתוף פעולה עם מיקרוסופט ושותפי תשתית נוספים.