⭐ נקודות עיקריות
- אנבידיה הכריזה על מודל פתוח חדש וכלי ניתוב חכם המיועדים לייעול מערכות סוכני בינה מלאכותית.
- המודל Nemotron 3.5 Lightning נבנה בארכיטקטורת תערובת מומחים במטרה לבצע משימות ייעודיות במהירות גבוהה.
- ספריית הקוד הפתוח NeMo Switchyard מאפשרת להפנות שאילתות למודל המתאים ביותר בהתאם לעלות ולביצועים.
- המודל וספריית הניתוב זמינים להורדה חופשית ב-Hugging Face, ב-ModelScope וב-GitHub.
אנבידיה (NVIDIA) מרחיבה את משפחת מודלי השפה הפתוחים שלה ומכריזה על Nemotron 3.5 Lightning, מודל בינה מלאכותית פתוח מסדרת ה-Nemotron, המיועד לביצוע משימות ממוקדות בתוך מערכות של סוכנים אוטונומיים (Agentic AI).
לצד המודל, חושפת החברה את NeMo Switchyard, ספריית קוד פתוח לניתוב חכם של שאילתות בין מודלים שונים לשיפור הביצועים ועלות שימוש במודלים.
ההכרזה מגיעה כחלק מהמעבר של התעשייה משימוש בצ'אטבוטים בודדים לעבודה עם מערכות שלמות של סוכנים הפועלים במקביל.
כלי הניתוב והמודל החדש נועדו להעניק לארגונים ולמפתחים שליטה גמישה יותר על עלויות העיבוד, מהירות התגובה ופרטיות הנתונים, מבלי להסתמך בלעדית על מודלי ענק יקרים.
הכירו את ה-Nemotron 3.5 Lightning
מודל ה-Nemotron 3.5 Lightning מבוסס על ארכיטקטורת תערובת מומחים (Mixture of Experts) וכולל 30 מיליארד פרמטרים, מתוכם 3 מיליארד פרמטרים פעילים בכל טוקן.
תערובת מומחים היא שיטת בנייה שבה המודל מחולק לתת-רשתות נפרדות, וכל שאילתה מפעילה רק את אלה הרלוונטיות לה במקום את המודל כולו.
התוצאה היא מודל שנהנה מהידע הרחב של כלל הפרמטרים, אבל צורך בפועל את משאבי החישוב של חלק קטן מהם בלבד – וזהו הבסיס לטענות המהירות של אנבידיה.
המודל תוכנן במיוחד עבור משימות מתמשכות ועתירות נפח בתוך מערכות סוכנים, כגון סקירת קוד, ניטור התראות אבטחה, מענה לשאלות תמיכה ושימוש בכלי תוכנה חיצוניים.
המודל פתוח לחלוטין להתאמה אישית באמצעות כלי NVIDIA NeMo, דבר המאפשר לארגונים לאמן אותו על מידע פנימי, כלי עבודה וזרימות עבודה ייעודיות.
| מאפיין | Nemotron 3.5 Lightning |
|---|---|
| ארכיטקטורה | תערובת מומחים (Mixture of Experts) |
| סך פרמטרים | 30 מיליארד |
| פרמטרים פעילים בכל טוקן | 3 מיליארד |
| ייעוד | משימות מתמשכות במערכות סוכנים – סקירת קוד, ניטור אבטחה, מענה תמיכה, הפעלת כלים חיצוניים |
| קצב פלט | מהיר עד פי 4 ממודלים אחרים בקטגוריה |
| מהירות השלמת משימות סוכניות | גבוהה ב-30% ממודלים אחרים בקטגוריה |
| התאמה אישית | אימון על מידע וזרימות עבודה פנימיים באמצעות כלי NVIDIA NeMo |

ניתוב מודלי AI עם NeMo Switchyard
לצד ה-Nemotron 3.5 Lightning, החברה הציגה את ספריית ה-NeMo Switchyard, המיועדת להשתלב בתוך כלים ופלטפורמות פיתוח קיימות.
הספרייה מאבחנת כל פנייה של המשתמש ומנתבת אותה באופן אוטומטי למודל המתאים ביותר, לפי סדרי עדיפויות שקובע המפתח, כגון דיוק, זמן תגובה או מחירי עיבוד.
השילוב בין מודל ממוקד לספריית ניתוב חכמה מאפשר לארגונים להקים מערכות סוכנים רב-שכבתיות. במערכים אלה, מודל מורכב כדוגמת GPT-5.6 או Nemotron 3 Ultra משמש לתכנון ולניהול זרימת העבודה הכללית, בעוד מודל קל משקל כמו Nemotron 3.5 Lightning מבצע את המשימות הנקודתיות בפועל.
ביצועים
לדברי החברה, Nemotron 3.5 Lightning מציע קצב פלט מהיר עד פי 4 ומהירות השלמת משימות סוכניות הגבוהה ב-30% בהשוואה למודלים אחרים בקטגוריה שלו.
המודל מציג ביצועים זהים למודל Qwen3.6-35B תוך חיסכון בזמן העיבוד, וביצועים גבוהים יותר מהמודל Gemma 4 26B.
בבדיקות פנימיות שערכה אנבידיה עם ספריית NeMo Switchyard, שילוב של המודל החדש לצד מודלים מורכבים יותר הצליח לשמור על רמת דיוק של מודלי קצה, תוך הורדת עלות השלמת המשימות לכשליש מהעלות של שימוש במודל Opus 4.8 בלבד.
זמינות
מודל ה-Nemotron 3.5 Lightning זמין להורדה ולשימוש דרך הפלטפורמות Hugging Face, ModelScope ו-OpenRouter. כאשר ספריית NeMo Switchyard זמינה להורדה כקוד פתוח בפלטפורמת GitHub.

