נקודות עיקריות
- •גוגל הכריזה על מודל יצירת ועריכת התמונות Nano Banana 2.1, המבוסס על Gemini 3.6 Flash.
- •המודל מציג עריכה מבוססת מסכה (Masking), המאפשרת שינוי אזור ספציפי בתמונה ללא צורך ביצירתה מחדש.
- •לדברי החברה, נרשם שיפור בשמירה על עקביות של עד ארבע דמויות ועשרה עצמים לאורך שלבי עריכה רצופים.
- •עלות הפקת תמונה למפתחים הוזלה בכמחצית דרך ה-API, אך עלות טוקני הקלט עלתה ל-1.50 דולר למיליון טוקנים.
גוגל (Google) הכריזה על Nano Banana 2.1, מודל בינה מלאכותית מעודכן ליצירה ועריכה של תמונות. המודל החדש מבוסס על Gemini 3.6 Flash (המוכר גם כ-Gemini 3.6 Image) ומגיע כ-8 חודשים שנה לאחר השקת מודל Nano Banana 2 בפברואר.
לדברי החברה, המודל מציג שיפור כולל באיכות העיצוב הוויזואלי, ביכולות העריכה הממוקדות ובשמירה על עקביות של דמויות וחפצים לאורך מספר שלבי עריכה שונים.
המודל משתלב בהדרגה במוצרי החברה, בהם אפליקציית Gemini, מנוע החיפוש Google Search במצב AI Mode, שירות Google Ads וכלי הפיתוח השונים.
מאפיינים עיקריים וחדשנות
החידוש המרכזי בעבודה היומיומית עם המודל נוגע ליכולת עריכה מבוססת מסכה (Mask-based editing). תכונה זו מאפשרת למשתמשים לסמן אזור מוגדר בלבד בתוך תמונה קיימת ולבצע בו שינויים ישירים, במקום ליצור מחדש את הסצנה כולה ולאבד אלמנטים רצויים.
נוסף על כך, המודל תומך בשימוש בעד 14 תמונות רפרנס במקביל. על פי גוגל, המערכת מסוגלת לשמר את המראה והזהות של עד ארבע דמויות ועד עשרה עצמים שונים לאורך סבבי יצירה ועריכה מרובים. במקרים שבהם נדרש ייצוג מדויק של נושאים מהעולם האמיתי, המודל משלב פנייה למנוע החיפוש של גוגל לאימות המידע לפני הפקת התוצר.
Meet Nano Banana 2.1, our latest image generation and editing model 🍌
This upgraded version outperforms our previous models across the board, with notable leaps in visual design, mask-based editing, and subject consistency to help you create more natural-looking images. pic.twitter.com/d858DrzrF3
— Google (@Google) October 6, 2026
ביצועים
במבחני השוואה שערכה גוגל מול בודקים אנושיים, השיג Nano Banana 2.1 ציון של 1,050 נקודות Elo בהעדפה כללית כאשר מנגנון החשיבה (Thinking) מופעל, לעומת 1,015 נקודות ללא הפעלתו.
מדובר בציון הגבוה מזה של קודמו, Nano Banana 2, שעמד על 990 נקודות, ומזה של מודל Nano Banana Pro שקיבל 935 נקודות.
| מדד ביצועים | Nano Banana 2.1 (Thinking) | Nano Banana 2 (Thinking) | Nano Banana Pro |
|---|---|---|---|
| העדפה כללית (Elo) | 1,050 | 990 | 935 |
| עיצוב אינפוגרפיקה (Elo) | 1,048 | 961 | 912 |
| דיוק עובדתי באינפוגרפיקה | 0.521 | 0.179 | 0.265 |
| עריכה מבוססת מסכה (Elo) | 1,049 | 965 | 927 |
| עקביות מרובת דמויות (Elo) | 1,106 | 978 | 1,011 |
יכולות נוספות
המודל מסוגל לייצר תמונות ברזולוציות של 1K, 2K ועד 4K, וביחסי תצוגה מגוונים של עד 8:1. עבור מפתחים, המודל זמין תחת המזהה gemini-nano-banana-2.1.
מבחינת סוגי הקלט, המערכת תומכת בטקסט, מסמכים ותמונות, כאשר עבור מפתחים מוצעת תמיכה גם בקלט וידאו ואודיו. היכולת לעבד קלטים שונים מאפשרת יצירת תמונות מורכבות תוך הצלבת מידע ממקורות מרובים בו-זמנית.
זמינות ומחירים
המודל מופץ בהדרגה למשתמשי קצה בתוך אפליקציית Gemini ובמצב AI Mode בחיפוש של גוגל, וכן בפלטפורמות Google Ads, Google Flow ו-Stitch.
עבור מפתחים וארגונים, הגישה מתבצעת דרך Google AI Studio, ממשק ה-Gemini API ופלטפורמת Gemini Enterprise.
במסגרת ה-API של גוגל, מחיר הפקת התמונות ירד בכמחצית: תמונה ברזולוציית 1K עולה כעת כ-3.4 סנט (במקום 6.7 סנט), ותמונה ברזולוציית 4K עולה כ-7.6 סנט (במקום 15.1 סנט). מנגד, עלויות הקלט התייקרו מ-0.5 ל-1.50 דולר למיליון טוקנים.