נקודות עיקריות
- •גוגל הכריזה על Gemini 4 Argon, מודל ה-AI החדש שלה, המיועד למשימות ארוכות ומורכבות בפיתוח תוכנה, בעבודה משפטית ופיננסית ובאבטחת סייבר
- •מגבלת הפלט של המודל הורחבה למיליון טוקנים, לעומת 64 אלף בדור הקודם, כך שהוא יכול להשלים משימה ארוכה ברצף אחד
- •המודל אומן לאתר, לאמת ולתקן פרצות אבטחה באופן עצמאי, ולפי נתוני גוגל הוא מוביל בעמידות להתקפות הזרקת פקודות
- •בשלב זה המודל זמין רק לקבוצה מצומצמת של גורמי הגנת סייבר. בהמשך יורחב למנויי API בתשלום ולמנויי Google AI Ultra
גוגל הכריזה על Gemini 4 Argon, מודל הבינה המלאכותית החדש שלה, שהחברה מגדירה כמודל החזית (Frontier Model) המתקדם ביותר שפיתחה עד היום.
מדובר במודל שפה גדול (LLM) שפותח ב-Google DeepMind ונבנה במיוחד לתהליכי עבודה ארוכים ומורכבים, שבהם המודל צריך להמשיך לחשוב ולפעול לאורך שלבים רבים בלי לאבד את הכיוון.
בניגוד להשקות קודמות של מודלי Gemini, הפעם גוגל לא פותחת את המודל לכולם. בשלב הראשון Argon זמין רק לקבוצת גורמי הגנת סייבר מהימנים במסגרת תוכנית בשם Fairwind, והחברה משתתפת במקביל בתהליך התנדבותי של ממשל ארה"ב, שבמסגרתו גופי ממשל מקבלים גישה למודלים לפני השקתם.
המשמעות היא שגוגל מתייחסת ליכולות של המודל, ובעיקר ליכולות הסייבר שלו, כמשמעותיות מספיק כדי להצדיק הרחבה הדרגתית ובקרה לפני שחרור רחב למפתחים, לחברות ולצרכנים.
משימות ארוכות ברצף אחד
השינוי הבולט ביותר ב-Gemini 4 Argon הוא מגבלת הפלט. גוגל הרחיבה את מספר הטוקנים (Tokens – יחידות הטקסט שהמודל קורא ומייצר) שהמודל יכול להפיק בתשובה אחת למיליון, לעומת 64 אלף בלבד בדור הקודם – קפיצה של פי 15 בערך.
לפי גוגל, כשהמודל יכול לייצר מאות אלפי טוקנים במסלול עבודה אחד, הוא מסוגל לחשוב לעומק ולפתור בעיה מורכבת בבת אחת, במקום לפרק אותה לסדרה של בקשות נפרדות. זה רלוונטי במיוחד לסוכני AI שמבצעים משימות פיתוח ארוכות, מחקר מעמיק או ניתוח של מסמכים רבים.
החברה מציגה את המודל כמיועד לשלושה תחומים מרכזיים: הנדסת תוכנה בעולם האמיתי, עבודת ידע ארגונית כמו משפטים, פיננסים ומיסים, והגנת סייבר.
לצד אלה גוגל מציינת גם שיפור באיכות הכתיבה וביכולת ההבנה החזותית – ניתוח גרפים מקצועיים, זיהוי פרטים בסרטונים ארוכים וביצוע פעולות על בסיס סדרת מסמכים.
ביצועים
במבחני הביצועים שפרסמה גוגל, Gemini 4 Argon מוביל במרבית הקטגוריות מול GPT-6 Astra של OpenAI ומול Claude Fable 5.1 ו-Claude Opus 5.5 של Anthropic. כמו בכל השקה, מדובר בנתונים שמציגה החברה עצמה, ותמונה מלאה יותר תתקבל רק לאחר בדיקות עצמאיות.

בפיתוח תוכנה המודל השיג 77.9% במבחן DeepSWE v1.1, הבוחן משימות הנדסה ארוכות טווח, לעומת 74.2% של Claude Opus 5.5 ו-74.1% של GPT-6 Astra.
בעבודת ידע ארגונית הוא מוביל במדד Vals Index, ששוקל משימות בפיננסים, קוד, משפטים ומיסים לפי משקלן בתוצר האמריקאי, ובמבחן AutomationBench של Zapier, הבודק ביצוע מקצה לקצה של תהליכים עסקיים.

הפער הבולט ביותר נרשם במבחן הסוכן המשפטי של Harvey, שבו Argon השיג 19.6% לעומת 3.8%-6.7% אצל המתחרים – נתון שמעיד גם כמה המשימה עדיין קשה לכל המודלים. בהבנת וידאו ארוך (LVBench) המודל הגיע ל-91.7%.
עם זאת, Argon לא מוביל בכל מקום. במבחן FrontierSWE v2 הוא מפגר משמעותית אחרי GPT-6 Astra, וב-Terminal-bench 4.0, הבוחן עבודה בסביבת שורת פקודה, Claude Opus 5.5 מקדים אותו בפער ניכר. גם במבחני מדע מסוימים ובשימוש עצמאי במחשב (OSWorld) המודל של OpenAI מקדים אותו.
הגנת סייבר
גוגל אימנה את Argon במיוחד לתחום הגנת הסייבר, והמודל מסוגל לאתר, לאמת ולתקן פרצות אבטחה קריטיות בתוכנה באופן עצמאי.
לגורמי ההגנה המהימנים ולצוותים הפנימיים של גוגל המודל ישוחרר ללא מגבלות הסייבר הרגילות, כדי שיוכלו לנצל את מלוא היכולות שלו.
חברת אבטחת הענן Wiz כבר משתמשת במודל במסגרת יוזמת Scan for Good, שמאתרת חשיפות מסוכנות בתשתיות ציבוריות קריטיות ללא תשלום.
בהדגמה מוקדמת, Argon חשף פרצה קריטית בתוכנה רפואית המשמשת בתי חולים ברחבי העולם, שחשפה מידע אישי רגיש – פרצה שמודלים קודמים פספסו.
במבחן CWE-bench v1, הבוחן תיקון פרצות אבטחה, Argon חולק את המקום הראשון עם ציון של 68%.
במבחנים שמשווים אותו למודל הסייבר הקודם של גוגל, Gemini 3.8 Flash Cyber, הוא השתפר באיתור פרצות בקוד מקור ב-20 שפות תכנות, וגם במבחן חדירה של Wiz שבו המודל צריך לתקוף אתרים חיים בלי גישה לקוד שלהם.

מנגנוני בטיחות
לפני השקה רחבה, גוגל מחזקת את מנגנוני הבטיחות של המודל בארבעה תחומים. הראשון הוא מניעת שימוש לרעה בתחומי סייבר ונשק כימי, ביולוגי, רדיולוגי וגרעיני – בין היתר באמצעות ניטור הפעילות הפנימית של המודל כדי לזהות ניסיונות ניצול.
התחום השני הוא הגנה מפני הזרקת פקודות עקיפה (Indirect Prompt Injection), שבה הוראות זדוניות מוסתרות בתוכן שהמודל קורא, כמו דף אינטרנט או מסמך, במטרה להשתלט על התנהגותו.
במבחן של Gray Swan, שיעור ההצלחה של התקפות כאלה מול Argon עמד על 0.7% בלבד גם אחרי 15 ניסיונות, לעומת 1% אצל מודלי Claude העדכניים ויותר מ-50% אצל Grok 4.6 ו-Kimi K3.
שני התחומים הנוספים הם ניטור של שרשרת החשיבה (Chain-of-Thought) והפעולות של המודל, כדי לעצור אותו כשהוא חורג מכוונת המשתמש, והקשחה של סביבות הבדיקה המבודדות (Sandbox) שבהן המודל נבחן. גוגל אף קראה לשאר התעשייה לשמור על שקיפות בתהליכי החשיבה של המודלים, כדי שאפשר יהיה לזהות התנהגות חריגה.
מחירים וזמינות
Gemini 4 Argon זמין בשלב זה רק לגורמי הגנת סייבר מהימנים במסגרת תוכנית Fairwind.
גוגל מתכננת להרחיב את הגישה בהמשך, בתחילה ללקוחות API בתשלום ולמנויי Google AI Ultra, ולאחר מכן למפתחים, לחברות ולצרכנים, אך לא מסרה מועד.
המודל יושק במחיר היכרות של 2 דולר למיליון טוקני קלט ו-10 דולר למיליון טוקני פלט, עם הנחה של 95% על טוקני קלט שמורים במטמון (Cached). בתום תקופת ההיכרות המחיר יעלה ל-4 דולר ו-20 דולר בהתאמה.