⭐ נקודות עיקריות
- חברת SpaceXAI הכריזה על Grok 4.6, מודל בינה מלאכותית המתמקד בהפעלת סוכנים אוטונומיים ומשימות מתמשכות.
- הדגם מציג ביצועים משופרים במבחני הביצועים לכתיבת קוד, פיתוח תוכנה ועבודה אינטראקטיבית וויזואלית.
- האימון התבסס על נתוני סינתזה מ-Grok 4.5 בשילוב למידת חיזוק בסביבות פיתוח והנדסה מגוונות.
- Grok 4.6 זמין כעת ב-Cursor, Grok Build וב-API במחיר של החל מ-2 דולר למיליון טוקנים.
חברת SpaceXAI (לשעבר xAI) הכריזה על השקת Grok 4.6, מודל בינה מלאכותית חדש המבוסס על Grok 4.5 ומתמקד בהפעלת סוכנים אוטונומיים (AI Agents) לאורך זמן.
המודל מיועד להתמודד עם משימות מורכבות ורב-שלביות, החל ממחקר וניתוח מידע ועד לפיתוח תוכנה מלא ויצירת יישומים אינטראקטיביים.
Grok 4.6 הוא מודל שפה ופיתוח המתוכנן לביצוע משימות ארוכות טווח הדורשות תכנון, אימות עצמי והוצאה לפועל של שלבים רבים ברצף.
החשיבות של העדכון טמונה ביכולת להפוך רעיון כללי למוצר עובד בסבב פיתוח יחיד, תוך הפחתת הצורך בהתערבות אנושית רציפה.
הכירו את Grok 4.6
תהליך האימון של Grok 4.6 הקיף שלב אימון משלים ממושך יותר בהשוואה לגרסה הקודמת. השלב התבסס על נתונים שנאצרו בקפידה ויצרו המודלים עצמם עבור משימות הסקה, קוד והנדסה, לצד שיפורים במתכון האימון ובאלגוריתם האופטימיזציה.
בשלב הכיוונון העדין המודרך (Supervised Fine-Tuning), נעשה שימוש ב-Grok 4.5 ליצירת מסלולי פתרון בתחומי ה-STEM, הנדסת תוכנה ועבודת ידע. מסלולים בעייתיים סוננו כדי להבטיח איכות נתונים גבוהה.
בנוסף, המודל עבר אימון נרחב באמצעות למידת חיזוק (Reinforcement Learning) בסביבות ייעודיות שונות. אלו כוללות אופטימיזציה של ליבת מערכת (Kernel Optimization), פיתוח, תכנון מודרך מחשב (CAD) ומשימות קידוד כלליות.
ביצועים
במדד האינטליגנציה של Artificial Analysis הגיע Grok 4.6 לציון של 61 נקודות, המשתווה לדגם GPT-5.6 Sol Max ומציג עליה מציון 56 של גרסת Grok 4.5.
בדיקות המעבדה מצביעות על יכולת גבוהה יותר של המודל לבצע בדיקה עצמית ואימות של נתונים לפני מעבר לשלב הבא במשימה.
במבחני ביצועים נוספים רשם המודל ציון של 69.9% במדד CursorBench v3.2, מול 66.7% בגרסה הקודמת, וציון של 65.9% במבחן הנדסת התוכנה DeepSWE v1.1.
במדד FrontierCode v1.1 השיג המודל 61.3%, ובמבחני APEX-Agents רשם תוצאה של 57.5%.
Introducing Grok 4.6.
It delivers frontier intelligence and is a significant improvement over Grok 4.5 at the same price. pic.twitter.com/RtTbpXcb3a
— SpaceXAI (@SpaceXAI) August 12, 2026
יכולות נוספות
המודל מציג יכולות משודרגות ביצירת תוצרים ויזואליים ואינטראקטיביים כבר בניסיון הראשון. בעת קבלת קונספט כללי למוצר, Grok 4.6 מסוגל לגבש את המבנה והשפה הויזואלית של היישום במעבר יחיד, דבר המקצר את תהליך הפיתוח והעיצוב.
לצד יכולות הפיתוח, הורחבו גם מנגנוני הבטיחות וההגנה של המודל. מערך האבטחה כויל כדי לאפשר שימוש לגיטימי בתחומים כמו תיקון פגיעות אבטחה (Vulnerability Patching), האצת מעגלי תכנון הנדסיים ומחקר בתחום הבינה המלאכותית.
זמינות
Grok 4.6 זמין החל מהיום בסביבות הפיתוח Cursor ו-Grok Build, וכן לגישה דרך ה-API של החברה ובפלטפורמות צד שלישי כמו OpenRouter, Vercel ו-Cloudflare. במהלך השבוע הראשון להשקה מציעה החברה שימוש כפול במסגרת החבילות ב-Grok Build וב-Cursor.
השימוש במודל מתומחר ב-2 ו-6 דולר למיליון טוקנים של קלט פלט, כאשר קיימת גרסה מהירה (Fast) במחיר כפול של 4 ו-12 דולר למיליון טוקנים של קלט ופלט.