בחצי המחיר: OpenAI מרחיבה את סדרת GPT-6 עם מודלי Sol ו-Luna

GPT-6 Sol/Luna (מקור OpenAI) GPT-6 Sol/Luna (מקור OpenAI)

נקודות עיקריות

  • •חברת OpenAI מרחיבה את סדרת GPT-6 ומשיקה את המודלים GPT-6 Sol ו-GPT-6 Luna.
  • •המודלים מציגים שיפורי יעילות לצד הוזלה של 50% ומעלה במחירי ה-API ביחס לדור הקודם.
  • •לפי בדיקות החברה, נרשמה ירידה בשיעור השגיאות העובדתיות ושיפור במשימות תכנות ואוטומציה.
  • •המודלים זמינים כעת בממשקי ChatGPT Work ו-Codex וכן בגישת API למפתחים.

חברת OpenAI הכריזה על הרחבת משפחת GPT-6 עם השקת המודלים GPT-6 Sol ו-GPT-6 Luna. המהלך מגיע בהמשך להצגת GPT-6 Astra מוקדם יותר החודש, כאשר המודלים החדשים מתמקדים ביעילות חישובית, ביצועים משופרים והוזלה ישירה של 50% בעלויות השימוש.

לדברי החברה, GPT-6 Sol מיועד למשימות מורכבות, ניתוח מעמיק ופיתוח תוכנה, תוך מתן אפשרות לתהליכי עבודה תובעניים בעלויות מופחתות. מנגד, GPT-6 Luna פונה למשימות שוטפות בהיקף גבוה עם יעד מוגדר, בהן סיכום מסמכים, חילוץ נתונים ומענה לשאלות מהירות.

מאפיינים עיקריים וחדשנות

OpenAI מדווחת כי אימנה את Sol ו-Luna בשיטות דומות לאלו ששימשו ב-Astra, במטרה להעביר יכולות מתקדמות למודלים מהירים ונגישים יותר.

השיפורים מתרכזים ביעילות הסקת המסקנות ובמנגנון ה-Caching, המאפשר למערכות לשמור הקשר בשיחות ארוכות ופעולות של סוכני AI.

שיפורי המטמון מציעים הנחה של עד 90% בקריאת טוקנים שמורים בקלט. לפי נתוני GitHub שהוצגו בהכרזה, אופטימיזציות אלו צמצמו ביותר מ-50% את כמות הטוקנים שדרשו עיבוד מחדש בבקשות Copilot לאורך החודשים האחרונים.

בנוסף, המודלים מציגים סגנון תקשורת ממוקד יותר עם פחות מלל מיותר במענה לשאלות טכניות.

ביצועים

במדדי הביצועים שהציגה OpenAI, המודלים החדשים מציגים שיפור משמעותי במגוון מבחנים מקצועיים מול הדור הקודם ומתחריהם בשוק:

  • במבחן AutomationBench 1.0.6, הבודק זרימות עבודה עסקיות, השיג GPT-6 Sol ציון של 33.2% ברמת מאמץ xhigh בעלות של 0.27 דולר למשימה, תוך עקיפת Claude Opus 5 שרשם ציון של 26.9% בעלות גבוהה פי 11.1. באותו מבחן, GPT-6 Luna רשם שיפור של 5.4 נקודות אחוז לעומת קודמו תוך הפחתת עלות המשימה ב-58%.
  • במבחן Agents' Last Exam V1, הבוחן תהליכי עבודה מקצועיים ארוכי טווח, הגיע GPT-6 Sol ברמת מאמץ מרבית לתוצאה של 56.4% בעלות הנמוכה ב-60% מזו של Claude Opus 5.
  • בתחום פיתוח התוכנה ומבחן DeepSWE 1.1, השיג GPT-6 Sol ציון של 68.8% ברמת מאמץ מרבית, בטווח של 1.1 נקודות אחוז מהתוצאה הגבוהה של Claude Fable 5, בעלות נמוכה בכ-80% למשימה. המודל GPT-6 Luna השיג במבחן זה תוצאה של 66.6% בעלות נמוכה ב-93% לעומת Claude Opus 5.

OpenAI מציינת התקדמות גם ברמת הדיוק העובדתי. בהערכה פנימית המבוססת על שיחות ממשתמשים שדיווחו על שגיאות, מציג GPT-6 Sol ירידה של כמחצית מכמות הטעויות ביחס לקודמו, בעוד GPT-6 Luna משתווה ברמות מאמץ גבוהות לביצועי הדיוק של GPT-5.6 Sol בעלות נמוכה בהרבה.

זמינות

מודלי GPT-6 Sol ו-GPT-6 Luna זמינים ב-ChatGPT Work ו-Codex עבור מנויי Plus, Pro, Business, Enterprise ו-Edu, כאשר הפריסה מתבצעת באופן הדרגתי.

משתמשי המסלולים החינמיים ו-Go יכולים לגשת ל-GPT-6 Luna דרך אפליקציית שולחן העבודה.

בגישת ה-API מחירי השימוש נקבעו על (לכל מיליון טוקנים):

  • GPT-6 Sol: מחיר של 2 דולר עבור קלט ו-10 דולר עבור פלט (הוזלה מ-4 ו-20 דולר בדור הקודם).
  • GPT-6 Luna: מחיר של 0.10 דולר עבור קלט ו-0.50 דולר עבור פלט (הוזלה מ-0.20 ו-1.20 דולר בדור הקודם).

השוואת מפרטים