חברת OpenAI הכריזה על השקת GPT-6.1 Sol, שדרוג למודל הדרג האמצעי בסדרת GPT-6. המודל החדש מציג יכולות הקרובות לאלו של מודל הדגל GPT-6 Astra במשימות תכנות אוטונומי (agentic coding), שימוש במחשב (computer use) ועבודה מקצועית, אך מתומחר בחמישית בלבד מעלות הקלט והפלט של מודל העילית. המודל זמין החל מהיום לשימוש מסחרי באמצעות ה-API של החברה תחת המזהה gpt-6.1-sol, וכן שולב בסביבות ChatGPT Work ו-Codex.
רמת ביצועים קרובה למוביל, בעלות מופחתת
השקת המודל מחדדת את מבנה הדרגות של OpenAI בסדרת GPT-6, הכוללת כעת שלושה מודלים עיקריים ברמות תמחור וביצועים שונות. בעוד מודל העילית GPT-6 Astra עולה $10 לקלט ו-$50 לפלט למיליון טוקנים, תמחור הבסיס של GPT-6.1 Sol יעמוד על $2 למיליון טוקנים של קלט ו-$10 למיליון טוקנים של פלט.
נתון משמעותי במיוחד עבור מפתחי סוכני בינה מלאכותית (AI Agents) הוא המחיר לקריאת קלט מאוחסן במטמון (cached input). סוכנים אוטונומיים נוטים לשלוח מחדש את אותן הנחיות מערכת, הגדרות כלים והיסטוריית שיחה בכל שלב ביצוע. ב-GPT-6.1 Sol ירד המחיר לקלט במטמון ל-$0.10 בלבד למיליון טוקנים - הוזלה של 50% לעומת גרסת GPT-6 Sol הקודמת, המהווה כעת 5% בלבד ממחיר הקלט הרגיל.
לצד שני מודלים אלו פועל מודל GPT-6 Luna, המיועד למשימות קלות יותר ומחיר הקלט והפלט שלו עומד על $0.10 ו-$0.50 למיליון טוקנים בהתאמה.
ביצועים במבחני השוואה: תכנות, ניתוח ושימוש במחשב
לפי נתוני הביצועים שפרסמה OpenAI, המודל החדש מציג קפיצת מדרגה משמעותית בהשוואה לדור הקודם, ומגיע לתוצאות קרובות למודלי הקצה:
תכנות אוטונומי: במבחן ההשוואה DeepSWE v1.1, המודל משתווה לביצועי GPT-6 Astra בחמישית מהעלות, ועוקף את תוצאתו הטובה ביותר של GPT-6 Sol ב-6.4 נקודות אחוז תוך השקעת מאמץ חישובי (reasoning effort) נמוך יותר.
שימוש במחשב: במבחן OSWorld 2.0 (בגרסת האופליין), Sol משפר את הציון ב-7 נקודות לעומת GPT-6 Sol ברמת מאמץ מרבית, ומגיע למרחק של 2.1 נקודות בלבד מ-Astra, בעלות נמוכה פי שבעה למשימה.
עבודה מקצועית וניתוח מסמכים: במבחן GDP.pdf, הבודק מתן תשובות מתוך קובצי PDF מקצועיים ומורכבים, גבר Sol על המודל Claude Opus 5.5 בפחות ממחצית העלות למשימה. במבחן AutomationBench 1.0.6 עבר Sol את Opus 5.5 ב-2.2 נקודות ברמת מאמץ בינונית, בשליש מהעלות.
מדע ומחקר: במבחן Terminal-Bench Science 0.1, המודל מכפיל את תוצאות קודמו ואף יותר מכך. העלות הממוצעת למשימה עומדת על $5.47, לעומת $23.21 ב-Claude Opus 5.5 ו-$23.80 ב-GPT-6 Astra. עם זאת, Astra מוביל במבחן זה עם 68.1%, והחברה ממליצה להמשיך להשתמש בו למשימות מחקר מורכבות במיוחד.
הפחתת שגיאות עובדתיות: ברמת מאמץ נמוכה, שיעור התשובות שכללו שגיאה עובדתית ירד מ-11.4% ל-7.7% - צמצום של כ-32% בשיחות שנבחרו במיוחד בשל מורכבותן.
| מודל | מפתח | מחיר קלט (למיליון) | מחיר פלט (למיליון) | מחיר קלט במטמון (למיליון) | חלון הקשר |
|---|---|---|---|---|---|
| GPT-6.1 Sol | OpenAI | $2.00 | $10.00 | $0.10 | 1,050,000 |
| Claude Opus 5.5 | Anthropic | $4.00 | $20.00 | $0.20 | 1,000,000 |
| Claude Sonnet 5.5 | Anthropic | $2.00 | $10.00 | $0.20 | 1,000,000 |
| Gemini 3.1 Pro Preview | $2.00 (עד 200K) | $12.00 (עד 200K) | $0.20 + דמי אחסון | 1,048,576 |
מפרט טכני ואפשרויות שילוב ב-API
המודל מציע חלון הקשר (Context Window) של 1,050,000 טוקנים, ותומך בפלט מרבי של עד 128,000 טוקנים. תאריך עדכון הידע של המודל נקבע ל-30 באפריל 2026. המודל תומך בקלט של טקסט ותמונות ובפלט טקסטואלי בלבד.
מפתחים יכולים לשלוט ברמת המאמץ החישובי באמצעות חמש רמות לבחירה: נמוכה (low), בינונית (medium, ברירת המחדל), גבוהה (high), גבוהה מאוד (xhigh) ומרבית (max). הגדרות none ו-minimal אינן נתמכות. הפעלת הכלים (tool calling) מתבצעת דרך ה-Responses API.
עבור בקשות המכילות קלט של מעל 272 אלף טוקנים, יחול תשלום מוגדל של פי 2 על הקלט והזיכרון במטמון, ופי 1.5 על הפלט לכל אורך הבקשה. מנגד, מסלולי העיבוד המוזלים Batch ו-Flex מעניקים הנחה של 50%, בעוד מצב מהיר (Fast mode) עולה פי שניים מהמחיר הרגיל.
OpenAI מתכננת להשיק בימים הקרובים אפשרות בשם GPT-6.1 Sol Ultrafast בסביבת Codex, שתציע יצירת טוקנים מהירה עד פי 8 מהמהירות הרגילה. המודל נתמך באזורי שמירת נתונים בארה"ב ובאירופה (מצב Fast אינו זמין באירופה), ואינו מציע תמיכה בכוונון עדין (Fine-tuning) או בהורדה להרצה עצמית.
למה זה חשוב לך
להורדת המחירים המשמעותית יש השלכה ישירה על חברות הזנק וחברות תוכנה ישראליות המפתחות סוכני בינה מלאכותית, שכן עלות ההרצה השוטפת (cached input זול פי 50) יכולה להוזיל משמעותית את עלויות התפעול של מוצרים מבוססי AI. בנוסף, זמינות מודל בעלות נמוכה אך בביצועים קרובים לדגם המוביל מאפשרת למפתחים בישראל לבנות כלים מתקדמים לתכנות אוטונומי וניתוח מסמכים בלי להתפשר על תקציב ה-API. מי שכבר עובד עם מודלים מתחרים של Anthropic או Google כדאי שיבחן את טבלת ההשוואה, שכן במקרים רבים GPT-6.1 Sol מציע יחס מחיר-ביצועים עדיף.
התוכן בכתבה זו נועד לספק סקירה כללית בלבד ואינו מהווה תחליף לייעוץ מקצועי פרטני. המערכת אינה אחראית לכל נזק או הפסד שייגרם כתוצאה מהסתמכות על המידע המוצג.
קראו גם: כשרכישת התוכנה אינה מספיקה: מדוע הטמעת ה-AI נתקעת בדרג הניהולי? · 150 אלף סוכני AI בארגון: RSA משיקה כלים לניהול זהויות סוכני צללים





