רמת ההסקה של GPT-6.1 Sol: low, medium, high, xhigh או max?
באיזו רמת הסקה להשתמש ב-GPT-6.1 Sol: זמנים, מספרי טוקנים ועלויות אמיתיים ב-low, medium, high, xhigh ו-max, למה הוא מרגיש איטי ומאיפה להתחיל.
קריאה כ-Markdownהתחילו את GPT-6.1 Sol ב-medium, ברירת המחדל שלו, והשתמשו ב-low כשאתם רוצים את התשובה מהר. העלו את רמת ההסקה ל-high, xhigh או max רק למשימות שנכשלות ב-medium: ריפקטורינג ארוך, דיבאג קשה, עבודת סוכנים רב-שלבית. במשימות הקצרות במבחנים שלמטה, כל רמת הסקה נתנה את התשובה הנכונה, אבל ל-max לקח בערך פי עשרה זמן להציג את המילה הראשונה, והוא השתמש בפי שניים וחצי עד פי חמישה מהטוקנים של low.
זו גם הסיבה העיקרית לכך ש-GPT-6.1 Sol מרגיש איטי. הוא תמיד מסיק לפני שהוא עונה, ואתם מחכים להסקה הזו לפני הטקסט הגלוי הראשון.
באילו רמות הסקה GPT-6.1 Sol תומך?
חמש: low, medium, high, xhigh ו-max. ברירת המחדל היא medium. לפי עמוד המודל של GPT-6.1 Sol של OpenAI, "רמות ההסקה none ו-minimal אינן נתמכות", כך שבניגוד ל-GPT-6 Sol אין דרך לכבות את ההסקה. בלי none, גם להגדרות דגימה כמו temperature ו-top_p אין השפעה.
קבעו את רמת ההסקה לכל בקשה. ב-Responses API זה reasoning.effort:
from openai import OpenAI
client = OpenAI(api_key="YOUR_SEEDROUTER_KEY", base_url="https://api.seedrouter.ai/v1")
response = client.responses.create(
model="gpt-6.1-sol",
input="Find the race condition in this handler and suggest a fix: ...",
reasoning={"effort": "low"},
)
print(response.output_text)
print(response.usage.output_tokens_details.reasoning_tokens)ב-Chat Completions השדה הוא reasoning_effort. טוקני הסקה נספרים ב-output_tokens, מחויבים כפלט, וחולקים עם התשובה את תקציב max_output_tokens.
איך חמש הרמות משתוות בפועל?
במבחן נשלחו שלושה פרומפטים עם תשובות ידועות ל-GPT-6.1 Sol דרך SeedRouter ב-5 באוקטובר 2026, פעם אחת לכל רמת הסקה, כל חמש הרמות במקביל. הזמנים הם בשניות מהבקשה ועד תשובה מלאה. העלות לפי מחירי המחירון של OpenAI, $2 לקלט ו-$10 לפלט למיליון טוקנים, כפי שנבדקו ב-5 באוקטובר 2026.
בעיית ספירה — כמה מספרים שלמים מ-1 עד 1000 מתחלקים ב-3 או ב-5 אבל לא ב-7 (תשובה: 401).
| רמה | שניות | טוקני הסקה | טוקני פלט | עלות | נכון |
|---|---|---|---|---|---|
low | 14.0 | 51 | 225 | $0.0023 | כן |
medium | 13.4 | 46 | 187 | $0.0020 | כן |
high | 14.6 | 134 | 272 | $0.0028 | כן |
xhigh | 16.2 | 303 | 362 | $0.0037 | כן |
max | 20.4 | 516 | 574 | $0.0058 | כן |
בעיית ספירה קשה יותר — כמה מספרים שלמים מ-1 עד 99,999 הם כפולות של 7 ואינם מכילים את הספרה 7 (תשובה: 8,434).
| רמה | שניות | טוקני הסקה | טוקני פלט | עלות | נכון |
|---|---|---|---|---|---|
low | 17.5 | 473 | 711 | $0.0072 | כן |
medium | 27.6 | 1,031 | 1,273 | $0.0128 | כן |
high | 28.3 | 1,034 | 1,255 | $0.0126 | כן |
xhigh | 31.2 | 1,552 | 1,763 | $0.0177 | כן |
max | 42.6 | 2,070 | 2,259 | $0.0227 | כן |
סקירת קוד — מציאת הבאגים בפונקציית median של ארבע שורות ב-Python, שממיינת את הקלט שלה במקום ומטפלת לא נכון ברשימות באורך זוגי.
| רמה | שניות | טוקני הסקה | טוקני פלט | עלות | מצא את שני הבאגים |
|---|---|---|---|---|---|
low | 14.9 | 76 | 221 | $0.0023 | כן, עם גרסה מתוקנת |
medium | 15.4 | 91 | 194 | $0.0020 | כן |
high | 19.5 | 296 | 396 | $0.0040 | כן |
xhigh | 19.5 | 516 | 606 | $0.0061 | כן |
max | 28.4 | 1,034 | 1,114 | $0.0112 | כן |
אלה הרצות בודדות על משימות קצרות, אז התייחסו אליהן כאל תחושת סדר גודל ולא כאל benchmark. מספרי טוקני ההסקה משתנים בין הרצות, ובמשימות קשות יותר רמת הסקה גבוהה יותר מצדיקה את העלות שלה.
למה GPT-6.1 Sol איטי?
רוב ההמתנה היא הסקה, וההסקה באה קודם. מבחן שני הזרים את אותו הסבר של 300 מילים בשלוש רמות הסקה ומדד מתי הגיע הטקסט הגלוי הראשון:
| רמה | טקסט ראשון אחרי | זמן כולל | טוקני הסקה | מהירות התשובה |
|---|---|---|---|---|
low | 3.0 שניות | 20.5 שניות | 56 | 25 טוקנים לשנייה |
medium | 13.6 שניות | 24.7 שניות | 824 | 40 טוקנים לשנייה |
max | 30.6 שניות | 43.5 שניות | 2,517 | 34 טוקנים לשנייה |
ברגע שהתשובה מתחילה, היא זורמת בקצב דומה בכל רמה. מה שמשתנה הוא החלק השקט שלפניה: ב-max המודל השקיע חצי דקה בהסקה לפני שכתב משהו. אם המשתמשים שלכם בוהים בספינר, low עם הזרמה היא ההגדרה שמרגישה הכי מהירה.
OpenAI גם הכריזה על GPT-6.1 Sol Ultrafast, עם "יצירת טוקנים מהירה עד פי 8 בהשוואה למהירות הרגילה שלו ב-Codex", ב-פוסט ההשקה שלה.
האם xhigh או max יכולים להיות גרועים מ-medium?
במשימה נתונה, כן: רמת הסקה גבוהה יותר אינה ערובה לתשובה טובה יותר. בהרצות שלמעלה max אף פעם לא עקף את low בנכונות, הוא רק עלה יותר. גם התוצאות של OpenAI עצמה מצביעות לאותו כיוון בעבודה שגרתית: GPT-6.1 Sol עקף את הציון הטוב ביותר של GPT-6 Sol ב-DeepSWE "ברמת הסקה נמוכה יותר", והשיפור הגדול ביותר שלו בדיוק עובדתי לעומת GPT-6 Sol הגיע ברמת low.
איפה שרמת הסקה גבוהה יותר משתלמת במספרים של OpenAI היא עבודה ארוכה וקשה: התוצאות של GPT-6.1 Sol ב-OSWorld 2.0 וב-Terminal-Bench Science מדווחות ברמת ההסקה המקסימלית. הכלל המעשי הוא למדוד על המשימות שלכם. הריצו מדגם ב-medium וברמה אחת מעליה, והשאירו את הרמה הגבוהה רק במקומות שבהם היא מתקנת כשלים.
באיזו רמת הסקה כדאי להשתמש?
low— תשובות צ'אט, סיווג, חילוץ, עריכות קוד פשוטות, כל דבר שמשתמש מחכה לו.medium— ברירת המחדל לעזרה בקוד, לסקירות ולרוב שלבי הסוכנים.high— שינויים על פני כמה קבצים ודיבאג שנכשל ב-medium.xhigh— ריפקטורינג ארוך ותכנון לאורך שלבים רבים.max— הבעיות הקשות ביותר, שבהן תשובה שגויה עולה יותר מהטוקנים הנוספים.
לסוכן שלם, ערבבו רמות: תכננו ברמת הסקה גבוהה יותר, והריצו שלבי כלים שגרתיים ב-low או ב-medium. המחירים לכל רמה נמצאים ב-עמוד GPT-6.1 Sol, ו-מדריך התמחור של GPT-6.1 Sol מסביר איך טוקני הסקה מופיעים בחשבון.
שאלות נפוצות
מהי רמת ההסקה שמוגדרת כברירת מחדל ב-GPT-6.1 Sol?
medium. אם לא שולחים את השדה, GPT-6.1 Sol מסיק ברמת medium.
כדאי להשתמש ב-low או ב-medium ב-GPT-6.1 Sol?
השתמשו ב-medium כברירת מחדל וב-low כשמהירות חשובה יותר מעומק. במבחן שלמעלה, low ענה נכון על כל שאלה והציג את הטקסט הראשון אחרי כשלוש שניות, לעומת כארבע עשרה ב-medium.
למה GPT-6.1 Sol כל כך איטי?
הוא מסיק לפני שהוא עונה, וההסקה לא מוזרמת כטקסט. ב-medium ומעלה השלב השקט הזה תופס את רוב ההמתנה. הורידו את רמת ההסקה או הזרימו את התגובה כדי להתחיל להציג טקסט מוקדם יותר.
האם xhigh טוב יותר מ-high ב-GPT-6.1 Sol?
רק במשימות שצריכות את זה. במשימות קצרות שתי הרמות נתנו את אותן תשובות, ו-xhigh השתמש ביותר טוקנים. בדקו את שתיהן על העבודה שלכם לפני שאתם משלמים על xhigh.
אפשר לכבות את ההסקה ב-GPT-6.1 Sol?
לא. GPT-6.1 Sol לא תומך ב-none או ב-minimal. אם אתם צריכים תשובות בלי הסקה, GPT-6 Sol עדיין תומך ב-none. ראו את ההשוואה בין GPT-6.1 Sol, GPT-6 Astra ו-GPT-6 Sol.



