مستوى الاستدلال في GPT-6.1 Sol: low أم medium أم high أم xhigh أم max؟
أي مستوى استدلال تستخدم في GPT-6.1 Sol: أزمنة وأعداد توكنات وتكاليف حقيقية عند low و medium و high و xhigh و max، ولماذا يبدو بطيئًا، ومن أين تبدأ.
اقرأ بصيغة Markdownابدأ GPT-6.1 Sol بمستوى medium، وهو المستوى الافتراضي، واستخدم low عندما تريد الإجابة بسرعة. ارفع مستوى الاستدلال إلى high أو xhigh أو max فقط للمهام التي تفشل عند medium: إعادة الهيكلة الطويلة، وتصحيح الأخطاء الصعب، وعمل الوكلاء متعدد الخطوات. في المهام القصيرة في الاختبارات أدناه، أعطى كل مستوى استدلال الإجابة الصحيحة، لكن max استغرق نحو عشرة أضعاف الوقت لإظهار أول كلمة، واستهلك ما بين ضعفين ونصف وخمسة أضعاف توكنات low.
وهذا أيضًا السبب الرئيسي في أن GPT-6.1 Sol يبدو بطيئًا. فهو يستدل دائمًا قبل أن يجيب، وأنت تنتظر ذلك الاستدلال قبل ظهور أول نص مرئي.
ما مستويات الاستدلال التي يدعمها GPT-6.1 Sol؟
خمسة: low و medium و high و xhigh و max. والمستوى الافتراضي هو medium. وبحسب صفحة نموذج GPT-6.1 Sol لدى OpenAI، «مستويا الاستدلال none و minimal غير مدعومين»، لذا لا توجد طريقة لإيقاف الاستدلال، على عكس GPT-6 Sol. وبدون none لا يكون لإعدادات أخذ العينات مثل temperature و top_p أي أثر كذلك.
اضبط مستوى الاستدلال لكل طلب. في Responses API هو reasoning.effort:
from openai import OpenAI
client = OpenAI(api_key="YOUR_SEEDROUTER_KEY", base_url="https://api.seedrouter.ai/v1")
response = client.responses.create(
model="gpt-6.1-sol",
input="Find the race condition in this handler and suggest a fix: ...",
reasoning={"effort": "low"},
)
print(response.output_text)
print(response.usage.output_tokens_details.reasoning_tokens)في Chat Completions الحقل هو reasoning_effort. تُحتسب توكنات الاستدلال ضمن output_tokens، وتُفوتَر كإخراج، وتتشارك ميزانية max_output_tokens مع الإجابة.
كيف تتقارن المستويات الخمسة عمليًا؟
أرسل الاختبار ثلاثة موجّهات معروفة الإجابة إلى GPT-6.1 Sol عبر SeedRouter في 5 أكتوبر 2026، مرة لكل مستوى استدلال، والمستويات الخمسة في الوقت نفسه. الأزمنة بالثواني من الطلب حتى اكتمال الإجابة. والتكلفة بأسعار قائمة OpenAI البالغة $2 للإدخال و $10 للإخراج لكل مليون توكن، كما تحققنا منها في 5 أكتوبر 2026.
مسألة عدّ — كم عددًا صحيحًا من 1 إلى 1000 يقبل القسمة على 3 أو 5 ولا يقبل القسمة على 7 (الإجابة: 401).
| المستوى | الثواني | توكنات الاستدلال | توكنات الإخراج | التكلفة | صحيحة |
|---|---|---|---|---|---|
low | 14.0 | 51 | 225 | $0.0023 | نعم |
medium | 13.4 | 46 | 187 | $0.0020 | نعم |
high | 14.6 | 134 | 272 | $0.0028 | نعم |
xhigh | 16.2 | 303 | 362 | $0.0037 | نعم |
max | 20.4 | 516 | 574 | $0.0058 | نعم |
مسألة عدّ أصعب — كم عددًا صحيحًا من 1 إلى 99,999 من مضاعفات 7 ولا يحتوي على الرقم 7 (الإجابة: 8,434).
| المستوى | الثواني | توكنات الاستدلال | توكنات الإخراج | التكلفة | صحيحة |
|---|---|---|---|---|---|
low | 17.5 | 473 | 711 | $0.0072 | نعم |
medium | 27.6 | 1,031 | 1,273 | $0.0128 | نعم |
high | 28.3 | 1,034 | 1,255 | $0.0126 | نعم |
xhigh | 31.2 | 1,552 | 1,763 | $0.0177 | نعم |
max | 42.6 | 2,070 | 2,259 | $0.0227 | نعم |
مراجعة الكود — إيجاد الأخطاء في دالة Python باسم median من أربعة أسطر ترتّب مدخلاتها في مكانها وتخطئ في معالجة القوائم ذات الطول الزوجي.
| المستوى | الثواني | توكنات الاستدلال | توكنات الإخراج | التكلفة | وجد الخطأين |
|---|---|---|---|---|---|
low | 14.9 | 76 | 221 | $0.0023 | نعم، مع نسخة مُصلَحة |
medium | 15.4 | 91 | 194 | $0.0020 | نعم |
high | 19.5 | 296 | 396 | $0.0040 | نعم |
xhigh | 19.5 | 516 | 606 | $0.0061 | نعم |
max | 28.4 | 1,034 | 1,114 | $0.0112 | نعم |
هذه تشغيلات منفردة على مهام قصيرة، فاعتبرها مؤشرًا على الحجم لا مقياسًا معياريًا. تختلف أعداد توكنات الاستدلال بين التشغيلات، والمهام الأصعب هي حيث يستحق مستوى الاستدلال الأعلى تكلفته.
لماذا GPT-6.1 Sol بطيء؟
معظم الانتظار هو استدلال، والاستدلال يأتي أولًا. بثّ اختبار ثانٍ الشرح نفسه المؤلف من 300 كلمة عند ثلاثة مستويات استدلال، وقاس متى وصل أول نص مرئي:
| المستوى | أول نص بعد | الزمن الكلي | توكنات الاستدلال | سرعة الإجابة |
|---|---|---|---|---|
low | 3.0 ثانية | 20.5 ثانية | 56 | 25 توكن/ثانية |
medium | 13.6 ثانية | 24.7 ثانية | 824 | 40 توكن/ثانية |
max | 30.6 ثانية | 43.5 ثانية | 2,517 | 34 توكن/ثانية |
بمجرد أن تبدأ الإجابة، تُبثّ بوتيرة متقاربة عند كل مستوى. ما يتغيّر هو الجزء الصامت الذي يسبقها: عند max قضى النموذج نصف دقيقة في الاستدلال قبل أن يكتب أي شيء. إذا كان مستخدموك يحدّقون في مؤشر تحميل، فإن low مع البث هو الإعداد الذي يبدو الأسرع.
وأعلنت OpenAI أيضًا عن GPT-6.1 Sol Ultrafast، مع «توليد توكنات أسرع بما يصل إلى 8 أضعاف مقارنةً بسرعته القياسية في Codex»، في منشور الإطلاق.
هل يمكن أن يكون xhigh أو max أسوأ من medium؟
في مهمة بعينها، نعم: مستوى الاستدلال الأعلى ليس ضمانًا لإجابة أفضل. في التشغيلات أعلاه لم يتفوّق max على low في الصحة قط، بل كلّف أكثر فقط. ونتائج OpenAI نفسها تشير إلى الاتجاه ذاته في الأعمال الروتينية: تجاوز GPT-6.1 Sol أفضل نتيجة لـ GPT-6 Sol في DeepSWE «بمستوى استدلال أقل»، وجاء أكبر تحسّن له في الدقة الواقعية مقارنة بـ GPT-6 Sol عند مستوى low.
أما حيث يؤتي مستوى الاستدلال الأعلى ثماره في أرقام OpenAI فهو العمل الطويل والصعب: نتائج GPT-6.1 Sol في OSWorld 2.0 و Terminal-Bench Science مُعلنة عند أقصى مستوى استدلال. والقاعدة العملية هي أن تقيس على مهامك الخاصة. شغّل عيّنة عند medium وعند المستوى الأعلى منه بدرجة واحدة، واحتفظ بالمستوى الأعلى فقط حيث يُصلح الإخفاقات.
أي مستوى استدلال تستخدم؟
low— ردود الدردشة، والتصنيف، والاستخراج، وتعديلات الكود البسيطة، وكل ما ينتظره المستخدم.medium— المستوى الافتراضي للمساعدة البرمجية والمراجعات ومعظم خطوات الوكلاء.high— التغييرات عبر ملفات متعددة وتصحيح الأخطاء الذي يفشل عندmedium.xhigh— إعادة الهيكلة الطويلة والتخطيط عبر خطوات كثيرة.max— أصعب المشكلات، حيث تكلّف الإجابة الخاطئة أكثر من التوكنات الإضافية.
للوكيل الكامل، امزج المستويات: خطّط بمستوى استدلال أعلى، ونفّذ خطوات الأدوات الروتينية بمستوى low أو medium. أسعار كل مستوى موجودة في صفحة GPT-6.1 Sol، ويشرح دليل أسعار GPT-6.1 Sol كيف تظهر توكنات الاستدلال في الفاتورة.
الأسئلة الشائعة
ما مستوى الاستدلال الافتراضي في GPT-6.1 Sol؟
medium. إذا لم تُرسل الحقل، يستدل GPT-6.1 Sol بمستوى medium.
هل أستخدم low أم medium مع GPT-6.1 Sol؟
استخدم medium كمستوى افتراضي و low حيث تهمّ السرعة أكثر من العمق. في الاختبار أعلاه، أجاب low عن كل سؤال إجابة صحيحة وأظهر أول نص في نحو ثلاث ثوانٍ، مقابل نحو أربع عشرة ثانية عند medium.
لماذا GPT-6.1 Sol بطيء جدًا؟
إنه يستدل قبل أن يجيب، ولا يُبثّ الاستدلال كنص. عند medium وما فوقه تستغرق تلك المرحلة الصامتة معظم وقت الانتظار. خفّض مستوى الاستدلال أو بثّ الاستجابة لتبدأ بعرض النص أسرع.
هل xhigh أفضل من high في GPT-6.1 Sol؟
فقط في المهام التي تحتاجه. في المهام القصيرة أعطى المستويان الإجابات نفسها، واستهلك xhigh توكنات أكثر. اختبر كليهما على عملك قبل أن تدفع مقابل xhigh.
هل يمكن إيقاف الاستدلال في GPT-6.1 Sol؟
لا. لا يدعم GPT-6.1 Sol القيمتين none أو minimal. إذا كنت تحتاج إجابات دون استدلال، فما زال GPT-6 Sol يدعم none. راجع مقارنة GPT-6.1 Sol و GPT-6 Astra و GPT-6 Sol.



