Уровень рассуждения GPT-6.1 Sol: low, medium, high, xhigh или max?
Какой уровень рассуждения GPT-6.1 Sol выбрать: реальное время, токены и стоимость на low, medium, high, xhigh и max, почему модель медленная и с чего начать.
Читать в MarkdownНачинайте работу с GPT-6.1 Sol на medium — это уровень по умолчанию, — а low используйте, когда ответ нужен быстро. Поднимайте уровень рассуждения до high, xhigh или max только для задач, которые не решаются на medium: длинных рефакторингов, сложной отладки, многошаговой работы агентов. На коротких задачах из тестов ниже каждый уровень дал правильный ответ, но max выдавал первое слово примерно в десять раз дольше и тратил в два с половиной — пять раз больше токенов, чем low.
Это и главная причина, по которой GPT-6.1 Sol кажется медленной. Она всегда рассуждает перед ответом, и до первого видимого текста вы ждёте, пока закончится это рассуждение.
Какие уровни рассуждения поддерживает GPT-6.1 Sol?
Пять: low, medium, high, xhigh и max. По умолчанию — medium. Согласно странице модели GPT-6.1 Sol у OpenAI, «уровни рассуждения none и minimal не поддерживаются», поэтому, в отличие от GPT-6 Sol, отключить рассуждение нельзя. Без none настройки сэмплинга, такие как temperature и top_p, тоже ни на что не влияют.
Уровень задаётся для каждого запроса. В Responses API это reasoning.effort:
from openai import OpenAI
client = OpenAI(api_key="YOUR_SEEDROUTER_KEY", base_url="https://api.seedrouter.ai/v1")
response = client.responses.create(
model="gpt-6.1-sol",
input="Find the race condition in this handler and suggest a fix: ...",
reasoning={"effort": "low"},
)
print(response.output_text)
print(response.usage.output_tokens_details.reasoning_tokens)В Chat Completions это поле reasoning_effort. Токены рассуждения учитываются в output_tokens, тарифицируются как выход и делят бюджет max_output_tokens с ответом.
Как пять уровней соотносятся на практике?
5 октября 2026 года мы отправили через SeedRouter в GPT-6.1 Sol три промпта с известными ответами — по одному разу на каждом уровне, все пять уровней одновременно. Время — секунды от запроса до полного ответа. Стоимость — по ценам прайс-листа OpenAI: $2 за вход и $10 за выход за миллион токенов, проверено 5 октября 2026 года.
Задача на подсчёт — сколько целых чисел от 1 до 1000 делятся на 3 или на 5, но не делятся на 7 (ответ: 401).
| Уровень | Секунды | Токены рассуждения | Выходные токены | Стоимость | Верно |
|---|---|---|---|---|---|
low | 14,0 | 51 | 225 | $0,0023 | Да |
medium | 13,4 | 46 | 187 | $0,0020 | Да |
high | 14,6 | 134 | 272 | $0,0028 | Да |
xhigh | 16,2 | 303 | 362 | $0,0037 | Да |
max | 20,4 | 516 | 574 | $0,0058 | Да |
Более сложная задача на подсчёт — сколько целых чисел от 1 до 99 999 кратны 7 и не содержат цифры 7 (ответ: 8434).
| Уровень | Секунды | Токены рассуждения | Выходные токены | Стоимость | Верно |
|---|---|---|---|---|---|
low | 17,5 | 473 | 711 | $0,0072 | Да |
medium | 27,6 | 1031 | 1273 | $0,0128 | Да |
high | 28,3 | 1034 | 1255 | $0,0126 | Да |
xhigh | 31,2 | 1552 | 1763 | $0,0177 | Да |
max | 42,6 | 2070 | 2259 | $0,0227 | Да |
Код-ревью — найти ошибки в четырёхстрочной функции Python median, которая сортирует входные данные на месте и неправильно обрабатывает списки чётной длины.
| Уровень | Секунды | Токены рассуждения | Выходные токены | Стоимость | Нашла обе ошибки |
|---|---|---|---|---|---|
low | 14,9 | 76 | 221 | $0,0023 | Да, с исправленной версией |
medium | 15,4 | 91 | 194 | $0,0020 | Да |
high | 19,5 | 296 | 396 | $0,0040 | Да |
xhigh | 19,5 | 516 | 606 | $0,0061 | Да |
max | 28,4 | 1034 | 1114 | $0,0112 | Да |
Это одиночные прогоны на коротких задачах, поэтому воспринимайте их как ориентир по порядку величин, а не как бенчмарк. Число токенов рассуждения меняется от прогона к прогону, а оправдывает свою цену высокий уровень рассуждения на более сложных задачах.
Почему GPT-6.1 Sol медленная?
Большая часть ожидания — это рассуждение, и оно идёт первым. Во втором тесте мы в потоковом режиме запросили одно и то же объяснение на 300 слов на трёх уровнях и замерили, когда пришёл первый видимый текст:
| Уровень | Первый текст через | Общее время | Токены рассуждения | Скорость ответа |
|---|---|---|---|---|
low | 3,0 с | 20,5 с | 56 | 25 токенов/с |
medium | 13,6 с | 24,7 с | 824 | 40 токенов/с |
max | 30,6 с | 43,5 с | 2517 | 34 токена/с |
Когда ответ начался, он идёт в похожем темпе на всех уровнях. Меняется тихая часть перед ним: на max модель полминуты рассуждала, прежде чем что-либо написать. Если ваши пользователи смотрят на индикатор загрузки, быстрее всего ощущается low с потоковым выводом.
OpenAI также анонсировала GPT-6.1 Sol Ultrafast — «до 8 раз более быструю генерацию токенов по сравнению со стандартной скоростью в Codex», — в своём посте о запуске.
Может ли xhigh или max быть хуже medium?
На конкретной задаче — да: более высокий уровень рассуждения не гарантирует лучшего ответа. В прогонах выше max ни разу не превзошёл low по правильности, он лишь стоил дороже. Собственные результаты OpenAI указывают в ту же сторону для рутинной работы: GPT-6.1 Sol превзошла лучший результат GPT-6 Sol в DeepSWE «при более низком уровне рассуждения», а наибольший выигрыш в фактической точности над GPT-6 Sol показала на уровне low.
В цифрах OpenAI высокий уровень окупается на длинной и трудной работе: результаты GPT-6.1 Sol в OSWorld 2.0 и Terminal-Bench Science приведены для максимального уровня рассуждения. Практическое правило — измерять на своих задачах. Прогоните выборку на medium и на уровень выше и оставляйте более высокий уровень только там, где он исправляет ошибки.
Какой уровень выбрать?
low— ответы в чате, классификация, извлечение данных, простые правки кода, всё, чего ждёт пользователь.medium— уровень по умолчанию для помощи с кодом, ревью и большинства шагов агента.high— изменения в нескольких файлах и отладка, которая не удаётся наmedium.xhigh— длинные рефакторинги и планирование на много шагов.max— самые сложные задачи, где неверный ответ обходится дороже лишних токенов.
Для целого агента смешивайте уровни: планируйте на более высоком уровне, а рутинные шаги с инструментами выполняйте на low или medium. Цены для каждого уровня — на странице GPT-6.1 Sol, а руководство по ценам GPT-6.1 Sol объясняет, как токены рассуждения отражаются в счёте.
Часто задаваемые вопросы
Какой уровень рассуждения у GPT-6.1 Sol по умолчанию?
medium. Если не указывать поле, GPT-6.1 Sol рассуждает на уровне medium.
Что выбрать для GPT-6.1 Sol: low или medium?
Используйте medium по умолчанию, а low — там, где скорость важнее глубины. В тесте выше low правильно ответил на все вопросы и показывал первый текст примерно через три секунды, против примерно четырнадцати на medium.
Почему GPT-6.1 Sol такая медленная?
Она рассуждает перед ответом, а рассуждение не передаётся потоком как текст. На medium и выше эта тихая фаза занимает большую часть ожидания. Снизьте уровень рассуждения или включите потоковый вывод, чтобы текст появлялся раньше.
xhigh лучше, чем high, в GPT-6.1 Sol?
Только на задачах, которым это нужно. На коротких задачах оба уровня дали одинаковые ответы, а xhigh потратил больше токенов. Прежде чем платить за xhigh, проверьте оба уровня на своей работе.
Можно ли отключить рассуждение в GPT-6.1 Sol?
Нет. GPT-6.1 Sol не поддерживает none и minimal. Если нужны ответы без рассуждения, GPT-6 Sol по-прежнему поддерживает none. Смотрите сравнение GPT-6.1 Sol vs GPT-6 Astra vs GPT-6 Sol.



