Claude Opus 5.5 уже доступна в SeedRouter

Уровень рассуждения GPT-6.1 Sol: low, medium, high, xhigh или max?

Какой уровень рассуждения GPT-6.1 Sol выбрать: реальное время, токены и стоимость на low, medium, high, xhigh и max, почему модель медленная и с чего начать.

Читать в Markdown

Начинайте работу с GPT-6.1 Sol на medium — это уровень по умолчанию, — а low используйте, когда ответ нужен быстро. Поднимайте уровень рассуждения до high, xhigh или max только для задач, которые не решаются на medium: длинных рефакторингов, сложной отладки, многошаговой работы агентов. На коротких задачах из тестов ниже каждый уровень дал правильный ответ, но max выдавал первое слово примерно в десять раз дольше и тратил в два с половиной — пять раз больше токенов, чем low.

Это и главная причина, по которой GPT-6.1 Sol кажется медленной. Она всегда рассуждает перед ответом, и до первого видимого текста вы ждёте, пока закончится это рассуждение.

Какие уровни рассуждения поддерживает GPT-6.1 Sol?

Пять: low, medium, high, xhigh и max. По умолчанию — medium. Согласно странице модели GPT-6.1 Sol у OpenAI, «уровни рассуждения none и minimal не поддерживаются», поэтому, в отличие от GPT-6 Sol, отключить рассуждение нельзя. Без none настройки сэмплинга, такие как temperature и top_p, тоже ни на что не влияют.

Уровень задаётся для каждого запроса. В Responses API это reasoning.effort:

from openai import OpenAI

client = OpenAI(api_key="YOUR_SEEDROUTER_KEY", base_url="https://api.seedrouter.ai/v1")

response = client.responses.create(
    model="gpt-6.1-sol",
    input="Find the race condition in this handler and suggest a fix: ...",
    reasoning={"effort": "low"},
)
print(response.output_text)
print(response.usage.output_tokens_details.reasoning_tokens)

В Chat Completions это поле reasoning_effort. Токены рассуждения учитываются в output_tokens, тарифицируются как выход и делят бюджет max_output_tokens с ответом.

Как пять уровней соотносятся на практике?

5 октября 2026 года мы отправили через SeedRouter в GPT-6.1 Sol три промпта с известными ответами — по одному разу на каждом уровне, все пять уровней одновременно. Время — секунды от запроса до полного ответа. Стоимость — по ценам прайс-листа OpenAI: $2 за вход и $10 за выход за миллион токенов, проверено 5 октября 2026 года.

Задача на подсчёт — сколько целых чисел от 1 до 1000 делятся на 3 или на 5, но не делятся на 7 (ответ: 401).

УровеньСекундыТокены рассужденияВыходные токеныСтоимостьВерно
low14,051225$0,0023Да
medium13,446187$0,0020Да
high14,6134272$0,0028Да
xhigh16,2303362$0,0037Да
max20,4516574$0,0058Да

Более сложная задача на подсчёт — сколько целых чисел от 1 до 99 999 кратны 7 и не содержат цифры 7 (ответ: 8434).

УровеньСекундыТокены рассужденияВыходные токеныСтоимостьВерно
low17,5473711$0,0072Да
medium27,610311273$0,0128Да
high28,310341255$0,0126Да
xhigh31,215521763$0,0177Да
max42,620702259$0,0227Да

Код-ревью — найти ошибки в четырёхстрочной функции Python median, которая сортирует входные данные на месте и неправильно обрабатывает списки чётной длины.

УровеньСекундыТокены рассужденияВыходные токеныСтоимостьНашла обе ошибки
low14,976221$0,0023Да, с исправленной версией
medium15,491194$0,0020Да
high19,5296396$0,0040Да
xhigh19,5516606$0,0061Да
max28,410341114$0,0112Да

Это одиночные прогоны на коротких задачах, поэтому воспринимайте их как ориентир по порядку величин, а не как бенчмарк. Число токенов рассуждения меняется от прогона к прогону, а оправдывает свою цену высокий уровень рассуждения на более сложных задачах.

Почему GPT-6.1 Sol медленная?

Большая часть ожидания — это рассуждение, и оно идёт первым. Во втором тесте мы в потоковом режиме запросили одно и то же объяснение на 300 слов на трёх уровнях и замерили, когда пришёл первый видимый текст:

УровеньПервый текст черезОбщее времяТокены рассужденияСкорость ответа
low3,0 с20,5 с5625 токенов/с
medium13,6 с24,7 с82440 токенов/с
max30,6 с43,5 с251734 токена/с

Когда ответ начался, он идёт в похожем темпе на всех уровнях. Меняется тихая часть перед ним: на max модель полминуты рассуждала, прежде чем что-либо написать. Если ваши пользователи смотрят на индикатор загрузки, быстрее всего ощущается low с потоковым выводом.

OpenAI также анонсировала GPT-6.1 Sol Ultrafast — «до 8 раз более быструю генерацию токенов по сравнению со стандартной скоростью в Codex», — в своём посте о запуске.

Может ли xhigh или max быть хуже medium?

На конкретной задаче — да: более высокий уровень рассуждения не гарантирует лучшего ответа. В прогонах выше max ни разу не превзошёл low по правильности, он лишь стоил дороже. Собственные результаты OpenAI указывают в ту же сторону для рутинной работы: GPT-6.1 Sol превзошла лучший результат GPT-6 Sol в DeepSWE «при более низком уровне рассуждения», а наибольший выигрыш в фактической точности над GPT-6 Sol показала на уровне low.

В цифрах OpenAI высокий уровень окупается на длинной и трудной работе: результаты GPT-6.1 Sol в OSWorld 2.0 и Terminal-Bench Science приведены для максимального уровня рассуждения. Практическое правило — измерять на своих задачах. Прогоните выборку на medium и на уровень выше и оставляйте более высокий уровень только там, где он исправляет ошибки.

Какой уровень выбрать?

  • low — ответы в чате, классификация, извлечение данных, простые правки кода, всё, чего ждёт пользователь.
  • medium — уровень по умолчанию для помощи с кодом, ревью и большинства шагов агента.
  • high — изменения в нескольких файлах и отладка, которая не удаётся на medium.
  • xhigh — длинные рефакторинги и планирование на много шагов.
  • max — самые сложные задачи, где неверный ответ обходится дороже лишних токенов.

Для целого агента смешивайте уровни: планируйте на более высоком уровне, а рутинные шаги с инструментами выполняйте на low или medium. Цены для каждого уровня — на странице GPT-6.1 Sol, а руководство по ценам GPT-6.1 Sol объясняет, как токены рассуждения отражаются в счёте.

Часто задаваемые вопросы

Какой уровень рассуждения у GPT-6.1 Sol по умолчанию?

medium. Если не указывать поле, GPT-6.1 Sol рассуждает на уровне medium.

Что выбрать для GPT-6.1 Sol: low или medium?

Используйте medium по умолчанию, а low — там, где скорость важнее глубины. В тесте выше low правильно ответил на все вопросы и показывал первый текст примерно через три секунды, против примерно четырнадцати на medium.

Почему GPT-6.1 Sol такая медленная?

Она рассуждает перед ответом, а рассуждение не передаётся потоком как текст. На medium и выше эта тихая фаза занимает большую часть ожидания. Снизьте уровень рассуждения или включите потоковый вывод, чтобы текст появлялся раньше.

xhigh лучше, чем high, в GPT-6.1 Sol?

Только на задачах, которым это нужно. На коротких задачах оба уровня дали одинаковые ответы, а xhigh потратил больше токенов. Прежде чем платить за xhigh, проверьте оба уровня на своей работе.

Можно ли отключить рассуждение в GPT-6.1 Sol?

Нет. GPT-6.1 Sol не поддерживает none и minimal. Если нужны ответы без рассуждения, GPT-6 Sol по-прежнему поддерживает none. Смотрите сравнение GPT-6.1 Sol vs GPT-6 Astra vs GPT-6 Sol.

Похожие руководства