Claude Opus 5.5 уже доступна в SeedRouter
LogoSeedRouter

Поиск модели по названию, например «nano banana»

Поиск модели по названию, например «nano banana»

Цены Grok 4.7: кэшированный ввод, рассуждения и стоимость запроса

Разберитесь в ценах Grok 4.7, кэшированном вводе и рассуждениях. Оцените запрос по текущим тарифам без двойного учёта токенов из кэша.

Читать в Markdown

Цены Grok 4.7 зависят от входных токенов, кэшированного ввода и расхода на вывод. Официальные начальные тарифы составляют 2 доллара США за миллион входных токенов и 6 долларов США за миллион выходных токенов. Это заявленная цена модели; для оценки запроса SeedRouter используйте таблицу актуальных тарифов SeedRouter ниже.[1]

Видимая длина ответа — лишь часть расчёта. Короткий ответ может включать дополнительные токены рассуждений, а длинный промпт — кэшированный ввод. На странице модели Grok 4.7 собраны Playground и актуальные цены.

Сколько стоит Grok 4.7?

В официальном анонсе указанные выше тарифы ввода и вывода представлены как начальные цены Grok 4.7. Там также описан отдельный вариант fast с другой ценой. Это руководство посвящено модели grok-4.7; цену варианта с похожим названием нельзя подставлять вместо её цены.[2]

Для запроса через SeedRouter используйте эти актуальные тарифы на токены:

Цены временно недоступны. Пожалуйста, вернитесь позже.

Выберите тарифы ступени, соответствующей длине ввода запроса. В SeedRouter ввод меньше 200 000 токенов относится к стандартной ступени; при объёме от 200 000 токенов ступень длинного контекста применяется ко всему запросу. Ввод, кэшированный ввод и вывод используют соответствующую ступень. Этот порог — граница цены, а не резервирование такого количества токенов.

Для service_tier: "priority" или "fast" удвойте тарифы на токены выбранной ступени длины ввода. Этот множитель применяется к плате за токены; плата за инструменты рассчитывается отдельно.

В официальном обзоре API указано контекстное окно в 500 000 токенов. Этот предел возможностей не означает, что каждый запрос оплачивается за полное окно.[1]

Какие поля использования нужны для расчёта?

Для API Responses сохраняйте три значения из возвращённого usage:

Поле использованияКак применять
input_tokensВесь ввод, включая кэшированную часть
input_tokens_details.cached_tokensЧасть ввода, оплачиваемая по тарифу кэшированного ввода
output_tokensВесь вывод, используемый при расчёте токенов

Вычтите кэшированные токены из общего ввода, прежде чем применять обычный тариф ввода. Иначе одни и те же кэшированные токены попадут в оценку один раз как обычный ввод и второй раз как кэшированный.

Если тарифы указаны за миллион токенов:

uncached input = input_tokens - cached_tokens

token cost = (
  uncached input × input rate
  + cached_tokens × cached-input rate
  + output_tokens × output rate
) / 1,000,000

Для каждого слагаемого используйте тариф из актуальной таблицы. Выбирайте ступень длины ввода по общему вводу до вычитания кэшированных токенов. Оценка токенов не включает отдельную плату за инструменты автоматически; если запрос использует платный поисковый инструмент, его использование тоже нужно учесть.

Почему короткий ответ может расходовать больше выходных токенов?

Рассуждения входят в расход на вывод, даже если итоговый ответ короткий. Например, один завершённый запрос Responses к Grok 4.7, проверенный 10 октября 2026 года, вернул:

{
  "input_tokens": 3340,
  "input_tokens_details": { "cached_tokens": 1152 },
  "output_tokens": 22,
  "output_tokens_details": { "reasoning_tokens": 21 },
  "total_tokens": 3362
}

Этот запрос содержит 2 188 некэшированных входных токенов, 1 152 кэшированных входных токена и 22 выходных токена. Его 21 токен рассуждений — детализация общего вывода. Повторное прибавление превратит 22 в 43 и завысит оценку платы за вывод.

Эти числа описывают один завершённый запрос, а не среднее значение или прогноз для других промптов. Чтобы спланировать бюджет своего приложения, записывайте сообщаемый расход на типичных задачах и проверяйте, соответствует ли каждый результат требованиям задачи.

Меняет ли потоковая передача цену токенов?

Потоковая передача меняет способ поступления ответа. Для оценки по-прежнему используются ввод, кэшированный ввод и вывод завершённого запроса. Сохраняйте итоговые данные об использовании, а не считайте каждый фрагмент текста отдельным оплачиваемым запросом.

При проверке Grok 4.7 в SeedRouter запросы Chat и Responses с потоковой передачей и без неё завершились с учётом кэшированного ввода. Это проверка расчёта использования; она не означает, что два отдельно сгенерированных ответа расходуют одинаковое количество токенов.

Как сравнивать стоимость двух промптов?

Сохраняйте одинаковые задачу и критерии приёмки. Для каждой попытки записывайте общий ввод, кэшированный ввод, вывод и пригодность ответа. Сравнивайте общие затраты на получение приемлемого результата, включая успешные генерации, которые пришлось повторить из-за неудовлетворительных ответов.

В длинном разговоре удаляйте несущественную историю только после проверки, что сокращённая версия всё ещё отвечает правильно. Для повторяющегося контекста проверяйте число кэшированных токенов: повторение текста само по себе не доказывает попадание в кэш. В задачах с большим объёмом рассуждений сравнивайте фактический расход на вывод, а не только количество видимых слов в ответе.

Вопросы о ценах

Официальный базовый тариф — это цена, которую я плачу в SeedRouter?

Для SeedRouter используйте актуальную таблицу выше. Официальная начальная цена полезна для ориентира, но оценка определяется текущими ступенями длины ввода и тарифами на токены сервиса.

Нужно ли прибавлять reasoning_tokens к output_tokens?

Нет. В показанных выше данных Responses рассуждения уже входят в общий вывод. Используйте их детализацию для понимания выполненной работы, а не как вторую плату за вывод.

Гарантирует ли повтор промпта скидку на кэшированный ввод?

Нет. Используйте число кэшированных токенов, указанное в ответе. Применяйте тариф кэшированного ввода только к этой части, а обычный тариф ввода — к остатку.

Где проверить итоговую плату?

Записи об использовании показывают плату за завершённый запрос. Для новой оценки обновите раздел цен Grok 4.7 и используйте расход, сообщённый для этого запроса. Запросы, вернувшие ошибку, не оплачиваются.

Источники

  1. SpaceXAI API: модели Grok и цены, проверено 10 октября 2026 года.
  2. Представляем Grok 4.7, 21 сентября 2026 года.

Похожие руководства