Цены Grok 4.7: кэшированный ввод, рассуждения и стоимость запроса
Разберитесь в ценах Grok 4.7, кэшированном вводе и рассуждениях. Оцените запрос по текущим тарифам без двойного учёта токенов из кэша.
Читать в MarkdownЦены Grok 4.7 зависят от входных токенов, кэшированного ввода и расхода на вывод. Официальные начальные тарифы составляют 2 доллара США за миллион входных токенов и 6 долларов США за миллион выходных токенов. Это заявленная цена модели; для оценки запроса SeedRouter используйте таблицу актуальных тарифов SeedRouter ниже.[1]
Видимая длина ответа — лишь часть расчёта. Короткий ответ может включать дополнительные токены рассуждений, а длинный промпт — кэшированный ввод. На странице модели Grok 4.7 собраны Playground и актуальные цены.
Сколько стоит Grok 4.7?
В официальном анонсе указанные выше тарифы ввода и вывода представлены как начальные цены Grok 4.7. Там также описан отдельный вариант fast с другой ценой. Это руководство посвящено модели grok-4.7; цену варианта с похожим названием нельзя подставлять вместо её цены.[2]
Для запроса через SeedRouter используйте эти актуальные тарифы на токены:
Цены временно недоступны. Пожалуйста, вернитесь позже.
Выберите тарифы ступени, соответствующей длине ввода запроса. В SeedRouter ввод меньше 200 000 токенов относится к стандартной ступени; при объёме от 200 000 токенов ступень длинного контекста применяется ко всему запросу. Ввод, кэшированный ввод и вывод используют соответствующую ступень. Этот порог — граница цены, а не резервирование такого количества токенов.
Для service_tier: "priority" или "fast" удвойте тарифы на токены выбранной ступени длины ввода. Этот множитель применяется к плате за токены; плата за инструменты рассчитывается отдельно.
В официальном обзоре API указано контекстное окно в 500 000 токенов. Этот предел возможностей не означает, что каждый запрос оплачивается за полное окно.[1]
Какие поля использования нужны для расчёта?
Для API Responses сохраняйте три значения из возвращённого usage:
| Поле использования | Как применять |
|---|---|
input_tokens | Весь ввод, включая кэшированную часть |
input_tokens_details.cached_tokens | Часть ввода, оплачиваемая по тарифу кэшированного ввода |
output_tokens | Весь вывод, используемый при расчёте токенов |
Вычтите кэшированные токены из общего ввода, прежде чем применять обычный тариф ввода. Иначе одни и те же кэшированные токены попадут в оценку один раз как обычный ввод и второй раз как кэшированный.
Если тарифы указаны за миллион токенов:
uncached input = input_tokens - cached_tokens
token cost = (
uncached input × input rate
+ cached_tokens × cached-input rate
+ output_tokens × output rate
) / 1,000,000Для каждого слагаемого используйте тариф из актуальной таблицы. Выбирайте ступень длины ввода по общему вводу до вычитания кэшированных токенов. Оценка токенов не включает отдельную плату за инструменты автоматически; если запрос использует платный поисковый инструмент, его использование тоже нужно учесть.
Почему короткий ответ может расходовать больше выходных токенов?
Рассуждения входят в расход на вывод, даже если итоговый ответ короткий. Например, один завершённый запрос Responses к Grok 4.7, проверенный 10 октября 2026 года, вернул:
{
"input_tokens": 3340,
"input_tokens_details": { "cached_tokens": 1152 },
"output_tokens": 22,
"output_tokens_details": { "reasoning_tokens": 21 },
"total_tokens": 3362
}Этот запрос содержит 2 188 некэшированных входных токенов, 1 152 кэшированных входных токена и 22 выходных токена. Его 21 токен рассуждений — детализация общего вывода. Повторное прибавление превратит 22 в 43 и завысит оценку платы за вывод.
Эти числа описывают один завершённый запрос, а не среднее значение или прогноз для других промптов. Чтобы спланировать бюджет своего приложения, записывайте сообщаемый расход на типичных задачах и проверяйте, соответствует ли каждый результат требованиям задачи.
Меняет ли потоковая передача цену токенов?
Потоковая передача меняет способ поступления ответа. Для оценки по-прежнему используются ввод, кэшированный ввод и вывод завершённого запроса. Сохраняйте итоговые данные об использовании, а не считайте каждый фрагмент текста отдельным оплачиваемым запросом.
При проверке Grok 4.7 в SeedRouter запросы Chat и Responses с потоковой передачей и без неё завершились с учётом кэшированного ввода. Это проверка расчёта использования; она не означает, что два отдельно сгенерированных ответа расходуют одинаковое количество токенов.
Как сравнивать стоимость двух промптов?
Сохраняйте одинаковые задачу и критерии приёмки. Для каждой попытки записывайте общий ввод, кэшированный ввод, вывод и пригодность ответа. Сравнивайте общие затраты на получение приемлемого результата, включая успешные генерации, которые пришлось повторить из-за неудовлетворительных ответов.
В длинном разговоре удаляйте несущественную историю только после проверки, что сокращённая версия всё ещё отвечает правильно. Для повторяющегося контекста проверяйте число кэшированных токенов: повторение текста само по себе не доказывает попадание в кэш. В задачах с большим объёмом рассуждений сравнивайте фактический расход на вывод, а не только количество видимых слов в ответе.
Вопросы о ценах
Официальный базовый тариф — это цена, которую я плачу в SeedRouter?
Для SeedRouter используйте актуальную таблицу выше. Официальная начальная цена полезна для ориентира, но оценка определяется текущими ступенями длины ввода и тарифами на токены сервиса.
Нужно ли прибавлять reasoning_tokens к output_tokens?
Нет. В показанных выше данных Responses рассуждения уже входят в общий вывод. Используйте их детализацию для понимания выполненной работы, а не как вторую плату за вывод.
Гарантирует ли повтор промпта скидку на кэшированный ввод?
Нет. Используйте число кэшированных токенов, указанное в ответе. Применяйте тариф кэшированного ввода только к этой части, а обычный тариф ввода — к остатку.
Где проверить итоговую плату?
Записи об использовании показывают плату за завершённый запрос. Для новой оценки обновите раздел цен Grok 4.7 и используйте расход, сообщённый для этого запроса. Запросы, вернувшие ошибку, не оплачиваются.
Источники
- SpaceXAI API: модели Grok и цены, проверено 10 октября 2026 года.
- Представляем Grok 4.7, 21 сентября 2026 года.



