Claude Opus 5.5 уже доступна в SeedRouter
LogoSeedRouter

Поиск модели по названию, например «nano banana»

Поиск модели по названию, например «nano banana»

Text

Grok 4.7

View Markdown

Используйте Grok 4.7 с нативными запросами Chat Completions, Responses или Messages. Параметры, потоковая передача, расход токенов и текущие ограничения.

Используйте grok-4.7 в одном из трёх форматов ниже. Для аутентификации нужен ваш API-ключ SeedRouter. На странице модели доступны Playground и актуальные цены на токены, а руководство по ценам объясняет учёт кэшированного ввода и рассуждений.

Быстрый старт

curl https://api.seedrouter.ai/v1/responses \
  -H "Authorization: Bearer $SEEDROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"grok-4.7","input":"What is 2 + 2?","reasoning":{"effort":"low"},"max_output_tokens":64,"store":false}'

JSON-ответ содержит элементы output и usage. При построении истории разговора сохраняйте все элементы вывода, включая рассуждения и элементы инструментов.

Форматы запросов

ФорматЭндпоинтОбязательные поля
ResponsesPOST /v1/responsesmodel, input
Chat CompletionsPOST /v1/chat/completionsmodel, messages
MessagesPOST /v1/messagesmodel, messages, max_tokens

Используйте Content-Type: application/json и Authorization: Bearer $SEEDROUTER_API_KEY. Клиенты Messages также могут отправлять anthropic-version: 2023-06-01.

Параметры и ограничения

Спецификация OpenAPI содержит полные вложенные схемы запросов и ответов. В таблицах ниже перечислены все поддерживаемые поля запроса верхнего уровня. Неизвестные поля и параметры, которые модель официально игнорирует, отбрасываются. Поддерживаемый параметр с недопустимым значением остаётся недопустимым.

Необязательные поля, допускающие null, принимают явно заданный null; если поле пропущено, используется значение API по умолчанию. Playground скрывает user и фиксирует model на grok-4.7. Клиенты API по-прежнему могут передавать user.

  • Контекст: 500 000 токенов, включая разговор и вывод.
  • Уровень рассуждений: low, medium, high, xhigh; по умолчанию — high.
  • Значение max_completion_tokens и max_output_tokens по умолчанию — 128 000 видимых выходных токенов. Токены рассуждений и вызовов функций не входят в этот лимит видимого вывода. Это значение по умолчанию, а не утверждение о максимальном объёме вывода.
  • Лимиты вывода должны быть положительными целыми числами. API также применяет существующий защитный предел для целых чисел — 1 073 741 823; ограничение объёма контекста сохраняется.
  • temperature: от 0 до 2, по умолчанию 1. top_p: больше 0 и не больше 1, по умолчанию 1. В Responses min_p: от 0 до 1; top_k: целое число не меньше 1.
  • До 350 определений инструментов. Для stream_options требуется stream: true.
  • instructions и previous_response_id нельзя использовать вместе. Сводки рассуждений всегда подробные.

Параметры Responses

ПолеТипПравило
includeмассив или nullМассив дополнительных полей, включаемых в ответ.
input (обязательное)объект или другая допустимая формаТекстовая строка или полный массив входных элементов.
instructionsстрока или nullСистемные инструкции; нельзя совмещать с previous_response_id.
max_output_tokensцелое число или nullЛимит видимого вывода; по умолчанию 128 000.
max_turnsцелое число или nullМаксимальное число ходов агента в виде целого числа.
min_pчисло или nullЧисло от 0 до 1.
model (обязательное)строкаФиксированное значение grok-4.7.
parallel_tool_callsлогическое значение или nullЛогическое значение; по умолчанию true.
previous_response_idстрока или nullID ответа в виде строки; продолжение по ID сейчас недоступно.
prompt_cache_keyстрока или nullКлюч кэша в виде строки.
reasoningобъектНастройки рассуждений; уровень по умолчанию — high.
reasoning_effortстрока или nulllow, medium, high, xhigh; по умолчанию high.
safety_identifierстрока или nullНеобязательный идентификатор безопасности, передаваемый вызывающей стороной.
search_parametersобъектНастройки поиска.
service_tierстрокаauto, default, priority, fast; priority и fast удваивают тарифы на токены.
storeлогическое значение или nullЛогическое значение; по умолчанию true. Операции с сохранёнными ответами сейчас недоступны.
streamлогическое значение или nullЛогическое значение; по умолчанию false.
temperatureчисло или nullЧисло от 0 до 2; по умолчанию 1.
textобъектНастройки текстового ответа, включая format.
tool_choiceобъект или другая допустимая формаАвтоматический выбор, отключение, обязательный вызов или выбранный инструмент; синтаксис зависит от формата.
toolsмассив или nullОпределения инструментов; не больше 350.
top_kцелое число или nullЦелое число; в Responses требуется не меньше 1.
top_pчисло или nullЧисло больше 0 и не больше 1; по умолчанию 1.
userстрока или nullНеобязательный идентификатор вызывающей стороны; скрыт в Playground.

Параметры Chat Completions

ПолеТипПравило
deferredлогическое значение или nullЛогическое значение; по умолчанию false. Отложенное завершение сейчас недоступно.
max_completion_tokensцелое число или nullЛимит видимого вывода; по умолчанию 128 000.
max_tokensцелое число или nullПоложительный лимит видимого вывода. Обязателен для Messages.
messages (обязательное)массивСообщения разговора в этом формате.
model (обязательное)строкаФиксированное значение grok-4.7.
nцелое число или nullЦелое число не меньше 1; по умолчанию 1.
parallel_tool_callsлогическое значение или nullЛогическое значение; по умолчанию true.
prompt_cache_keyстрока или nullКлюч кэша в виде строки.
reasoning_effortстрока или nulllow, medium, high, xhigh; по умолчанию high.
response_formatобъект или другая допустимая формаТекст, объект JSON или вывод по JSON-схеме.
safety_identifierстрока или nullНеобязательный идентификатор безопасности, передаваемый вызывающей стороной.
search_parametersобъектНастройки поиска.
seedцелое число или nullЦелочисленное начальное значение для семплирования.
service_tierстрокаauto, default, priority, fast; priority и fast удваивают тарифы на токены.
streamлогическое значение или nullЛогическое значение; по умолчанию false.
stream_optionsобъектНастройки потоковой передачи; требуется stream: true.
temperatureчисло или nullЧисло от 0 до 2; по умолчанию 1.
tool_choiceобъект или другая допустимая формаАвтоматический выбор, отключение, обязательный вызов или выбранный инструмент; синтаксис зависит от формата.
toolsмассив или nullОпределения инструментов; не больше 350.
top_pчисло или nullЧисло больше 0 и не больше 1; по умолчанию 1.
userстрока или nullНеобязательный идентификатор вызывающей стороны; скрыт в Playground.
web_search_optionsобъектНастройки поиска для совместимости.

Параметры Messages

ПолеТипПравило
max_tokens (обязательное)целое числоПоложительный лимит видимого вывода. Обязателен для Messages.
messages (обязательное)массивСообщения разговора в этом формате.
metadataобъектОбъект метаданных Messages.
model (обязательное)строкаФиксированное значение grok-4.7.
stop_sequencesмассив или nullМассив строк остановки.
streamлогическое значение или nullЛогическое значение; по умолчанию false.
systemобъект или другая допустимая формаСистемная строка или блоки содержимого.
temperatureчисло или nullЧисло от 0 до 2; по умолчанию 1.
tool_choiceобъект или другая допустимая формаАвтоматический выбор, отключение, обязательный вызов или выбранный инструмент; синтаксис зависит от формата.
toolsмассив или nullОпределения инструментов; не больше 350.
top_kцелое число или nullЦелое число; в Responses требуется не меньше 1.
top_pчисло или nullЧисло больше 0 и не больше 1; по умолчанию 1.

Потоковая передача

Установите stream в true. Chat передаёт фрагменты завершения; Responses — именованные события ответа; Messages — события сообщений и блоков содержимого. Читайте итоговое событие использования наряду с текстовыми приращениями. Вызовы инструментов и рассуждения могут быть отдельными элементами вывода; при сохранении истории не сводите поток только к видимому тексту.

{
  "model": "grok-4.7",
  "input": "Explain a mutex in one sentence.",
  "reasoning": { "effort": "low" },
  "max_output_tokens": 128,
  "store": false,
  "stream": true
}

Инструменты и структурированный вывод

Используйте определение инструмента для выбранного формата. Chat использует response_format, а Responses — text.format. С этой моделью проверены функции, веб-поиск, поиск в X, интерпретатор кода и вызовы MCP. Shell возвращает вызов для выполнения клиентом; он не запускает команду на вашем компьютере автоматически. Полная схема также описывает другие типы инструментов; сама запись в схеме не доказывает, что конкретный внешний сервис настроен.

{
  "model": "grok-4.7",
  "input": "Use the code interpreter once to compute 13*17. Return the number.",
  "tools": [{ "type": "code_interpreter" }],
  "tool_choice": "required",
  "max_turns": 1,
  "reasoning": { "effort": "low" },
  "max_output_tokens": 32,
  "store": false
}

Использование инструментов оплачивается отдельно от токенов. Для веб-поиска и интерпретатора кода учитывается число вызовов. Для поиска в X учитывается число полученных публикаций и профилей, включая повторно полученные элементы; количество вызовов поиска в X не является единицей оплаты. Проверяйте usage.server_side_tool_usage_details и записи об использовании в аккаунте.

Расход токенов и цены

Цены зависят от общей длины ввода. При вводе меньше 200 000 токенов используйте стандартную ступень тарифа. При 200 000 и более применяется ступень для длинного контекста ко всему запросу; кэшированный ввод учитывается при выборе ступени. service_tier: "priority" и "fast" удваивают тарифы на токены в обеих ступенях. auto и default выбирают стандартное обслуживание. Плата за инструменты рассчитывается отдельно и не удваивается этим множителем токенов.

ФорматУчёт вводаУчёт вывода
Responsesinput_tokens включает input_tokens_details.cached_tokensoutput_tokens включает рассуждения; не прибавляйте их детализацию повторно
Chatprompt_tokens включает prompt_tokens_details.cached_tokensxAI отдельно сообщает видимые completion_tokens; весь оплачиваемый вывод равен total_tokens - prompt_tokens, включая рассуждения
Messagesinput_tokens не включает cache_read_input_tokens; добавьте поля кэша, чтобы получить общий вводoutput_tokens — общий объём вывода

Публичные ответы содержат счётчики использования, но не денежные суммы. Итоговая плата отображается в записях об использовании. Неудачные запросы не оплачиваются.

История разговора и текущие ограничения

Для продолжения без сохранения состояния передайте предыдущий ввод, каждый возвращённый элемент вывода и следующее сообщение пользователя как новый input. Для Chat или Messages отправляйте полную историю сообщений в соответствующем формате. Сохраняйте возвращённые элементы зашифрованных рассуждений и инструментов без изменений.

Текущий сервис не может продолжать по previous_response_id, получать или удалять сохранённый ответ, выводить список сохранённых входных элементов либо возвращать отложенные завершения Chat. При создании может приниматься store: true, но это не подтверждает поддержку хранения или получения ответов. Эти поля остаются в официальном контракте и Playground; ограничение не заменяет определение их предусмотренного поведения.

Вложения файлов не сработали с протестированными входными данными в виде встроенного текста и URL PDF. Запросы генерации изображений вернули текст без изображений, а поиск инструментов не завершил обнаружение на стороне сервера. Доступность этих возможностей не подтверждена. Для поиска Collections также нужен действительный ресурс collection; эта возможность не проверена.

Chat игнорирует frequency_penalty, presence_penalty, logit_bias, stop, logprobs и top_logprobs. Responses игнорирует background, context_management, metadata, truncation, logprobs и top_logprobs. Они не пересылаются и не предлагаются как активные элементы управления.

Ошибки

Недопустимый запрос возвращает ошибку вместо завершённого ответа. Проверьте значения полей и публичный справочник ошибок. Запросы, вернувшие ошибку, не оплачиваются.