Text
Grok 4.7
Используйте Grok 4.7 с нативными запросами Chat Completions, Responses или Messages. Параметры, потоковая передача, расход токенов и текущие ограничения.
Используйте grok-4.7 в одном из трёх форматов ниже. Для аутентификации нужен ваш API-ключ SeedRouter. На странице модели доступны Playground и актуальные цены на токены, а руководство по ценам объясняет учёт кэшированного ввода и рассуждений.
Быстрый старт
curl https://api.seedrouter.ai/v1/responses \
-H "Authorization: Bearer $SEEDROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"grok-4.7","input":"What is 2 + 2?","reasoning":{"effort":"low"},"max_output_tokens":64,"store":false}'JSON-ответ содержит элементы output и usage. При построении истории разговора сохраняйте все элементы вывода, включая рассуждения и элементы инструментов.
Форматы запросов
| Формат | Эндпоинт | Обязательные поля |
|---|---|---|
| Responses | POST /v1/responses | model, input |
| Chat Completions | POST /v1/chat/completions | model, messages |
| Messages | POST /v1/messages | model, messages, max_tokens |
Используйте Content-Type: application/json и Authorization: Bearer $SEEDROUTER_API_KEY. Клиенты Messages также могут отправлять anthropic-version: 2023-06-01.
Параметры и ограничения
Спецификация OpenAPI содержит полные вложенные схемы запросов и ответов. В таблицах ниже перечислены все поддерживаемые поля запроса верхнего уровня. Неизвестные поля и параметры, которые модель официально игнорирует, отбрасываются. Поддерживаемый параметр с недопустимым значением остаётся недопустимым.
Необязательные поля, допускающие null, принимают явно заданный null; если поле пропущено, используется значение API по умолчанию. Playground скрывает user и фиксирует model на grok-4.7. Клиенты API по-прежнему могут передавать user.
- Контекст: 500 000 токенов, включая разговор и вывод.
- Уровень рассуждений:
low,medium,high,xhigh; по умолчанию —high. - Значение
max_completion_tokensиmax_output_tokensпо умолчанию — 128 000 видимых выходных токенов. Токены рассуждений и вызовов функций не входят в этот лимит видимого вывода. Это значение по умолчанию, а не утверждение о максимальном объёме вывода. - Лимиты вывода должны быть положительными целыми числами. API также применяет существующий защитный предел для целых чисел — 1 073 741 823; ограничение объёма контекста сохраняется.
temperature: от 0 до 2, по умолчанию 1.top_p: больше 0 и не больше 1, по умолчанию 1. В Responsesmin_p: от 0 до 1;top_k: целое число не меньше 1.- До 350 определений инструментов. Для
stream_optionsтребуетсяstream: true. instructionsиprevious_response_idнельзя использовать вместе. Сводки рассуждений всегда подробные.
Параметры Responses
| Поле | Тип | Правило |
|---|---|---|
include | массив или null | Массив дополнительных полей, включаемых в ответ. |
input (обязательное) | объект или другая допустимая форма | Текстовая строка или полный массив входных элементов. |
instructions | строка или null | Системные инструкции; нельзя совмещать с previous_response_id. |
max_output_tokens | целое число или null | Лимит видимого вывода; по умолчанию 128 000. |
max_turns | целое число или null | Максимальное число ходов агента в виде целого числа. |
min_p | число или null | Число от 0 до 1. |
model (обязательное) | строка | Фиксированное значение grok-4.7. |
parallel_tool_calls | логическое значение или null | Логическое значение; по умолчанию true. |
previous_response_id | строка или null | ID ответа в виде строки; продолжение по ID сейчас недоступно. |
prompt_cache_key | строка или null | Ключ кэша в виде строки. |
reasoning | объект | Настройки рассуждений; уровень по умолчанию — high. |
reasoning_effort | строка или null | low, medium, high, xhigh; по умолчанию high. |
safety_identifier | строка или null | Необязательный идентификатор безопасности, передаваемый вызывающей стороной. |
search_parameters | объект | Настройки поиска. |
service_tier | строка | auto, default, priority, fast; priority и fast удваивают тарифы на токены. |
store | логическое значение или null | Логическое значение; по умолчанию true. Операции с сохранёнными ответами сейчас недоступны. |
stream | логическое значение или null | Логическое значение; по умолчанию false. |
temperature | число или null | Число от 0 до 2; по умолчанию 1. |
text | объект | Настройки текстового ответа, включая format. |
tool_choice | объект или другая допустимая форма | Автоматический выбор, отключение, обязательный вызов или выбранный инструмент; синтаксис зависит от формата. |
tools | массив или null | Определения инструментов; не больше 350. |
top_k | целое число или null | Целое число; в Responses требуется не меньше 1. |
top_p | число или null | Число больше 0 и не больше 1; по умолчанию 1. |
user | строка или null | Необязательный идентификатор вызывающей стороны; скрыт в Playground. |
Параметры Chat Completions
| Поле | Тип | Правило |
|---|---|---|
deferred | логическое значение или null | Логическое значение; по умолчанию false. Отложенное завершение сейчас недоступно. |
max_completion_tokens | целое число или null | Лимит видимого вывода; по умолчанию 128 000. |
max_tokens | целое число или null | Положительный лимит видимого вывода. Обязателен для Messages. |
messages (обязательное) | массив | Сообщения разговора в этом формате. |
model (обязательное) | строка | Фиксированное значение grok-4.7. |
n | целое число или null | Целое число не меньше 1; по умолчанию 1. |
parallel_tool_calls | логическое значение или null | Логическое значение; по умолчанию true. |
prompt_cache_key | строка или null | Ключ кэша в виде строки. |
reasoning_effort | строка или null | low, medium, high, xhigh; по умолчанию high. |
response_format | объект или другая допустимая форма | Текст, объект JSON или вывод по JSON-схеме. |
safety_identifier | строка или null | Необязательный идентификатор безопасности, передаваемый вызывающей стороной. |
search_parameters | объект | Настройки поиска. |
seed | целое число или null | Целочисленное начальное значение для семплирования. |
service_tier | строка | auto, default, priority, fast; priority и fast удваивают тарифы на токены. |
stream | логическое значение или null | Логическое значение; по умолчанию false. |
stream_options | объект | Настройки потоковой передачи; требуется stream: true. |
temperature | число или null | Число от 0 до 2; по умолчанию 1. |
tool_choice | объект или другая допустимая форма | Автоматический выбор, отключение, обязательный вызов или выбранный инструмент; синтаксис зависит от формата. |
tools | массив или null | Определения инструментов; не больше 350. |
top_p | число или null | Число больше 0 и не больше 1; по умолчанию 1. |
user | строка или null | Необязательный идентификатор вызывающей стороны; скрыт в Playground. |
web_search_options | объект | Настройки поиска для совместимости. |
Параметры Messages
| Поле | Тип | Правило |
|---|---|---|
max_tokens (обязательное) | целое число | Положительный лимит видимого вывода. Обязателен для Messages. |
messages (обязательное) | массив | Сообщения разговора в этом формате. |
metadata | объект | Объект метаданных Messages. |
model (обязательное) | строка | Фиксированное значение grok-4.7. |
stop_sequences | массив или null | Массив строк остановки. |
stream | логическое значение или null | Логическое значение; по умолчанию false. |
system | объект или другая допустимая форма | Системная строка или блоки содержимого. |
temperature | число или null | Число от 0 до 2; по умолчанию 1. |
tool_choice | объект или другая допустимая форма | Автоматический выбор, отключение, обязательный вызов или выбранный инструмент; синтаксис зависит от формата. |
tools | массив или null | Определения инструментов; не больше 350. |
top_k | целое число или null | Целое число; в Responses требуется не меньше 1. |
top_p | число или null | Число больше 0 и не больше 1; по умолчанию 1. |
Потоковая передача
Установите stream в true. Chat передаёт фрагменты завершения; Responses — именованные события ответа; Messages — события сообщений и блоков содержимого. Читайте итоговое событие использования наряду с текстовыми приращениями. Вызовы инструментов и рассуждения могут быть отдельными элементами вывода; при сохранении истории не сводите поток только к видимому тексту.
{
"model": "grok-4.7",
"input": "Explain a mutex in one sentence.",
"reasoning": { "effort": "low" },
"max_output_tokens": 128,
"store": false,
"stream": true
}Инструменты и структурированный вывод
Используйте определение инструмента для выбранного формата. Chat использует response_format, а Responses — text.format. С этой моделью проверены функции, веб-поиск, поиск в X, интерпретатор кода и вызовы MCP. Shell возвращает вызов для выполнения клиентом; он не запускает команду на вашем компьютере автоматически. Полная схема также описывает другие типы инструментов; сама запись в схеме не доказывает, что конкретный внешний сервис настроен.
{
"model": "grok-4.7",
"input": "Use the code interpreter once to compute 13*17. Return the number.",
"tools": [{ "type": "code_interpreter" }],
"tool_choice": "required",
"max_turns": 1,
"reasoning": { "effort": "low" },
"max_output_tokens": 32,
"store": false
}Использование инструментов оплачивается отдельно от токенов. Для веб-поиска и интерпретатора кода учитывается число вызовов. Для поиска в X учитывается число полученных публикаций и профилей, включая повторно полученные элементы; количество вызовов поиска в X не является единицей оплаты. Проверяйте usage.server_side_tool_usage_details и записи об использовании в аккаунте.
Расход токенов и цены
Цены зависят от общей длины ввода. При вводе меньше 200 000 токенов используйте стандартную ступень тарифа. При 200 000 и более применяется ступень для длинного контекста ко всему запросу; кэшированный ввод учитывается при выборе ступени. service_tier: "priority" и "fast" удваивают тарифы на токены в обеих ступенях. auto и default выбирают стандартное обслуживание. Плата за инструменты рассчитывается отдельно и не удваивается этим множителем токенов.
| Формат | Учёт ввода | Учёт вывода |
|---|---|---|
| Responses | input_tokens включает input_tokens_details.cached_tokens | output_tokens включает рассуждения; не прибавляйте их детализацию повторно |
| Chat | prompt_tokens включает prompt_tokens_details.cached_tokens | xAI отдельно сообщает видимые completion_tokens; весь оплачиваемый вывод равен total_tokens - prompt_tokens, включая рассуждения |
| Messages | input_tokens не включает cache_read_input_tokens; добавьте поля кэша, чтобы получить общий ввод | output_tokens — общий объём вывода |
Публичные ответы содержат счётчики использования, но не денежные суммы. Итоговая плата отображается в записях об использовании. Неудачные запросы не оплачиваются.
История разговора и текущие ограничения
Для продолжения без сохранения состояния передайте предыдущий ввод, каждый возвращённый элемент вывода и следующее сообщение пользователя как новый input. Для Chat или Messages отправляйте полную историю сообщений в соответствующем формате. Сохраняйте возвращённые элементы зашифрованных рассуждений и инструментов без изменений.
Текущий сервис не может продолжать по previous_response_id, получать или удалять сохранённый ответ, выводить список сохранённых входных элементов либо возвращать отложенные завершения Chat. При создании может приниматься store: true, но это не подтверждает поддержку хранения или получения ответов. Эти поля остаются в официальном контракте и Playground; ограничение не заменяет определение их предусмотренного поведения.
Вложения файлов не сработали с протестированными входными данными в виде встроенного текста и URL PDF. Запросы генерации изображений вернули текст без изображений, а поиск инструментов не завершил обнаружение на стороне сервера. Доступность этих возможностей не подтверждена. Для поиска Collections также нужен действительный ресурс collection; эта возможность не проверена.
Chat игнорирует frequency_penalty, presence_penalty, logit_bias, stop, logprobs и top_logprobs. Responses игнорирует background, context_management, metadata, truncation, logprobs и top_logprobs. Они не пересылаются и не предлагаются как активные элементы управления.
Ошибки
Недопустимый запрос возвращает ошибку вместо завершённого ответа. Проверьте значения полей и публичный справочник ошибок. Запросы, вернувшие ошибку, не оплачиваются.
