Text
Grok 4.7
Use o Grok 4.7 com requisições nativas de Chat Completions, Responses ou Messages. Parâmetros, streaming, uso e limites atuais dos recursos.
Use grok-4.7 com um dos três formatos abaixo. A autenticação usa sua chave de API da SeedRouter. A página do modelo inclui um Playground e os preços atuais dos tokens; o guia de preços explica a entrada em cache e o raciocínio.
Início rápido
curl https://api.seedrouter.ai/v1/responses \
-H "Authorization: Bearer $SEEDROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"grok-4.7","input":"What is 2 + 2?","reasoning":{"effort":"low"},"max_output_tokens":64,"store":false}'A resposta JSON inclui itens de output e usage. Ao montar o histórico da conversa, preserve todos os itens de saída, incluindo os de raciocínio e de ferramentas.
Formatos de requisição
| Formato | Endpoint | Campos obrigatórios |
|---|---|---|
| Responses | POST /v1/responses | model, input |
| Chat Completions | POST /v1/chat/completions | model, messages |
| Messages | POST /v1/messages | model, messages, max_tokens |
Use Content-Type: application/json e Authorization: Bearer $SEEDROUTER_API_KEY. Clientes de Messages também podem enviar anthropic-version: 2023-06-01.
Parâmetros e restrições
A especificação OpenAPI contém os esquemas completos e aninhados de requisição e resposta. As tabelas abaixo listam todos os campos de primeiro nível aceitos nas requisições. Campos desconhecidos e parâmetros que este modelo ignora oficialmente são descartados. Um parâmetro aceito com um valor inválido continua inválido.
Campos opcionais que permitem null aceitam null explícito; omitir um campo usa seu padrão da API. O Playground oculta user e fixa model em grok-4.7. Clientes da API ainda podem enviar user.
- Contexto: 500.000 tokens, incluindo a conversa e a saída.
- Esforço de raciocínio:
low,medium,high,xhigh; padrão:high. max_completion_tokensemax_output_tokenstêm como padrão 128.000 tokens de saída visíveis. Tokens de raciocínio e de chamadas de função ficam fora desse limite de saída visível. Esse é um valor padrão, não uma afirmação sobre a capacidade máxima de saída.- Os limites de saída devem ser inteiros positivos. A API também aplica seu teto de segurança existente para inteiros de 1.073.741.823; a capacidade do contexto continua se aplicando.
temperature: de 0 a 2, padrão 1.top_p: maior que 0 e no máximo 1, padrão 1. Em Responses,min_p: de 0 a 1;top_k: inteiro de pelo menos 1.- Até 350 definições de ferramentas.
stream_optionsexigestream: true. instructionseprevious_response_idnão podem ser combinados. Os resumos de raciocínio são sempre detalhados.
Parâmetros de Responses
| Campo | Tipo | Regra |
|---|---|---|
include | array ou null | Array de campos adicionais a incluir na resposta. |
input (obrigatório) | objeto ou outra forma aceita | String de texto ou array completo de itens de entrada. |
instructions | string ou null | Instruções do sistema; não podem ser combinadas com previous_response_id. |
max_output_tokens | inteiro ou null | Limite de saída visível; padrão: 128.000. |
max_turns | inteiro ou null | Número inteiro máximo de turnos do agente. |
min_p | número ou null | Número de 0 a 1. |
model (obrigatório) | string | Fixo em grok-4.7. |
parallel_tool_calls | booleano ou null | Booleano; padrão: true. |
previous_response_id | string ou null | ID da resposta como string; a continuação por ID está indisponível no momento. |
prompt_cache_key | string ou null | Chave de cache como string. |
reasoning | objeto | Configuração de raciocínio; esforço padrão: high. |
reasoning_effort | string ou null | low, medium, high, xhigh; padrão: high. |
safety_identifier | string ou null | Identificador de segurança opcional fornecido por quem faz a chamada. |
search_parameters | objeto | Configuração de busca. |
service_tier | string | auto, default, priority, fast; priority e fast dobram as tarifas de tokens. |
store | booleano ou null | Booleano; padrão: true. Operações com respostas armazenadas estão indisponíveis no momento. |
stream | booleano ou null | Booleano; padrão: false. |
temperature | número ou null | Número de 0 a 2; padrão: 1. |
text | objeto | Configuração da resposta de texto, incluindo format. |
tool_choice | objeto ou outra forma aceita | Automático, desativado, obrigatório ou uma ferramenta selecionada; a sintaxe depende do formato. |
tools | array ou null | Definições de ferramentas; no máximo 350. |
top_k | inteiro ou null | Inteiro; Responses exige pelo menos 1. |
top_p | número ou null | Número maior que 0 e no máximo 1; padrão: 1. |
user | string ou null | Identificador opcional fornecido por quem faz a chamada; oculto no Playground. |
Parâmetros de Chat Completions
| Campo | Tipo | Regra |
|---|---|---|
deferred | booleano ou null | Booleano; padrão: false. A conclusão adiada está indisponível no momento. |
max_completion_tokens | inteiro ou null | Limite de saída visível; padrão: 128.000. |
max_tokens | inteiro ou null | Limite positivo de saída visível. Obrigatório em Messages. |
messages (obrigatório) | array | Mensagens da conversa neste formato. |
model (obrigatório) | string | Fixo em grok-4.7. |
n | inteiro ou null | Inteiro de pelo menos 1; padrão: 1. |
parallel_tool_calls | booleano ou null | Booleano; padrão: true. |
prompt_cache_key | string ou null | Chave de cache como string. |
reasoning_effort | string ou null | low, medium, high, xhigh; padrão: high. |
response_format | objeto ou outra forma aceita | Texto, objeto JSON ou saída conforme um esquema JSON. |
safety_identifier | string ou null | Identificador de segurança opcional fornecido por quem faz a chamada. |
search_parameters | objeto | Configuração de busca. |
seed | inteiro ou null | Semente inteira de amostragem. |
service_tier | string | auto, default, priority, fast; priority e fast dobram as tarifas de tokens. |
stream | booleano ou null | Booleano; padrão: false. |
stream_options | objeto | Opções de streaming; exige stream: true. |
temperature | número ou null | Número de 0 a 2; padrão: 1. |
tool_choice | objeto ou outra forma aceita | Automático, desativado, obrigatório ou uma ferramenta selecionada; a sintaxe depende do formato. |
tools | array ou null | Definições de ferramentas; no máximo 350. |
top_p | número ou null | Número maior que 0 e no máximo 1; padrão: 1. |
user | string ou null | Identificador opcional fornecido por quem faz a chamada; oculto no Playground. |
web_search_options | objeto | Opções de busca de compatibilidade. |
Parâmetros de Messages
| Campo | Tipo | Regra |
|---|---|---|
max_tokens (obrigatório) | inteiro | Limite positivo de saída visível. Obrigatório em Messages. |
messages (obrigatório) | array | Mensagens da conversa neste formato. |
metadata | objeto | Objeto de metadados de Messages. |
model (obrigatório) | string | Fixo em grok-4.7. |
stop_sequences | array ou null | Array de strings de parada. |
stream | booleano ou null | Booleano; padrão: false. |
system | objeto ou outra forma aceita | String do sistema ou blocos de conteúdo. |
temperature | número ou null | Número de 0 a 2; padrão: 1. |
tool_choice | objeto ou outra forma aceita | Automático, desativado, obrigatório ou uma ferramenta selecionada; a sintaxe depende do formato. |
tools | array ou null | Definições de ferramentas; no máximo 350. |
top_k | inteiro ou null | Inteiro; Responses exige pelo menos 1. |
top_p | número ou null | Número maior que 0 e no máximo 1; padrão: 1. |
Streaming
Defina stream como true. Chat emite fragmentos de conclusão; Responses emite eventos de resposta nomeados; Messages emite eventos de mensagem e de bloco de conteúdo. Leia o evento final de uso além dos deltas de texto. Chamadas de ferramentas e raciocínio podem ser itens de saída separados; ao preservar o histórico, não reduza o fluxo ao texto visível.
{
"model": "grok-4.7",
"input": "Explain a mutex in one sentence.",
"reasoning": { "effort": "low" },
"max_output_tokens": 128,
"store": false,
"stream": true
}Ferramentas e saída estruturada
Use a definição de ferramenta do formato escolhido. Chat usa response_format; Responses usa text.format. Funções, busca na web, busca no X, interpretador de código e chamadas MCP foram testados com este modelo. Shell retorna uma chamada a ser executada pelo cliente; ele não executa automaticamente um comando no seu computador. O esquema completo também descreve outros tipos de ferramentas; uma entrada no esquema, por si só, não comprova que um serviço externo específico está configurado.
{
"model": "grok-4.7",
"input": "Use the code interpreter once to compute 13*17. Return the number.",
"tools": [{ "type": "code_interpreter" }],
"tool_choice": "required",
"max_turns": 1,
"reasoning": { "effort": "low" },
"max_output_tokens": 32,
"store": false
}O uso de ferramentas é cobrado separadamente dos tokens. Busca na web e interpretador de código usam contagens de chamadas. A busca no X usa o número de publicações e perfis recuperados, incluindo itens recuperados repetidamente; o número de chamadas de busca no X não é sua unidade de cobrança. Confira usage.server_side_tool_usage_details e os registros de uso da sua conta.
Consumo e preços
Os preços dependem do tamanho total da entrada. Abaixo de 200.000 tokens de entrada, use a faixa padrão. A partir de 200.000, use a faixa de contexto longo para toda a requisição; a entrada em cache conta na seleção da faixa. service_tier: "priority" e "fast" dobram as tarifas de tokens nas duas faixas. auto e default selecionam o serviço padrão. As cobranças de ferramentas são calculadas à parte e não dobram com esse multiplicador de tokens.
| Formato | Contabilização da entrada | Contabilização da saída |
|---|---|---|
| Responses | input_tokens inclui input_tokens_details.cached_tokens | output_tokens inclui o raciocínio; não some novamente seu detalhamento |
| Chat | prompt_tokens inclui prompt_tokens_details.cached_tokens | xAI informa os completion_tokens visíveis separadamente; a saída total cobrável é total_tokens - prompt_tokens, incluindo o raciocínio |
| Messages | input_tokens exclui cache_read_input_tokens; some os campos de cache para obter a entrada total | output_tokens é o total de saída |
As respostas públicas incluem contadores de uso, não campos de valores monetários. Seus registros de uso mostram a cobrança final. Requisições com falha não são cobradas.
Histórico da conversa e limites atuais
Para continuar sem estado, envie a entrada anterior, todos os itens de saída retornados e a próxima mensagem do usuário como o novo input. Com Chat ou Messages, envie o histórico completo de mensagens no formato correspondente. Preserve sem alterações os itens de raciocínio criptografado e de ferramentas, quando retornados.
O serviço atual não consegue continuar com previous_response_id, recuperar ou excluir uma resposta armazenada, listar itens de entrada armazenados ou retornar conclusões adiadas de Chat. store: true pode ser aceito na criação, mas isso não comprova suporte ao armazenamento ou à recuperação de respostas. Esses campos permanecem no contrato oficial e no Playground; essa limitação não redefine seu comportamento previsto.
Anexos de arquivos não funcionaram com as entradas testadas de texto inline e URLs de PDF. Requisições de geração de imagens retornaram texto sem imagens, e a busca de ferramentas não concluiu a descoberta no servidor. Esses recursos não foram verificados como disponíveis. A busca em Collections também exige um recurso collection válido e não foi verificada.
Chat ignora frequency_penalty, presence_penalty, logit_bias, stop, logprobs e top_logprobs. Responses ignora background, context_management, metadata, truncation, logprobs e top_logprobs. Eles não são encaminhados nem oferecidos como controles ativos.
Erros
Uma requisição inválida retorna um erro em vez de uma resposta concluída. Verifique os valores dos campos e a referência pública de erros. Requisições que retornam erro não são cobradas.
