Claude Opus 5.5 já está disponível no SeedRouter
LogoSeedRouter

Busque modelos pelo nome, ex.: 'nano banana'

Busque modelos pelo nome, ex.: 'nano banana'

Text

Grok 4.7

View Markdown

Use o Grok 4.7 com requisições nativas de Chat Completions, Responses ou Messages. Parâmetros, streaming, uso e limites atuais dos recursos.

Use grok-4.7 com um dos três formatos abaixo. A autenticação usa sua chave de API da SeedRouter. A página do modelo inclui um Playground e os preços atuais dos tokens; o guia de preços explica a entrada em cache e o raciocínio.

Início rápido

curl https://api.seedrouter.ai/v1/responses \
  -H "Authorization: Bearer $SEEDROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"grok-4.7","input":"What is 2 + 2?","reasoning":{"effort":"low"},"max_output_tokens":64,"store":false}'

A resposta JSON inclui itens de output e usage. Ao montar o histórico da conversa, preserve todos os itens de saída, incluindo os de raciocínio e de ferramentas.

Formatos de requisição

FormatoEndpointCampos obrigatórios
ResponsesPOST /v1/responsesmodel, input
Chat CompletionsPOST /v1/chat/completionsmodel, messages
MessagesPOST /v1/messagesmodel, messages, max_tokens

Use Content-Type: application/json e Authorization: Bearer $SEEDROUTER_API_KEY. Clientes de Messages também podem enviar anthropic-version: 2023-06-01.

Parâmetros e restrições

A especificação OpenAPI contém os esquemas completos e aninhados de requisição e resposta. As tabelas abaixo listam todos os campos de primeiro nível aceitos nas requisições. Campos desconhecidos e parâmetros que este modelo ignora oficialmente são descartados. Um parâmetro aceito com um valor inválido continua inválido.

Campos opcionais que permitem null aceitam null explícito; omitir um campo usa seu padrão da API. O Playground oculta user e fixa model em grok-4.7. Clientes da API ainda podem enviar user.

  • Contexto: 500.000 tokens, incluindo a conversa e a saída.
  • Esforço de raciocínio: low, medium, high, xhigh; padrão: high.
  • max_completion_tokens e max_output_tokens têm como padrão 128.000 tokens de saída visíveis. Tokens de raciocínio e de chamadas de função ficam fora desse limite de saída visível. Esse é um valor padrão, não uma afirmação sobre a capacidade máxima de saída.
  • Os limites de saída devem ser inteiros positivos. A API também aplica seu teto de segurança existente para inteiros de 1.073.741.823; a capacidade do contexto continua se aplicando.
  • temperature: de 0 a 2, padrão 1. top_p: maior que 0 e no máximo 1, padrão 1. Em Responses, min_p: de 0 a 1; top_k: inteiro de pelo menos 1.
  • Até 350 definições de ferramentas. stream_options exige stream: true.
  • instructions e previous_response_id não podem ser combinados. Os resumos de raciocínio são sempre detalhados.

Parâmetros de Responses

CampoTipoRegra
includearray ou nullArray de campos adicionais a incluir na resposta.
input (obrigatório)objeto ou outra forma aceitaString de texto ou array completo de itens de entrada.
instructionsstring ou nullInstruções do sistema; não podem ser combinadas com previous_response_id.
max_output_tokensinteiro ou nullLimite de saída visível; padrão: 128.000.
max_turnsinteiro ou nullNúmero inteiro máximo de turnos do agente.
min_pnúmero ou nullNúmero de 0 a 1.
model (obrigatório)stringFixo em grok-4.7.
parallel_tool_callsbooleano ou nullBooleano; padrão: true.
previous_response_idstring ou nullID da resposta como string; a continuação por ID está indisponível no momento.
prompt_cache_keystring ou nullChave de cache como string.
reasoningobjetoConfiguração de raciocínio; esforço padrão: high.
reasoning_effortstring ou nulllow, medium, high, xhigh; padrão: high.
safety_identifierstring ou nullIdentificador de segurança opcional fornecido por quem faz a chamada.
search_parametersobjetoConfiguração de busca.
service_tierstringauto, default, priority, fast; priority e fast dobram as tarifas de tokens.
storebooleano ou nullBooleano; padrão: true. Operações com respostas armazenadas estão indisponíveis no momento.
streambooleano ou nullBooleano; padrão: false.
temperaturenúmero ou nullNúmero de 0 a 2; padrão: 1.
textobjetoConfiguração da resposta de texto, incluindo format.
tool_choiceobjeto ou outra forma aceitaAutomático, desativado, obrigatório ou uma ferramenta selecionada; a sintaxe depende do formato.
toolsarray ou nullDefinições de ferramentas; no máximo 350.
top_kinteiro ou nullInteiro; Responses exige pelo menos 1.
top_pnúmero ou nullNúmero maior que 0 e no máximo 1; padrão: 1.
userstring ou nullIdentificador opcional fornecido por quem faz a chamada; oculto no Playground.

Parâmetros de Chat Completions

CampoTipoRegra
deferredbooleano ou nullBooleano; padrão: false. A conclusão adiada está indisponível no momento.
max_completion_tokensinteiro ou nullLimite de saída visível; padrão: 128.000.
max_tokensinteiro ou nullLimite positivo de saída visível. Obrigatório em Messages.
messages (obrigatório)arrayMensagens da conversa neste formato.
model (obrigatório)stringFixo em grok-4.7.
ninteiro ou nullInteiro de pelo menos 1; padrão: 1.
parallel_tool_callsbooleano ou nullBooleano; padrão: true.
prompt_cache_keystring ou nullChave de cache como string.
reasoning_effortstring ou nulllow, medium, high, xhigh; padrão: high.
response_formatobjeto ou outra forma aceitaTexto, objeto JSON ou saída conforme um esquema JSON.
safety_identifierstring ou nullIdentificador de segurança opcional fornecido por quem faz a chamada.
search_parametersobjetoConfiguração de busca.
seedinteiro ou nullSemente inteira de amostragem.
service_tierstringauto, default, priority, fast; priority e fast dobram as tarifas de tokens.
streambooleano ou nullBooleano; padrão: false.
stream_optionsobjetoOpções de streaming; exige stream: true.
temperaturenúmero ou nullNúmero de 0 a 2; padrão: 1.
tool_choiceobjeto ou outra forma aceitaAutomático, desativado, obrigatório ou uma ferramenta selecionada; a sintaxe depende do formato.
toolsarray ou nullDefinições de ferramentas; no máximo 350.
top_pnúmero ou nullNúmero maior que 0 e no máximo 1; padrão: 1.
userstring ou nullIdentificador opcional fornecido por quem faz a chamada; oculto no Playground.
web_search_optionsobjetoOpções de busca de compatibilidade.

Parâmetros de Messages

CampoTipoRegra
max_tokens (obrigatório)inteiroLimite positivo de saída visível. Obrigatório em Messages.
messages (obrigatório)arrayMensagens da conversa neste formato.
metadataobjetoObjeto de metadados de Messages.
model (obrigatório)stringFixo em grok-4.7.
stop_sequencesarray ou nullArray de strings de parada.
streambooleano ou nullBooleano; padrão: false.
systemobjeto ou outra forma aceitaString do sistema ou blocos de conteúdo.
temperaturenúmero ou nullNúmero de 0 a 2; padrão: 1.
tool_choiceobjeto ou outra forma aceitaAutomático, desativado, obrigatório ou uma ferramenta selecionada; a sintaxe depende do formato.
toolsarray ou nullDefinições de ferramentas; no máximo 350.
top_kinteiro ou nullInteiro; Responses exige pelo menos 1.
top_pnúmero ou nullNúmero maior que 0 e no máximo 1; padrão: 1.

Streaming

Defina stream como true. Chat emite fragmentos de conclusão; Responses emite eventos de resposta nomeados; Messages emite eventos de mensagem e de bloco de conteúdo. Leia o evento final de uso além dos deltas de texto. Chamadas de ferramentas e raciocínio podem ser itens de saída separados; ao preservar o histórico, não reduza o fluxo ao texto visível.

{
  "model": "grok-4.7",
  "input": "Explain a mutex in one sentence.",
  "reasoning": { "effort": "low" },
  "max_output_tokens": 128,
  "store": false,
  "stream": true
}

Ferramentas e saída estruturada

Use a definição de ferramenta do formato escolhido. Chat usa response_format; Responses usa text.format. Funções, busca na web, busca no X, interpretador de código e chamadas MCP foram testados com este modelo. Shell retorna uma chamada a ser executada pelo cliente; ele não executa automaticamente um comando no seu computador. O esquema completo também descreve outros tipos de ferramentas; uma entrada no esquema, por si só, não comprova que um serviço externo específico está configurado.

{
  "model": "grok-4.7",
  "input": "Use the code interpreter once to compute 13*17. Return the number.",
  "tools": [{ "type": "code_interpreter" }],
  "tool_choice": "required",
  "max_turns": 1,
  "reasoning": { "effort": "low" },
  "max_output_tokens": 32,
  "store": false
}

O uso de ferramentas é cobrado separadamente dos tokens. Busca na web e interpretador de código usam contagens de chamadas. A busca no X usa o número de publicações e perfis recuperados, incluindo itens recuperados repetidamente; o número de chamadas de busca no X não é sua unidade de cobrança. Confira usage.server_side_tool_usage_details e os registros de uso da sua conta.

Consumo e preços

Os preços dependem do tamanho total da entrada. Abaixo de 200.000 tokens de entrada, use a faixa padrão. A partir de 200.000, use a faixa de contexto longo para toda a requisição; a entrada em cache conta na seleção da faixa. service_tier: "priority" e "fast" dobram as tarifas de tokens nas duas faixas. auto e default selecionam o serviço padrão. As cobranças de ferramentas são calculadas à parte e não dobram com esse multiplicador de tokens.

FormatoContabilização da entradaContabilização da saída
Responsesinput_tokens inclui input_tokens_details.cached_tokensoutput_tokens inclui o raciocínio; não some novamente seu detalhamento
Chatprompt_tokens inclui prompt_tokens_details.cached_tokensxAI informa os completion_tokens visíveis separadamente; a saída total cobrável é total_tokens - prompt_tokens, incluindo o raciocínio
Messagesinput_tokens exclui cache_read_input_tokens; some os campos de cache para obter a entrada totaloutput_tokens é o total de saída

As respostas públicas incluem contadores de uso, não campos de valores monetários. Seus registros de uso mostram a cobrança final. Requisições com falha não são cobradas.

Histórico da conversa e limites atuais

Para continuar sem estado, envie a entrada anterior, todos os itens de saída retornados e a próxima mensagem do usuário como o novo input. Com Chat ou Messages, envie o histórico completo de mensagens no formato correspondente. Preserve sem alterações os itens de raciocínio criptografado e de ferramentas, quando retornados.

O serviço atual não consegue continuar com previous_response_id, recuperar ou excluir uma resposta armazenada, listar itens de entrada armazenados ou retornar conclusões adiadas de Chat. store: true pode ser aceito na criação, mas isso não comprova suporte ao armazenamento ou à recuperação de respostas. Esses campos permanecem no contrato oficial e no Playground; essa limitação não redefine seu comportamento previsto.

Anexos de arquivos não funcionaram com as entradas testadas de texto inline e URLs de PDF. Requisições de geração de imagens retornaram texto sem imagens, e a busca de ferramentas não concluiu a descoberta no servidor. Esses recursos não foram verificados como disponíveis. A busca em Collections também exige um recurso collection válido e não foi verificada.

Chat ignora frequency_penalty, presence_penalty, logit_bias, stop, logprobs e top_logprobs. Responses ignora background, context_management, metadata, truncation, logprobs e top_logprobs. Eles não são encaminhados nem oferecidos como controles ativos.

Erros

Uma requisição inválida retorna um erro em vez de uma resposta concluída. Verifique os valores dos campos e a referência pública de erros. Requisições que retornam erro não são cobradas.