Text
Grok 4.7
Usa Grok 4.7 con solicitudes nativas de Chat Completions, Responses o Messages. Parámetros, streaming, consumo y límites actuales.
Usa grok-4.7 con uno de los tres formatos siguientes. La autenticación utiliza tu clave API de SeedRouter. La página del modelo incluye un Playground y los precios actuales de los tokens; la guía de precios explica la entrada en caché y el razonamiento.
Inicio rápido
curl https://api.seedrouter.ai/v1/responses \
-H "Authorization: Bearer $SEEDROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"grok-4.7","input":"What is 2 + 2?","reasoning":{"effort":"low"},"max_output_tokens":64,"store":false}'La respuesta JSON incluye elementos de output y usage. Conserva todos los elementos de salida al construir el historial de la conversación, incluidos los de razonamiento y herramientas.
Formatos de solicitud
| Formato | Endpoint | Campos obligatorios |
|---|---|---|
| Responses | POST /v1/responses | model, input |
| Chat Completions | POST /v1/chat/completions | model, messages |
| Messages | POST /v1/messages | model, messages, max_tokens |
Usa Content-Type: application/json y Authorization: Bearer $SEEDROUTER_API_KEY. Los clientes de Messages también pueden enviar anthropic-version: 2023-06-01.
Parámetros y restricciones
La especificación OpenAPI contiene los esquemas completos y anidados de solicitudes y respuestas. Las tablas siguientes enumeran todos los campos de solicitud de nivel superior compatibles. Los campos desconocidos y los parámetros que este modelo ignora oficialmente se descartan. Un parámetro compatible con un valor no válido sigue siendo no válido.
Los campos opcionales que admiten null aceptan un null explícito; al omitir un campo se usa su valor predeterminado de la API. El Playground oculta user y fija model en grok-4.7. Los clientes de la API pueden seguir enviando user.
- Contexto: 500.000 tokens, incluidos la conversación y la salida.
- Esfuerzo de razonamiento:
low,medium,high,xhigh; valor predeterminado:high. max_completion_tokensymax_output_tokenstienen un valor predeterminado de 128.000 tokens de salida visibles. Los tokens de razonamiento y de llamadas a funciones quedan fuera de ese límite de salida visible. Es un valor predeterminado, no una afirmación sobre la capacidad máxima de salida.- Los límites de salida deben ser enteros positivos. La API también aplica su límite de seguridad existente para enteros de 1.073.741.823; la capacidad de contexto sigue siendo aplicable.
temperature: de 0 a 2, predeterminado 1.top_p: mayor que 0 y como máximo 1, predeterminado 1. En Responses,min_p: de 0 a 1;top_k: entero de al menos 1.- Hasta 350 definiciones de herramientas.
stream_optionsrequierestream: true. instructionsyprevious_response_idno se pueden combinar. Los resúmenes del razonamiento siempre son detallados.
Parámetros de Responses
| Campo | Tipo | Regla |
|---|---|---|
include | array o null | Array de campos adicionales que se incluirán en la respuesta. |
input (obligatorio) | objeto u otra forma admitida | Cadena de texto o array completo de elementos de entrada. |
instructions | cadena o null | Instrucciones del sistema; no se pueden combinar con previous_response_id. |
max_output_tokens | entero o null | Límite de salida visible; predeterminado: 128.000. |
max_turns | entero o null | Número máximo de turnos del agente, expresado como entero. |
min_p | número o null | Número de 0 a 1. |
model (obligatorio) | cadena | Fijado en grok-4.7. |
parallel_tool_calls | booleano o null | Booleano; predeterminado: true. |
previous_response_id | cadena o null | ID de respuesta como cadena; la continuación por ID no está disponible actualmente. |
prompt_cache_key | cadena o null | Clave de caché como cadena. |
reasoning | objeto | Configuración del razonamiento; esfuerzo predeterminado: high. |
reasoning_effort | cadena o null | low, medium, high, xhigh; predeterminado: high. |
safety_identifier | cadena o null | Identificador de seguridad opcional proporcionado por quien realiza la llamada. |
search_parameters | objeto | Configuración de búsqueda. |
service_tier | cadena | auto, default, priority, fast; priority y fast duplican las tarifas de tokens. |
store | booleano o null | Booleano; predeterminado: true. Las operaciones con respuestas almacenadas no están disponibles actualmente. |
stream | booleano o null | Booleano; predeterminado: false. |
temperature | número o null | Número de 0 a 2; predeterminado: 1. |
text | objeto | Configuración de la respuesta de texto, incluido format. |
tool_choice | objeto u otra forma admitida | Automático, desactivado, obligatorio o una herramienta seleccionada; la sintaxis depende del formato. |
tools | array o null | Definiciones de herramientas; como máximo 350. |
top_k | entero o null | Entero; Responses exige al menos 1. |
top_p | número o null | Número mayor que 0 y como máximo 1; predeterminado: 1. |
user | cadena o null | Identificador opcional proporcionado por quien realiza la llamada; oculto en el Playground. |
Parámetros de Chat Completions
| Campo | Tipo | Regla |
|---|---|---|
deferred | booleano o null | Booleano; predeterminado: false. La finalización diferida no está disponible actualmente. |
max_completion_tokens | entero o null | Límite de salida visible; predeterminado: 128.000. |
max_tokens | entero o null | Límite positivo de salida visible. Obligatorio para Messages. |
messages (obligatorio) | array | Mensajes de conversación en este formato. |
model (obligatorio) | cadena | Fijado en grok-4.7. |
n | entero o null | Entero de al menos 1; predeterminado: 1. |
parallel_tool_calls | booleano o null | Booleano; predeterminado: true. |
prompt_cache_key | cadena o null | Clave de caché como cadena. |
reasoning_effort | cadena o null | low, medium, high, xhigh; predeterminado: high. |
response_format | objeto u otra forma admitida | Salida de texto, objeto JSON o salida conforme a un esquema JSON. |
safety_identifier | cadena o null | Identificador de seguridad opcional proporcionado por quien realiza la llamada. |
search_parameters | objeto | Configuración de búsqueda. |
seed | entero o null | Semilla de muestreo entera. |
service_tier | cadena | auto, default, priority, fast; priority y fast duplican las tarifas de tokens. |
stream | booleano o null | Booleano; predeterminado: false. |
stream_options | objeto | Opciones de streaming; requiere stream: true. |
temperature | número o null | Número de 0 a 2; predeterminado: 1. |
tool_choice | objeto u otra forma admitida | Automático, desactivado, obligatorio o una herramienta seleccionada; la sintaxis depende del formato. |
tools | array o null | Definiciones de herramientas; como máximo 350. |
top_p | número o null | Número mayor que 0 y como máximo 1; predeterminado: 1. |
user | cadena o null | Identificador opcional proporcionado por quien realiza la llamada; oculto en el Playground. |
web_search_options | objeto | Opciones de búsqueda de compatibilidad. |
Parámetros de Messages
| Campo | Tipo | Regla |
|---|---|---|
max_tokens (obligatorio) | entero | Límite positivo de salida visible. Obligatorio para Messages. |
messages (obligatorio) | array | Mensajes de conversación en este formato. |
metadata | objeto | Objeto de metadatos de Messages. |
model (obligatorio) | cadena | Fijado en grok-4.7. |
stop_sequences | array o null | Array de cadenas de parada. |
stream | booleano o null | Booleano; predeterminado: false. |
system | objeto u otra forma admitida | Cadena del sistema o bloques de contenido. |
temperature | número o null | Número de 0 a 2; predeterminado: 1. |
tool_choice | objeto u otra forma admitida | Automático, desactivado, obligatorio o una herramienta seleccionada; la sintaxis depende del formato. |
tools | array o null | Definiciones de herramientas; como máximo 350. |
top_k | entero o null | Entero; Responses exige al menos 1. |
top_p | número o null | Número mayor que 0 y como máximo 1; predeterminado: 1. |
Streaming
Establece stream en true. Chat emite fragmentos de finalización; Responses emite eventos de respuesta con nombre; Messages emite eventos de mensaje y de bloque de contenido. Lee el evento final de uso además de los incrementos de texto. Las llamadas a herramientas y el razonamiento pueden ser elementos de salida independientes; no reduzcas el flujo al texto visible cuando guardes el historial.
{
"model": "grok-4.7",
"input": "Explain a mutex in one sentence.",
"reasoning": { "effort": "low" },
"max_output_tokens": 128,
"store": false,
"stream": true
}Herramientas y salida estructurada
Usa la definición de herramienta correspondiente al formato elegido. Chat utiliza response_format; Responses utiliza text.format. Las funciones, la búsqueda web, la búsqueda en X, el intérprete de código y las llamadas MCP se han probado con este modelo. Shell devuelve una llamada que ejecuta el cliente; no ejecuta automáticamente un comando en tu ordenador. El esquema completo también describe otros tipos de herramientas; una entrada del esquema por sí sola no demuestra que un servicio externo concreto esté configurado.
{
"model": "grok-4.7",
"input": "Use the code interpreter once to compute 13*17. Return the number.",
"tools": [{ "type": "code_interpreter" }],
"tool_choice": "required",
"max_turns": 1,
"reasoning": { "effort": "low" },
"max_output_tokens": 32,
"store": false
}El uso de herramientas se cobra por separado de los tokens. La búsqueda web y el intérprete de código se contabilizan por llamadas. La búsqueda en X utiliza el número de publicaciones y perfiles recuperados, incluidos los elementos recuperados varias veces; el número de llamadas de búsqueda en X no es su unidad de facturación. Consulta usage.server_side_tool_usage_details y los registros de uso de tu cuenta.
Consumo y precios
Los precios dependen de la longitud total de entrada. Por debajo de 200.000 tokens de entrada, usa el tramo estándar. A partir de 200.000, usa el tramo de contexto largo para toda la solicitud; la entrada en caché cuenta al seleccionar el tramo. service_tier: "priority" y "fast" duplican las tarifas de tokens en ambos tramos. auto y default seleccionan el servicio estándar. Los cargos de herramientas se calculan por separado y no se duplican con este multiplicador de tokens.
| Formato | Cálculo de entrada | Cálculo de salida |
|---|---|---|
| Responses | input_tokens incluye input_tokens_details.cached_tokens | output_tokens incluye el razonamiento; no vuelvas a sumar su desglose |
| Chat | prompt_tokens incluye prompt_tokens_details.cached_tokens | xAI informa por separado de los completion_tokens visibles; la salida total facturable es total_tokens - prompt_tokens, incluido el razonamiento |
| Messages | input_tokens excluye cache_read_input_tokens; suma los campos de caché para obtener la entrada total | output_tokens es el total de salida |
Las respuestas públicas incluyen contadores de uso, no campos de importes monetarios. Tus registros de uso muestran el cargo final. Las solicitudes fallidas no se cobran.
Historial de conversación y límites actuales
Para continuar sin estado, envía la entrada anterior, todos los elementos de salida devueltos y el siguiente mensaje del usuario como el nuevo input. Con Chat o Messages, envía el historial completo de mensajes en ese formato. Conserva sin cambios los elementos de razonamiento cifrado y de herramientas cuando se devuelvan.
El servicio actual no permite continuar con previous_response_id, recuperar o eliminar una respuesta almacenada, listar los elementos de entrada almacenados ni devolver finalizaciones diferidas de Chat. Puede aceptarse store: true al crear la respuesta, pero esto no demuestra compatibilidad con su almacenamiento o recuperación. Estos campos siguen presentes en el contrato oficial y en el Playground; esta limitación no redefine su comportamiento previsto.
Los archivos adjuntos no han funcionado con las entradas probadas de texto en línea y URL de PDF. Las solicitudes de generación de imágenes devolvieron texto sin imágenes y la búsqueda de herramientas no completó el descubrimiento en el servidor. Estas capacidades no están verificadas como disponibles. La búsqueda en Collections también requiere un recurso collection válido y no se ha verificado.
Chat ignora frequency_penalty, presence_penalty, logit_bias, stop, logprobs y top_logprobs. Responses ignora background, context_management, metadata, truncation, logprobs y top_logprobs. No se reenvían ni se ofrecen como controles activos.
Errores
Una solicitud no válida devuelve un error en lugar de una respuesta completada. Revisa los valores de los campos y la referencia pública de errores. Las solicitudes que devuelven un error no se cobran.
