Claude Opus 5.5 ya está disponible en SeedRouter
LogoSeedRouter

Busca modelos por nombre, p. ej. 'nano banana'

Busca modelos por nombre, p. ej. 'nano banana'

Text

Grok 4.7

View Markdown

Usa Grok 4.7 con solicitudes nativas de Chat Completions, Responses o Messages. Parámetros, streaming, consumo y límites actuales.

Usa grok-4.7 con uno de los tres formatos siguientes. La autenticación utiliza tu clave API de SeedRouter. La página del modelo incluye un Playground y los precios actuales de los tokens; la guía de precios explica la entrada en caché y el razonamiento.

Inicio rápido

curl https://api.seedrouter.ai/v1/responses \
  -H "Authorization: Bearer $SEEDROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"grok-4.7","input":"What is 2 + 2?","reasoning":{"effort":"low"},"max_output_tokens":64,"store":false}'

La respuesta JSON incluye elementos de output y usage. Conserva todos los elementos de salida al construir el historial de la conversación, incluidos los de razonamiento y herramientas.

Formatos de solicitud

FormatoEndpointCampos obligatorios
ResponsesPOST /v1/responsesmodel, input
Chat CompletionsPOST /v1/chat/completionsmodel, messages
MessagesPOST /v1/messagesmodel, messages, max_tokens

Usa Content-Type: application/json y Authorization: Bearer $SEEDROUTER_API_KEY. Los clientes de Messages también pueden enviar anthropic-version: 2023-06-01.

Parámetros y restricciones

La especificación OpenAPI contiene los esquemas completos y anidados de solicitudes y respuestas. Las tablas siguientes enumeran todos los campos de solicitud de nivel superior compatibles. Los campos desconocidos y los parámetros que este modelo ignora oficialmente se descartan. Un parámetro compatible con un valor no válido sigue siendo no válido.

Los campos opcionales que admiten null aceptan un null explícito; al omitir un campo se usa su valor predeterminado de la API. El Playground oculta user y fija model en grok-4.7. Los clientes de la API pueden seguir enviando user.

  • Contexto: 500.000 tokens, incluidos la conversación y la salida.
  • Esfuerzo de razonamiento: low, medium, high, xhigh; valor predeterminado: high.
  • max_completion_tokens y max_output_tokens tienen un valor predeterminado de 128.000 tokens de salida visibles. Los tokens de razonamiento y de llamadas a funciones quedan fuera de ese límite de salida visible. Es un valor predeterminado, no una afirmación sobre la capacidad máxima de salida.
  • Los límites de salida deben ser enteros positivos. La API también aplica su límite de seguridad existente para enteros de 1.073.741.823; la capacidad de contexto sigue siendo aplicable.
  • temperature: de 0 a 2, predeterminado 1. top_p: mayor que 0 y como máximo 1, predeterminado 1. En Responses, min_p: de 0 a 1; top_k: entero de al menos 1.
  • Hasta 350 definiciones de herramientas. stream_options requiere stream: true.
  • instructions y previous_response_id no se pueden combinar. Los resúmenes del razonamiento siempre son detallados.

Parámetros de Responses

CampoTipoRegla
includearray o nullArray de campos adicionales que se incluirán en la respuesta.
input (obligatorio)objeto u otra forma admitidaCadena de texto o array completo de elementos de entrada.
instructionscadena o nullInstrucciones del sistema; no se pueden combinar con previous_response_id.
max_output_tokensentero o nullLímite de salida visible; predeterminado: 128.000.
max_turnsentero o nullNúmero máximo de turnos del agente, expresado como entero.
min_pnúmero o nullNúmero de 0 a 1.
model (obligatorio)cadenaFijado en grok-4.7.
parallel_tool_callsbooleano o nullBooleano; predeterminado: true.
previous_response_idcadena o nullID de respuesta como cadena; la continuación por ID no está disponible actualmente.
prompt_cache_keycadena o nullClave de caché como cadena.
reasoningobjetoConfiguración del razonamiento; esfuerzo predeterminado: high.
reasoning_effortcadena o nulllow, medium, high, xhigh; predeterminado: high.
safety_identifiercadena o nullIdentificador de seguridad opcional proporcionado por quien realiza la llamada.
search_parametersobjetoConfiguración de búsqueda.
service_tiercadenaauto, default, priority, fast; priority y fast duplican las tarifas de tokens.
storebooleano o nullBooleano; predeterminado: true. Las operaciones con respuestas almacenadas no están disponibles actualmente.
streambooleano o nullBooleano; predeterminado: false.
temperaturenúmero o nullNúmero de 0 a 2; predeterminado: 1.
textobjetoConfiguración de la respuesta de texto, incluido format.
tool_choiceobjeto u otra forma admitidaAutomático, desactivado, obligatorio o una herramienta seleccionada; la sintaxis depende del formato.
toolsarray o nullDefiniciones de herramientas; como máximo 350.
top_kentero o nullEntero; Responses exige al menos 1.
top_pnúmero o nullNúmero mayor que 0 y como máximo 1; predeterminado: 1.
usercadena o nullIdentificador opcional proporcionado por quien realiza la llamada; oculto en el Playground.

Parámetros de Chat Completions

CampoTipoRegla
deferredbooleano o nullBooleano; predeterminado: false. La finalización diferida no está disponible actualmente.
max_completion_tokensentero o nullLímite de salida visible; predeterminado: 128.000.
max_tokensentero o nullLímite positivo de salida visible. Obligatorio para Messages.
messages (obligatorio)arrayMensajes de conversación en este formato.
model (obligatorio)cadenaFijado en grok-4.7.
nentero o nullEntero de al menos 1; predeterminado: 1.
parallel_tool_callsbooleano o nullBooleano; predeterminado: true.
prompt_cache_keycadena o nullClave de caché como cadena.
reasoning_effortcadena o nulllow, medium, high, xhigh; predeterminado: high.
response_formatobjeto u otra forma admitidaSalida de texto, objeto JSON o salida conforme a un esquema JSON.
safety_identifiercadena o nullIdentificador de seguridad opcional proporcionado por quien realiza la llamada.
search_parametersobjetoConfiguración de búsqueda.
seedentero o nullSemilla de muestreo entera.
service_tiercadenaauto, default, priority, fast; priority y fast duplican las tarifas de tokens.
streambooleano o nullBooleano; predeterminado: false.
stream_optionsobjetoOpciones de streaming; requiere stream: true.
temperaturenúmero o nullNúmero de 0 a 2; predeterminado: 1.
tool_choiceobjeto u otra forma admitidaAutomático, desactivado, obligatorio o una herramienta seleccionada; la sintaxis depende del formato.
toolsarray o nullDefiniciones de herramientas; como máximo 350.
top_pnúmero o nullNúmero mayor que 0 y como máximo 1; predeterminado: 1.
usercadena o nullIdentificador opcional proporcionado por quien realiza la llamada; oculto en el Playground.
web_search_optionsobjetoOpciones de búsqueda de compatibilidad.

Parámetros de Messages

CampoTipoRegla
max_tokens (obligatorio)enteroLímite positivo de salida visible. Obligatorio para Messages.
messages (obligatorio)arrayMensajes de conversación en este formato.
metadataobjetoObjeto de metadatos de Messages.
model (obligatorio)cadenaFijado en grok-4.7.
stop_sequencesarray o nullArray de cadenas de parada.
streambooleano o nullBooleano; predeterminado: false.
systemobjeto u otra forma admitidaCadena del sistema o bloques de contenido.
temperaturenúmero o nullNúmero de 0 a 2; predeterminado: 1.
tool_choiceobjeto u otra forma admitidaAutomático, desactivado, obligatorio o una herramienta seleccionada; la sintaxis depende del formato.
toolsarray o nullDefiniciones de herramientas; como máximo 350.
top_kentero o nullEntero; Responses exige al menos 1.
top_pnúmero o nullNúmero mayor que 0 y como máximo 1; predeterminado: 1.

Streaming

Establece stream en true. Chat emite fragmentos de finalización; Responses emite eventos de respuesta con nombre; Messages emite eventos de mensaje y de bloque de contenido. Lee el evento final de uso además de los incrementos de texto. Las llamadas a herramientas y el razonamiento pueden ser elementos de salida independientes; no reduzcas el flujo al texto visible cuando guardes el historial.

{
  "model": "grok-4.7",
  "input": "Explain a mutex in one sentence.",
  "reasoning": { "effort": "low" },
  "max_output_tokens": 128,
  "store": false,
  "stream": true
}

Herramientas y salida estructurada

Usa la definición de herramienta correspondiente al formato elegido. Chat utiliza response_format; Responses utiliza text.format. Las funciones, la búsqueda web, la búsqueda en X, el intérprete de código y las llamadas MCP se han probado con este modelo. Shell devuelve una llamada que ejecuta el cliente; no ejecuta automáticamente un comando en tu ordenador. El esquema completo también describe otros tipos de herramientas; una entrada del esquema por sí sola no demuestra que un servicio externo concreto esté configurado.

{
  "model": "grok-4.7",
  "input": "Use the code interpreter once to compute 13*17. Return the number.",
  "tools": [{ "type": "code_interpreter" }],
  "tool_choice": "required",
  "max_turns": 1,
  "reasoning": { "effort": "low" },
  "max_output_tokens": 32,
  "store": false
}

El uso de herramientas se cobra por separado de los tokens. La búsqueda web y el intérprete de código se contabilizan por llamadas. La búsqueda en X utiliza el número de publicaciones y perfiles recuperados, incluidos los elementos recuperados varias veces; el número de llamadas de búsqueda en X no es su unidad de facturación. Consulta usage.server_side_tool_usage_details y los registros de uso de tu cuenta.

Consumo y precios

Los precios dependen de la longitud total de entrada. Por debajo de 200.000 tokens de entrada, usa el tramo estándar. A partir de 200.000, usa el tramo de contexto largo para toda la solicitud; la entrada en caché cuenta al seleccionar el tramo. service_tier: "priority" y "fast" duplican las tarifas de tokens en ambos tramos. auto y default seleccionan el servicio estándar. Los cargos de herramientas se calculan por separado y no se duplican con este multiplicador de tokens.

FormatoCálculo de entradaCálculo de salida
Responsesinput_tokens incluye input_tokens_details.cached_tokensoutput_tokens incluye el razonamiento; no vuelvas a sumar su desglose
Chatprompt_tokens incluye prompt_tokens_details.cached_tokensxAI informa por separado de los completion_tokens visibles; la salida total facturable es total_tokens - prompt_tokens, incluido el razonamiento
Messagesinput_tokens excluye cache_read_input_tokens; suma los campos de caché para obtener la entrada totaloutput_tokens es el total de salida

Las respuestas públicas incluyen contadores de uso, no campos de importes monetarios. Tus registros de uso muestran el cargo final. Las solicitudes fallidas no se cobran.

Historial de conversación y límites actuales

Para continuar sin estado, envía la entrada anterior, todos los elementos de salida devueltos y el siguiente mensaje del usuario como el nuevo input. Con Chat o Messages, envía el historial completo de mensajes en ese formato. Conserva sin cambios los elementos de razonamiento cifrado y de herramientas cuando se devuelvan.

El servicio actual no permite continuar con previous_response_id, recuperar o eliminar una respuesta almacenada, listar los elementos de entrada almacenados ni devolver finalizaciones diferidas de Chat. Puede aceptarse store: true al crear la respuesta, pero esto no demuestra compatibilidad con su almacenamiento o recuperación. Estos campos siguen presentes en el contrato oficial y en el Playground; esta limitación no redefine su comportamiento previsto.

Los archivos adjuntos no han funcionado con las entradas probadas de texto en línea y URL de PDF. Las solicitudes de generación de imágenes devolvieron texto sin imágenes y la búsqueda de herramientas no completó el descubrimiento en el servidor. Estas capacidades no están verificadas como disponibles. La búsqueda en Collections también requiere un recurso collection válido y no se ha verificado.

Chat ignora frequency_penalty, presence_penalty, logit_bias, stop, logprobs y top_logprobs. Responses ignora background, context_management, metadata, truncation, logprobs y top_logprobs. No se reenvían ni se ofrecen como controles activos.

Errores

Una solicitud no válida devuelve un error en lugar de una respuesta completada. Revisa los valores de los campos y la referencia pública de errores. Las solicitudes que devuelven un error no se cobran.