Text
Grok 4.7
Utilisez Grok 4.7 avec les formats natifs Chat Completions, Responses ou Messages. Paramètres, streaming, consommation et limites actuelles.
Utilisez grok-4.7 avec l’un des trois formats ci-dessous. L’authentification repose sur votre clé API SeedRouter. La page du modèle propose un Playground et les tarifs actuels des tokens ; le guide des prix explique l’entrée en cache et le raisonnement.
Démarrage rapide
curl https://api.seedrouter.ai/v1/responses \
-H "Authorization: Bearer $SEEDROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"grok-4.7","input":"What is 2 + 2?","reasoning":{"effort":"low"},"max_output_tokens":64,"store":false}'La réponse JSON contient des éléments output et usage. Conservez tous les éléments de sortie pour construire l’historique de conversation, y compris ceux du raisonnement et des outils.
Formats de requête
| Format | Point de terminaison | Champs obligatoires |
|---|---|---|
| Responses | POST /v1/responses | model, input |
| Chat Completions | POST /v1/chat/completions | model, messages |
| Messages | POST /v1/messages | model, messages, max_tokens |
Utilisez Content-Type: application/json et Authorization: Bearer $SEEDROUTER_API_KEY. Les clients Messages peuvent aussi envoyer anthropic-version: 2023-06-01.
Paramètres et contraintes
La spécification OpenAPI contient les schémas complets et imbriqués des requêtes et réponses. Les tableaux ci-dessous recensent tous les champs de requête de premier niveau pris en charge. Les champs inconnus et les paramètres officiellement ignorés par ce modèle sont supprimés. Un paramètre pris en charge dont la valeur est invalide reste invalide.
Les champs facultatifs acceptant null autorisent un null explicite ; si un champ est omis, sa valeur par défaut dans l’API s’applique. Le Playground masque user et fixe model à grok-4.7. Les clients API peuvent toujours envoyer user.
- Contexte : 500 000 tokens, conversation et sortie comprises.
- Effort de raisonnement :
low,medium,high,xhigh; par défaut,high. max_completion_tokensetmax_output_tokensvalent par défaut 128 000 tokens de sortie visibles. Les tokens de raisonnement et d’appels de fonctions ne font pas partie de cette limite de sortie visible. Il s’agit d’une valeur par défaut, pas d’une affirmation sur la capacité maximale de sortie.- Les limites de sortie doivent être des entiers positifs. L’API applique aussi son plafond de sécurité existant de 1 073 741 823 pour les entiers ; la capacité du contexte reste applicable.
temperature: de 0 à 2, valeur par défaut 1.top_p: strictement supérieur à 0 et inférieur ou égal à 1, valeur par défaut 1. Pour Responses,min_p: de 0 à 1 ;top_k: entier supérieur ou égal à 1.- Jusqu’à 350 définitions d’outils.
stream_optionsexigestream: true. instructionsetprevious_response_idne peuvent pas être combinés. Les résumés du raisonnement sont toujours détaillés.
Paramètres de Responses
| Champ | Type | Règle |
|---|---|---|
include | tableau ou null | Tableau des champs supplémentaires à inclure dans la réponse. |
input (obligatoire) | objet ou autre forme acceptée | Chaîne de texte ou tableau complet d’éléments d’entrée. |
instructions | chaîne ou null | Instructions système ; incompatibles avec previous_response_id. |
max_output_tokens | entier ou null | Limite de sortie visible ; par défaut, 128 000. |
max_turns | entier ou null | Nombre maximal de tours de l’agent, sous forme d’entier. |
min_p | nombre ou null | Nombre compris entre 0 et 1. |
model (obligatoire) | chaîne | Fixé à grok-4.7. |
parallel_tool_calls | booléen ou null | Booléen ; par défaut, true. |
previous_response_id | chaîne ou null | ID de réponse sous forme de chaîne ; la continuation par ID est actuellement indisponible. |
prompt_cache_key | chaîne ou null | Clé de cache sous forme de chaîne. |
reasoning | objet | Configuration du raisonnement ; effort par défaut : high. |
reasoning_effort | chaîne ou null | low, medium, high, xhigh ; par défaut, high. |
safety_identifier | chaîne ou null | Identifiant de sécurité facultatif fourni par l’appelant. |
search_parameters | objet | Configuration de la recherche. |
service_tier | chaîne | auto, default, priority, fast ; priority et fast doublent les tarifs des tokens. |
store | booléen ou null | Booléen ; par défaut, true. Les opérations sur les réponses stockées sont actuellement indisponibles. |
stream | booléen ou null | Booléen ; par défaut, false. |
temperature | nombre ou null | Nombre compris entre 0 et 2 ; par défaut, 1. |
text | objet | Configuration de la réponse textuelle, dont format. |
tool_choice | objet ou autre forme acceptée | Automatique, désactivé, obligatoire ou outil sélectionné ; la syntaxe dépend du format. |
tools | tableau ou null | Définitions d’outils ; 350 au maximum. |
top_k | entier ou null | Entier ; Responses exige une valeur supérieure ou égale à 1. |
top_p | nombre ou null | Nombre strictement supérieur à 0 et inférieur ou égal à 1 ; par défaut, 1. |
user | chaîne ou null | Identifiant facultatif fourni par l’appelant ; masqué dans le Playground. |
Paramètres de Chat Completions
| Champ | Type | Règle |
|---|---|---|
deferred | booléen ou null | Booléen ; par défaut, false. La complétion différée est actuellement indisponible. |
max_completion_tokens | entier ou null | Limite de sortie visible ; par défaut, 128 000. |
max_tokens | entier ou null | Limite positive de sortie visible. Obligatoire pour Messages. |
messages (obligatoire) | tableau | Messages de conversation dans ce format. |
model (obligatoire) | chaîne | Fixé à grok-4.7. |
n | entier ou null | Entier supérieur ou égal à 1 ; par défaut, 1. |
parallel_tool_calls | booléen ou null | Booléen ; par défaut, true. |
prompt_cache_key | chaîne ou null | Clé de cache sous forme de chaîne. |
reasoning_effort | chaîne ou null | low, medium, high, xhigh ; par défaut, high. |
response_format | objet ou autre forme acceptée | Sortie textuelle, objet JSON ou sortie conforme à un schéma JSON. |
safety_identifier | chaîne ou null | Identifiant de sécurité facultatif fourni par l’appelant. |
search_parameters | objet | Configuration de la recherche. |
seed | entier ou null | Graine d’échantillonnage entière. |
service_tier | chaîne | auto, default, priority, fast ; priority et fast doublent les tarifs des tokens. |
stream | booléen ou null | Booléen ; par défaut, false. |
stream_options | objet | Options de streaming ; exige stream: true. |
temperature | nombre ou null | Nombre compris entre 0 et 2 ; par défaut, 1. |
tool_choice | objet ou autre forme acceptée | Automatique, désactivé, obligatoire ou outil sélectionné ; la syntaxe dépend du format. |
tools | tableau ou null | Définitions d’outils ; 350 au maximum. |
top_p | nombre ou null | Nombre strictement supérieur à 0 et inférieur ou égal à 1 ; par défaut, 1. |
user | chaîne ou null | Identifiant facultatif fourni par l’appelant ; masqué dans le Playground. |
web_search_options | objet | Options de recherche de compatibilité. |
Paramètres de Messages
| Champ | Type | Règle |
|---|---|---|
max_tokens (obligatoire) | entier | Limite positive de sortie visible. Obligatoire pour Messages. |
messages (obligatoire) | tableau | Messages de conversation dans ce format. |
metadata | objet | Objet de métadonnées de Messages. |
model (obligatoire) | chaîne | Fixé à grok-4.7. |
stop_sequences | tableau ou null | Tableau de chaînes d’arrêt. |
stream | booléen ou null | Booléen ; par défaut, false. |
system | objet ou autre forme acceptée | Chaîne système ou blocs de contenu. |
temperature | nombre ou null | Nombre compris entre 0 et 2 ; par défaut, 1. |
tool_choice | objet ou autre forme acceptée | Automatique, désactivé, obligatoire ou outil sélectionné ; la syntaxe dépend du format. |
tools | tableau ou null | Définitions d’outils ; 350 au maximum. |
top_k | entier ou null | Entier ; Responses exige une valeur supérieure ou égale à 1. |
top_p | nombre ou null | Nombre strictement supérieur à 0 et inférieur ou égal à 1 ; par défaut, 1. |
Streaming
Définissez stream sur true. Chat émet des fragments de complétion ; Responses émet des événements de réponse nommés ; Messages émet des événements de message et de bloc de contenu. Lisez l’événement final d’utilisation en plus des deltas de texte. Les appels d’outils et le raisonnement peuvent constituer des éléments de sortie distincts ; ne réduisez pas le flux au texte visible lorsque vous conservez l’historique.
{
"model": "grok-4.7",
"input": "Explain a mutex in one sentence.",
"reasoning": { "effort": "low" },
"max_output_tokens": 128,
"store": false,
"stream": true
}Outils et sortie structurée
Utilisez la définition d’outil correspondant au format choisi. Chat utilise response_format ; Responses utilise text.format. Les fonctions, la recherche web, la recherche X, l’interpréteur de code et les appels MCP ont été testés avec ce modèle. Shell renvoie un appel à exécuter côté client ; il ne lance pas automatiquement une commande sur votre ordinateur. Le schéma complet décrit aussi d’autres types d’outils ; la présence d’une entrée dans le schéma ne prouve pas qu’un service externe particulier est configuré.
{
"model": "grok-4.7",
"input": "Use the code interpreter once to compute 13*17. Return the number.",
"tools": [{ "type": "code_interpreter" }],
"tool_choice": "required",
"max_turns": 1,
"reasoning": { "effort": "low" },
"max_output_tokens": 32,
"store": false
}L’utilisation des outils est facturée séparément des tokens. La recherche web et l’interpréteur de code sont comptabilisés par appel. La recherche X utilise le nombre de publications et de profils récupérés, y compris les éléments récupérés plusieurs fois ; le nombre d’appels de recherche X n’est pas son unité de facturation. Consultez usage.server_side_tool_usage_details et les relevés d’utilisation de votre compte.
Consommation et tarifs
Les tarifs dépendent de la longueur totale de l’entrée. En dessous de 200 000 tokens d’entrée, utilisez le palier standard. À partir de 200 000, le palier de contexte long s’applique à toute la requête ; l’entrée en cache compte dans le choix du palier. service_tier: "priority" et "fast" doublent les tarifs des tokens dans les deux paliers. auto et default sélectionnent le service standard. Les frais d’outils sont calculés séparément et ne sont pas doublés par ce multiplicateur de tokens.
| Format | Comptabilisation de l’entrée | Comptabilisation de la sortie |
|---|---|---|
| Responses | input_tokens inclut input_tokens_details.cached_tokens | output_tokens inclut le raisonnement ; n’ajoutez pas à nouveau son détail |
| Chat | prompt_tokens inclut prompt_tokens_details.cached_tokens | xAI indique séparément les completion_tokens visibles ; la sortie totale facturable est total_tokens - prompt_tokens, raisonnement compris |
| Messages | input_tokens exclut cache_read_input_tokens ; ajoutez les champs de cache pour obtenir l’entrée totale | output_tokens est le total de sortie |
Les réponses publiques contiennent des compteurs d’utilisation, pas de champs monétaires. Vos relevés d’utilisation affichent le montant final. Les requêtes échouées ne sont pas facturées.
Historique de conversation et limites actuelles
Pour poursuivre sans état, envoyez l’entrée précédente, tous les éléments de sortie retournés et le prochain message utilisateur comme nouvel input. Avec Chat ou Messages, envoyez l’historique complet des messages dans le format correspondant. Conservez sans modification les éléments de raisonnement chiffré et d’outils lorsqu’ils sont retournés.
Le service actuel ne permet pas de poursuivre avec previous_response_id, de récupérer ou supprimer une réponse stockée, de lister les éléments d’entrée stockés, ni de renvoyer des complétions Chat différées. store: true peut être accepté à la création, mais cela ne démontre pas la prise en charge du stockage ou de la récupération des réponses. Ces champs restent dans le contrat officiel et le Playground ; cette limite ne redéfinit pas leur comportement prévu.
Les pièces jointes n’ont pas fonctionné avec les entrées testées de texte intégré et d’URL PDF. Les requêtes de génération d’images ont renvoyé du texte sans image, et la recherche d’outils n’a pas achevé la découverte côté serveur. Ces capacités ne sont pas vérifiées comme disponibles. La recherche Collections nécessite aussi une ressource collection valide et n’a pas été vérifiée.
Chat ignore frequency_penalty, presence_penalty, logit_bias, stop, logprobs et top_logprobs. Responses ignore background, context_management, metadata, truncation, logprobs et top_logprobs. Ces champs ne sont ni transmis ni proposés comme commandes actives.
Erreurs
Une requête invalide renvoie une erreur plutôt qu’une réponse terminée. Vérifiez les valeurs des champs et la référence publique des erreurs. Les requêtes qui renvoient une erreur ne sont pas facturées.
