Claude Opus 5.5 est disponible sur SeedRouter
LogoSeedRouter

Rechercher un modèle par nom, ex. « nano banana »

Rechercher un modèle par nom, ex. « nano banana »

Text

Grok 4.7

View Markdown

Utilisez Grok 4.7 avec les formats natifs Chat Completions, Responses ou Messages. Paramètres, streaming, consommation et limites actuelles.

Utilisez grok-4.7 avec l’un des trois formats ci-dessous. L’authentification repose sur votre clé API SeedRouter. La page du modèle propose un Playground et les tarifs actuels des tokens ; le guide des prix explique l’entrée en cache et le raisonnement.

Démarrage rapide

curl https://api.seedrouter.ai/v1/responses \
  -H "Authorization: Bearer $SEEDROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"grok-4.7","input":"What is 2 + 2?","reasoning":{"effort":"low"},"max_output_tokens":64,"store":false}'

La réponse JSON contient des éléments output et usage. Conservez tous les éléments de sortie pour construire l’historique de conversation, y compris ceux du raisonnement et des outils.

Formats de requête

FormatPoint de terminaisonChamps obligatoires
ResponsesPOST /v1/responsesmodel, input
Chat CompletionsPOST /v1/chat/completionsmodel, messages
MessagesPOST /v1/messagesmodel, messages, max_tokens

Utilisez Content-Type: application/json et Authorization: Bearer $SEEDROUTER_API_KEY. Les clients Messages peuvent aussi envoyer anthropic-version: 2023-06-01.

Paramètres et contraintes

La spécification OpenAPI contient les schémas complets et imbriqués des requêtes et réponses. Les tableaux ci-dessous recensent tous les champs de requête de premier niveau pris en charge. Les champs inconnus et les paramètres officiellement ignorés par ce modèle sont supprimés. Un paramètre pris en charge dont la valeur est invalide reste invalide.

Les champs facultatifs acceptant null autorisent un null explicite ; si un champ est omis, sa valeur par défaut dans l’API s’applique. Le Playground masque user et fixe model à grok-4.7. Les clients API peuvent toujours envoyer user.

  • Contexte : 500 000 tokens, conversation et sortie comprises.
  • Effort de raisonnement : low, medium, high, xhigh ; par défaut, high.
  • max_completion_tokens et max_output_tokens valent par défaut 128 000 tokens de sortie visibles. Les tokens de raisonnement et d’appels de fonctions ne font pas partie de cette limite de sortie visible. Il s’agit d’une valeur par défaut, pas d’une affirmation sur la capacité maximale de sortie.
  • Les limites de sortie doivent être des entiers positifs. L’API applique aussi son plafond de sécurité existant de 1 073 741 823 pour les entiers ; la capacité du contexte reste applicable.
  • temperature : de 0 à 2, valeur par défaut 1. top_p : strictement supérieur à 0 et inférieur ou égal à 1, valeur par défaut 1. Pour Responses, min_p : de 0 à 1 ; top_k : entier supérieur ou égal à 1.
  • Jusqu’à 350 définitions d’outils. stream_options exige stream: true.
  • instructions et previous_response_id ne peuvent pas être combinés. Les résumés du raisonnement sont toujours détaillés.

Paramètres de Responses

ChampTypeRègle
includetableau ou nullTableau des champs supplémentaires à inclure dans la réponse.
input (obligatoire)objet ou autre forme acceptéeChaîne de texte ou tableau complet d’éléments d’entrée.
instructionschaîne ou nullInstructions système ; incompatibles avec previous_response_id.
max_output_tokensentier ou nullLimite de sortie visible ; par défaut, 128 000.
max_turnsentier ou nullNombre maximal de tours de l’agent, sous forme d’entier.
min_pnombre ou nullNombre compris entre 0 et 1.
model (obligatoire)chaîneFixé à grok-4.7.
parallel_tool_callsbooléen ou nullBooléen ; par défaut, true.
previous_response_idchaîne ou nullID de réponse sous forme de chaîne ; la continuation par ID est actuellement indisponible.
prompt_cache_keychaîne ou nullClé de cache sous forme de chaîne.
reasoningobjetConfiguration du raisonnement ; effort par défaut : high.
reasoning_effortchaîne ou nulllow, medium, high, xhigh ; par défaut, high.
safety_identifierchaîne ou nullIdentifiant de sécurité facultatif fourni par l’appelant.
search_parametersobjetConfiguration de la recherche.
service_tierchaîneauto, default, priority, fast ; priority et fast doublent les tarifs des tokens.
storebooléen ou nullBooléen ; par défaut, true. Les opérations sur les réponses stockées sont actuellement indisponibles.
streambooléen ou nullBooléen ; par défaut, false.
temperaturenombre ou nullNombre compris entre 0 et 2 ; par défaut, 1.
textobjetConfiguration de la réponse textuelle, dont format.
tool_choiceobjet ou autre forme acceptéeAutomatique, désactivé, obligatoire ou outil sélectionné ; la syntaxe dépend du format.
toolstableau ou nullDéfinitions d’outils ; 350 au maximum.
top_kentier ou nullEntier ; Responses exige une valeur supérieure ou égale à 1.
top_pnombre ou nullNombre strictement supérieur à 0 et inférieur ou égal à 1 ; par défaut, 1.
userchaîne ou nullIdentifiant facultatif fourni par l’appelant ; masqué dans le Playground.

Paramètres de Chat Completions

ChampTypeRègle
deferredbooléen ou nullBooléen ; par défaut, false. La complétion différée est actuellement indisponible.
max_completion_tokensentier ou nullLimite de sortie visible ; par défaut, 128 000.
max_tokensentier ou nullLimite positive de sortie visible. Obligatoire pour Messages.
messages (obligatoire)tableauMessages de conversation dans ce format.
model (obligatoire)chaîneFixé à grok-4.7.
nentier ou nullEntier supérieur ou égal à 1 ; par défaut, 1.
parallel_tool_callsbooléen ou nullBooléen ; par défaut, true.
prompt_cache_keychaîne ou nullClé de cache sous forme de chaîne.
reasoning_effortchaîne ou nulllow, medium, high, xhigh ; par défaut, high.
response_formatobjet ou autre forme acceptéeSortie textuelle, objet JSON ou sortie conforme à un schéma JSON.
safety_identifierchaîne ou nullIdentifiant de sécurité facultatif fourni par l’appelant.
search_parametersobjetConfiguration de la recherche.
seedentier ou nullGraine d’échantillonnage entière.
service_tierchaîneauto, default, priority, fast ; priority et fast doublent les tarifs des tokens.
streambooléen ou nullBooléen ; par défaut, false.
stream_optionsobjetOptions de streaming ; exige stream: true.
temperaturenombre ou nullNombre compris entre 0 et 2 ; par défaut, 1.
tool_choiceobjet ou autre forme acceptéeAutomatique, désactivé, obligatoire ou outil sélectionné ; la syntaxe dépend du format.
toolstableau ou nullDéfinitions d’outils ; 350 au maximum.
top_pnombre ou nullNombre strictement supérieur à 0 et inférieur ou égal à 1 ; par défaut, 1.
userchaîne ou nullIdentifiant facultatif fourni par l’appelant ; masqué dans le Playground.
web_search_optionsobjetOptions de recherche de compatibilité.

Paramètres de Messages

ChampTypeRègle
max_tokens (obligatoire)entierLimite positive de sortie visible. Obligatoire pour Messages.
messages (obligatoire)tableauMessages de conversation dans ce format.
metadataobjetObjet de métadonnées de Messages.
model (obligatoire)chaîneFixé à grok-4.7.
stop_sequencestableau ou nullTableau de chaînes d’arrêt.
streambooléen ou nullBooléen ; par défaut, false.
systemobjet ou autre forme acceptéeChaîne système ou blocs de contenu.
temperaturenombre ou nullNombre compris entre 0 et 2 ; par défaut, 1.
tool_choiceobjet ou autre forme acceptéeAutomatique, désactivé, obligatoire ou outil sélectionné ; la syntaxe dépend du format.
toolstableau ou nullDéfinitions d’outils ; 350 au maximum.
top_kentier ou nullEntier ; Responses exige une valeur supérieure ou égale à 1.
top_pnombre ou nullNombre strictement supérieur à 0 et inférieur ou égal à 1 ; par défaut, 1.

Streaming

Définissez stream sur true. Chat émet des fragments de complétion ; Responses émet des événements de réponse nommés ; Messages émet des événements de message et de bloc de contenu. Lisez l’événement final d’utilisation en plus des deltas de texte. Les appels d’outils et le raisonnement peuvent constituer des éléments de sortie distincts ; ne réduisez pas le flux au texte visible lorsque vous conservez l’historique.

{
  "model": "grok-4.7",
  "input": "Explain a mutex in one sentence.",
  "reasoning": { "effort": "low" },
  "max_output_tokens": 128,
  "store": false,
  "stream": true
}

Outils et sortie structurée

Utilisez la définition d’outil correspondant au format choisi. Chat utilise response_format ; Responses utilise text.format. Les fonctions, la recherche web, la recherche X, l’interpréteur de code et les appels MCP ont été testés avec ce modèle. Shell renvoie un appel à exécuter côté client ; il ne lance pas automatiquement une commande sur votre ordinateur. Le schéma complet décrit aussi d’autres types d’outils ; la présence d’une entrée dans le schéma ne prouve pas qu’un service externe particulier est configuré.

{
  "model": "grok-4.7",
  "input": "Use the code interpreter once to compute 13*17. Return the number.",
  "tools": [{ "type": "code_interpreter" }],
  "tool_choice": "required",
  "max_turns": 1,
  "reasoning": { "effort": "low" },
  "max_output_tokens": 32,
  "store": false
}

L’utilisation des outils est facturée séparément des tokens. La recherche web et l’interpréteur de code sont comptabilisés par appel. La recherche X utilise le nombre de publications et de profils récupérés, y compris les éléments récupérés plusieurs fois ; le nombre d’appels de recherche X n’est pas son unité de facturation. Consultez usage.server_side_tool_usage_details et les relevés d’utilisation de votre compte.

Consommation et tarifs

Les tarifs dépendent de la longueur totale de l’entrée. En dessous de 200 000 tokens d’entrée, utilisez le palier standard. À partir de 200 000, le palier de contexte long s’applique à toute la requête ; l’entrée en cache compte dans le choix du palier. service_tier: "priority" et "fast" doublent les tarifs des tokens dans les deux paliers. auto et default sélectionnent le service standard. Les frais d’outils sont calculés séparément et ne sont pas doublés par ce multiplicateur de tokens.

FormatComptabilisation de l’entréeComptabilisation de la sortie
Responsesinput_tokens inclut input_tokens_details.cached_tokensoutput_tokens inclut le raisonnement ; n’ajoutez pas à nouveau son détail
Chatprompt_tokens inclut prompt_tokens_details.cached_tokensxAI indique séparément les completion_tokens visibles ; la sortie totale facturable est total_tokens - prompt_tokens, raisonnement compris
Messagesinput_tokens exclut cache_read_input_tokens ; ajoutez les champs de cache pour obtenir l’entrée totaleoutput_tokens est le total de sortie

Les réponses publiques contiennent des compteurs d’utilisation, pas de champs monétaires. Vos relevés d’utilisation affichent le montant final. Les requêtes échouées ne sont pas facturées.

Historique de conversation et limites actuelles

Pour poursuivre sans état, envoyez l’entrée précédente, tous les éléments de sortie retournés et le prochain message utilisateur comme nouvel input. Avec Chat ou Messages, envoyez l’historique complet des messages dans le format correspondant. Conservez sans modification les éléments de raisonnement chiffré et d’outils lorsqu’ils sont retournés.

Le service actuel ne permet pas de poursuivre avec previous_response_id, de récupérer ou supprimer une réponse stockée, de lister les éléments d’entrée stockés, ni de renvoyer des complétions Chat différées. store: true peut être accepté à la création, mais cela ne démontre pas la prise en charge du stockage ou de la récupération des réponses. Ces champs restent dans le contrat officiel et le Playground ; cette limite ne redéfinit pas leur comportement prévu.

Les pièces jointes n’ont pas fonctionné avec les entrées testées de texte intégré et d’URL PDF. Les requêtes de génération d’images ont renvoyé du texte sans image, et la recherche d’outils n’a pas achevé la découverte côté serveur. Ces capacités ne sont pas vérifiées comme disponibles. La recherche Collections nécessite aussi une ressource collection valide et n’a pas été vérifiée.

Chat ignore frequency_penalty, presence_penalty, logit_bias, stop, logprobs et top_logprobs. Responses ignore background, context_management, metadata, truncation, logprobs et top_logprobs. Ces champs ne sont ni transmis ni proposés comme commandes actives.

Erreurs

Une requête invalide renvoie une erreur plutôt qu’une réponse terminée. Vérifiez les valeurs des champs et la référence publique des erreurs. Les requêtes qui renvoient une erreur ne sont pas facturées.