Claude Opus 5.5 è disponibile su SeedRouter
LogoSeedRouter

Cerca modelli per nome, es. 'nano banana'

Cerca modelli per nome, es. 'nano banana'

Text

Grok 4.7

View Markdown

Usa Grok 4.7 con richieste native Chat Completions, Responses o Messages. Parametri, streaming, consumo e limiti attuali delle funzionalità.

Usa grok-4.7 con uno dei tre formati seguenti. L’autenticazione usa la tua chiave API SeedRouter. La pagina del modello include un Playground e i prezzi attuali dei token; la guida ai prezzi spiega l’input nella cache e il ragionamento.

Avvio rapido

curl https://api.seedrouter.ai/v1/responses \
  -H "Authorization: Bearer $SEEDROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"grok-4.7","input":"What is 2 + 2?","reasoning":{"effort":"low"},"max_output_tokens":64,"store":false}'

La risposta JSON include gli elementi output e usage. Quando costruisci la cronologia della conversazione, conserva tutti gli elementi di output, inclusi quelli di ragionamento e degli strumenti.

Formati delle richieste

FormatoEndpointCampi obbligatori
ResponsesPOST /v1/responsesmodel, input
Chat CompletionsPOST /v1/chat/completionsmodel, messages
MessagesPOST /v1/messagesmodel, messages, max_tokens

Usa Content-Type: application/json e Authorization: Bearer $SEEDROUTER_API_KEY. I client Messages possono anche inviare anthropic-version: 2023-06-01.

Parametri e vincoli

La specifica OpenAPI contiene gli schemi completi e annidati delle richieste e delle risposte. Le tabelle seguenti elencano tutti i campi di primo livello supportati nelle richieste. I campi sconosciuti e i parametri che il modello ignora ufficialmente vengono scartati. Un parametro supportato con un valore non valido rimane non valido.

I campi facoltativi che ammettono null accettano un null esplicito; omettendo un campo si usa il suo valore predefinito nell’API. Il Playground nasconde user e fissa model su grok-4.7. I client API possono comunque inviare user.

  • Contesto: 500.000 token, inclusi conversazione e output.
  • Livello di ragionamento: low, medium, high, xhigh; predefinito: high.
  • max_completion_tokens e max_output_tokens hanno un valore predefinito di 128.000 token di output visibili. I token di ragionamento e di chiamata alle funzioni non rientrano in questo limite di output visibile. Si tratta di un valore predefinito, non di una dichiarazione sulla capacità massima di output.
  • I limiti di output devono essere interi positivi. L’API applica anche il limite di sicurezza esistente per gli interi di 1.073.741.823; la capacità del contesto continua ad applicarsi.
  • temperature: da 0 a 2, predefinito 1. top_p: maggiore di 0 e non superiore a 1, predefinito 1. In Responses, min_p: da 0 a 1; top_k: intero pari almeno a 1.
  • Fino a 350 definizioni di strumenti. stream_options richiede stream: true.
  • instructions e previous_response_id non possono essere combinati. I riepiloghi del ragionamento sono sempre dettagliati.

Parametri di Responses

CampoTipoRegola
includearray o nullArray dei campi aggiuntivi da includere nella risposta.
input (obbligatorio)oggetto o altra forma supportataStringa di testo o array completo di elementi di input.
instructionsstringa o nullIstruzioni di sistema; non combinabili con previous_response_id.
max_output_tokensintero o nullLimite di output visibile; predefinito: 128.000.
max_turnsintero o nullNumero intero massimo di turni dell’agente.
min_pnumero o nullNumero da 0 a 1.
model (obbligatorio)stringaFissato su grok-4.7.
parallel_tool_callsbooleano o nullBooleano; predefinito: true.
previous_response_idstringa o nullID della risposta come stringa; la continuazione tramite ID non è attualmente disponibile.
prompt_cache_keystringa o nullChiave della cache come stringa.
reasoningoggettoConfigurazione del ragionamento; livello predefinito: high.
reasoning_effortstringa o nulllow, medium, high, xhigh; predefinito: high.
safety_identifierstringa o nullIdentificatore di sicurezza facoltativo fornito dal chiamante.
search_parametersoggettoConfigurazione della ricerca.
service_tierstringaauto, default, priority, fast; priority e fast raddoppiano le tariffe dei token.
storebooleano o nullBooleano; predefinito: true. Le operazioni sulle risposte memorizzate non sono attualmente disponibili.
streambooleano o nullBooleano; predefinito: false.
temperaturenumero o nullNumero da 0 a 2; predefinito: 1.
textoggettoConfigurazione della risposta testuale, incluso format.
tool_choiceoggetto o altra forma supportataAutomatico, disattivato, obbligatorio o uno strumento selezionato; la sintassi dipende dal formato.
toolsarray o nullDefinizioni degli strumenti; al massimo 350.
top_kintero o nullIntero; Responses richiede almeno 1.
top_pnumero o nullNumero maggiore di 0 e non superiore a 1; predefinito: 1.
userstringa o nullIdentificatore facoltativo fornito dal chiamante; nascosto nel Playground.

Parametri di Chat Completions

CampoTipoRegola
deferredbooleano o nullBooleano; predefinito: false. Il completamento differito non è attualmente disponibile.
max_completion_tokensintero o nullLimite di output visibile; predefinito: 128.000.
max_tokensintero o nullLimite positivo di output visibile. Obbligatorio per Messages.
messages (obbligatorio)arrayMessaggi della conversazione in questo formato.
model (obbligatorio)stringaFissato su grok-4.7.
nintero o nullIntero pari almeno a 1; predefinito: 1.
parallel_tool_callsbooleano o nullBooleano; predefinito: true.
prompt_cache_keystringa o nullChiave della cache come stringa.
reasoning_effortstringa o nulllow, medium, high, xhigh; predefinito: high.
response_formatoggetto o altra forma supportataTesto, oggetto JSON o output conforme a uno schema JSON.
safety_identifierstringa o nullIdentificatore di sicurezza facoltativo fornito dal chiamante.
search_parametersoggettoConfigurazione della ricerca.
seedintero o nullSeme intero per il campionamento.
service_tierstringaauto, default, priority, fast; priority e fast raddoppiano le tariffe dei token.
streambooleano o nullBooleano; predefinito: false.
stream_optionsoggettoOpzioni di streaming; richiede stream: true.
temperaturenumero o nullNumero da 0 a 2; predefinito: 1.
tool_choiceoggetto o altra forma supportataAutomatico, disattivato, obbligatorio o uno strumento selezionato; la sintassi dipende dal formato.
toolsarray o nullDefinizioni degli strumenti; al massimo 350.
top_pnumero o nullNumero maggiore di 0 e non superiore a 1; predefinito: 1.
userstringa o nullIdentificatore facoltativo fornito dal chiamante; nascosto nel Playground.
web_search_optionsoggettoOpzioni di ricerca per compatibilità.

Parametri di Messages

CampoTipoRegola
max_tokens (obbligatorio)interoLimite positivo di output visibile. Obbligatorio per Messages.
messages (obbligatorio)arrayMessaggi della conversazione in questo formato.
metadataoggettoOggetto dei metadati di Messages.
model (obbligatorio)stringaFissato su grok-4.7.
stop_sequencesarray o nullArray di stringhe di arresto.
streambooleano o nullBooleano; predefinito: false.
systemoggetto o altra forma supportataStringa di sistema o blocchi di contenuto.
temperaturenumero o nullNumero da 0 a 2; predefinito: 1.
tool_choiceoggetto o altra forma supportataAutomatico, disattivato, obbligatorio o uno strumento selezionato; la sintassi dipende dal formato.
toolsarray o nullDefinizioni degli strumenti; al massimo 350.
top_kintero o nullIntero; Responses richiede almeno 1.
top_pnumero o nullNumero maggiore di 0 e non superiore a 1; predefinito: 1.

Streaming

Imposta stream su true. Chat emette frammenti di completamento; Responses emette eventi di risposta con nome; Messages emette eventi di messaggio e di blocco di contenuto. Leggi l’evento finale di utilizzo oltre ai delta di testo. Le chiamate agli strumenti e il ragionamento possono essere elementi di output separati; quando conservi la cronologia, non ridurre il flusso al solo testo visibile.

{
  "model": "grok-4.7",
  "input": "Explain a mutex in one sentence.",
  "reasoning": { "effort": "low" },
  "max_output_tokens": 128,
  "store": false,
  "stream": true
}

Strumenti e output strutturato

Usa la definizione dello strumento prevista dal formato scelto. Chat usa response_format; Responses usa text.format. Funzioni, ricerca web, ricerca su X, interprete di codice e chiamate MCP sono stati provati con questo modello. Shell restituisce una chiamata da eseguire sul client; non esegue automaticamente un comando sul tuo computer. Lo schema completo descrive anche altri tipi di strumenti; una voce nello schema, da sola, non dimostra che un determinato servizio esterno sia configurato.

{
  "model": "grok-4.7",
  "input": "Use the code interpreter once to compute 13*17. Return the number.",
  "tools": [{ "type": "code_interpreter" }],
  "tool_choice": "required",
  "max_turns": 1,
  "reasoning": { "effort": "low" },
  "max_output_tokens": 32,
  "store": false
}

L’uso degli strumenti viene addebitato separatamente dai token. Ricerca web e interprete di codice si basano sul numero di chiamate. La ricerca su X si basa sul numero di post e profili recuperati, inclusi gli elementi recuperati più volte; il numero di chiamate di ricerca su X non è la sua unità di fatturazione. Controlla usage.server_side_tool_usage_details e i registri di utilizzo del tuo account.

Consumo e prezzi

I prezzi dipendono dalla lunghezza totale dell’input. Sotto 200.000 token di input, usa la fascia standard. Da 200.000 token in su, usa la fascia di contesto lungo per l’intera richiesta; l’input nella cache conta nella scelta della fascia. service_tier: "priority" e "fast" raddoppiano le tariffe dei token in entrambe le fasce. auto e default selezionano il servizio standard. I costi degli strumenti vengono calcolati a parte e non raddoppiano con questo moltiplicatore dei token.

FormatoConteggio dell’inputConteggio dell’output
Responsesinput_tokens include input_tokens_details.cached_tokensoutput_tokens include il ragionamento; non aggiungere di nuovo il dettaglio dei token di ragionamento
Chatprompt_tokens include prompt_tokens_details.cached_tokensxAI riporta separatamente i completion_tokens visibili; l’output totale fatturabile è total_tokens - prompt_tokens, ragionamento incluso
Messagesinput_tokens esclude cache_read_input_tokens; aggiungi i campi della cache per ottenere l’input totaleoutput_tokens è l’output totale

Le risposte pubbliche includono contatori di utilizzo, non campi con importi monetari. I registri di utilizzo mostrano l’addebito finale. Le richieste non riuscite non vengono addebitate.

Cronologia della conversazione e limiti attuali

Per continuare senza stato, invia l’input precedente, tutti gli elementi di output restituiti e il messaggio successivo dell’utente come nuovo input. Con Chat o Messages, invia la cronologia completa dei messaggi nel formato corrispondente. Mantieni invariati gli elementi di ragionamento cifrato e degli strumenti, quando vengono restituiti.

Il servizio attuale non può continuare tramite previous_response_id, recuperare o eliminare una risposta memorizzata, elencare gli elementi di input memorizzati o restituire completamenti Chat differiti. store: true può essere accettato alla creazione, ma ciò non dimostra il supporto per la memorizzazione o il recupero delle risposte. Questi campi rimangono nel contratto ufficiale e nel Playground; questa limitazione non ridefinisce il loro comportamento previsto.

Gli allegati non hanno funzionato con gli input testati di testo inline e URL di PDF. Le richieste di generazione di immagini hanno restituito testo senza immagini e la ricerca di strumenti non ha completato il rilevamento lato server. Queste funzionalità non sono state verificate come disponibili. La ricerca Collections richiede inoltre una risorsa collection valida e non è stata verificata.

Chat ignora frequency_penalty, presence_penalty, logit_bias, stop, logprobs e top_logprobs. Responses ignora background, context_management, metadata, truncation, logprobs e top_logprobs. Questi campi non vengono inoltrati né proposti come controlli attivi.

Errori

Una richiesta non valida restituisce un errore invece di una risposta completata. Controlla i valori dei campi e il riferimento pubblico degli errori. Le richieste che restituiscono un errore non vengono addebitate.