Text
Grok 4.7
Usa Grok 4.7 con richieste native Chat Completions, Responses o Messages. Parametri, streaming, consumo e limiti attuali delle funzionalità.
Usa grok-4.7 con uno dei tre formati seguenti. L’autenticazione usa la tua chiave API SeedRouter. La pagina del modello include un Playground e i prezzi attuali dei token; la guida ai prezzi spiega l’input nella cache e il ragionamento.
Avvio rapido
curl https://api.seedrouter.ai/v1/responses \
-H "Authorization: Bearer $SEEDROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"grok-4.7","input":"What is 2 + 2?","reasoning":{"effort":"low"},"max_output_tokens":64,"store":false}'La risposta JSON include gli elementi output e usage. Quando costruisci la cronologia della conversazione, conserva tutti gli elementi di output, inclusi quelli di ragionamento e degli strumenti.
Formati delle richieste
| Formato | Endpoint | Campi obbligatori |
|---|---|---|
| Responses | POST /v1/responses | model, input |
| Chat Completions | POST /v1/chat/completions | model, messages |
| Messages | POST /v1/messages | model, messages, max_tokens |
Usa Content-Type: application/json e Authorization: Bearer $SEEDROUTER_API_KEY. I client Messages possono anche inviare anthropic-version: 2023-06-01.
Parametri e vincoli
La specifica OpenAPI contiene gli schemi completi e annidati delle richieste e delle risposte. Le tabelle seguenti elencano tutti i campi di primo livello supportati nelle richieste. I campi sconosciuti e i parametri che il modello ignora ufficialmente vengono scartati. Un parametro supportato con un valore non valido rimane non valido.
I campi facoltativi che ammettono null accettano un null esplicito; omettendo un campo si usa il suo valore predefinito nell’API. Il Playground nasconde user e fissa model su grok-4.7. I client API possono comunque inviare user.
- Contesto: 500.000 token, inclusi conversazione e output.
- Livello di ragionamento:
low,medium,high,xhigh; predefinito:high. max_completion_tokensemax_output_tokenshanno un valore predefinito di 128.000 token di output visibili. I token di ragionamento e di chiamata alle funzioni non rientrano in questo limite di output visibile. Si tratta di un valore predefinito, non di una dichiarazione sulla capacità massima di output.- I limiti di output devono essere interi positivi. L’API applica anche il limite di sicurezza esistente per gli interi di 1.073.741.823; la capacità del contesto continua ad applicarsi.
temperature: da 0 a 2, predefinito 1.top_p: maggiore di 0 e non superiore a 1, predefinito 1. In Responses,min_p: da 0 a 1;top_k: intero pari almeno a 1.- Fino a 350 definizioni di strumenti.
stream_optionsrichiedestream: true. instructionseprevious_response_idnon possono essere combinati. I riepiloghi del ragionamento sono sempre dettagliati.
Parametri di Responses
| Campo | Tipo | Regola |
|---|---|---|
include | array o null | Array dei campi aggiuntivi da includere nella risposta. |
input (obbligatorio) | oggetto o altra forma supportata | Stringa di testo o array completo di elementi di input. |
instructions | stringa o null | Istruzioni di sistema; non combinabili con previous_response_id. |
max_output_tokens | intero o null | Limite di output visibile; predefinito: 128.000. |
max_turns | intero o null | Numero intero massimo di turni dell’agente. |
min_p | numero o null | Numero da 0 a 1. |
model (obbligatorio) | stringa | Fissato su grok-4.7. |
parallel_tool_calls | booleano o null | Booleano; predefinito: true. |
previous_response_id | stringa o null | ID della risposta come stringa; la continuazione tramite ID non è attualmente disponibile. |
prompt_cache_key | stringa o null | Chiave della cache come stringa. |
reasoning | oggetto | Configurazione del ragionamento; livello predefinito: high. |
reasoning_effort | stringa o null | low, medium, high, xhigh; predefinito: high. |
safety_identifier | stringa o null | Identificatore di sicurezza facoltativo fornito dal chiamante. |
search_parameters | oggetto | Configurazione della ricerca. |
service_tier | stringa | auto, default, priority, fast; priority e fast raddoppiano le tariffe dei token. |
store | booleano o null | Booleano; predefinito: true. Le operazioni sulle risposte memorizzate non sono attualmente disponibili. |
stream | booleano o null | Booleano; predefinito: false. |
temperature | numero o null | Numero da 0 a 2; predefinito: 1. |
text | oggetto | Configurazione della risposta testuale, incluso format. |
tool_choice | oggetto o altra forma supportata | Automatico, disattivato, obbligatorio o uno strumento selezionato; la sintassi dipende dal formato. |
tools | array o null | Definizioni degli strumenti; al massimo 350. |
top_k | intero o null | Intero; Responses richiede almeno 1. |
top_p | numero o null | Numero maggiore di 0 e non superiore a 1; predefinito: 1. |
user | stringa o null | Identificatore facoltativo fornito dal chiamante; nascosto nel Playground. |
Parametri di Chat Completions
| Campo | Tipo | Regola |
|---|---|---|
deferred | booleano o null | Booleano; predefinito: false. Il completamento differito non è attualmente disponibile. |
max_completion_tokens | intero o null | Limite di output visibile; predefinito: 128.000. |
max_tokens | intero o null | Limite positivo di output visibile. Obbligatorio per Messages. |
messages (obbligatorio) | array | Messaggi della conversazione in questo formato. |
model (obbligatorio) | stringa | Fissato su grok-4.7. |
n | intero o null | Intero pari almeno a 1; predefinito: 1. |
parallel_tool_calls | booleano o null | Booleano; predefinito: true. |
prompt_cache_key | stringa o null | Chiave della cache come stringa. |
reasoning_effort | stringa o null | low, medium, high, xhigh; predefinito: high. |
response_format | oggetto o altra forma supportata | Testo, oggetto JSON o output conforme a uno schema JSON. |
safety_identifier | stringa o null | Identificatore di sicurezza facoltativo fornito dal chiamante. |
search_parameters | oggetto | Configurazione della ricerca. |
seed | intero o null | Seme intero per il campionamento. |
service_tier | stringa | auto, default, priority, fast; priority e fast raddoppiano le tariffe dei token. |
stream | booleano o null | Booleano; predefinito: false. |
stream_options | oggetto | Opzioni di streaming; richiede stream: true. |
temperature | numero o null | Numero da 0 a 2; predefinito: 1. |
tool_choice | oggetto o altra forma supportata | Automatico, disattivato, obbligatorio o uno strumento selezionato; la sintassi dipende dal formato. |
tools | array o null | Definizioni degli strumenti; al massimo 350. |
top_p | numero o null | Numero maggiore di 0 e non superiore a 1; predefinito: 1. |
user | stringa o null | Identificatore facoltativo fornito dal chiamante; nascosto nel Playground. |
web_search_options | oggetto | Opzioni di ricerca per compatibilità. |
Parametri di Messages
| Campo | Tipo | Regola |
|---|---|---|
max_tokens (obbligatorio) | intero | Limite positivo di output visibile. Obbligatorio per Messages. |
messages (obbligatorio) | array | Messaggi della conversazione in questo formato. |
metadata | oggetto | Oggetto dei metadati di Messages. |
model (obbligatorio) | stringa | Fissato su grok-4.7. |
stop_sequences | array o null | Array di stringhe di arresto. |
stream | booleano o null | Booleano; predefinito: false. |
system | oggetto o altra forma supportata | Stringa di sistema o blocchi di contenuto. |
temperature | numero o null | Numero da 0 a 2; predefinito: 1. |
tool_choice | oggetto o altra forma supportata | Automatico, disattivato, obbligatorio o uno strumento selezionato; la sintassi dipende dal formato. |
tools | array o null | Definizioni degli strumenti; al massimo 350. |
top_k | intero o null | Intero; Responses richiede almeno 1. |
top_p | numero o null | Numero maggiore di 0 e non superiore a 1; predefinito: 1. |
Streaming
Imposta stream su true. Chat emette frammenti di completamento; Responses emette eventi di risposta con nome; Messages emette eventi di messaggio e di blocco di contenuto. Leggi l’evento finale di utilizzo oltre ai delta di testo. Le chiamate agli strumenti e il ragionamento possono essere elementi di output separati; quando conservi la cronologia, non ridurre il flusso al solo testo visibile.
{
"model": "grok-4.7",
"input": "Explain a mutex in one sentence.",
"reasoning": { "effort": "low" },
"max_output_tokens": 128,
"store": false,
"stream": true
}Strumenti e output strutturato
Usa la definizione dello strumento prevista dal formato scelto. Chat usa response_format; Responses usa text.format. Funzioni, ricerca web, ricerca su X, interprete di codice e chiamate MCP sono stati provati con questo modello. Shell restituisce una chiamata da eseguire sul client; non esegue automaticamente un comando sul tuo computer. Lo schema completo descrive anche altri tipi di strumenti; una voce nello schema, da sola, non dimostra che un determinato servizio esterno sia configurato.
{
"model": "grok-4.7",
"input": "Use the code interpreter once to compute 13*17. Return the number.",
"tools": [{ "type": "code_interpreter" }],
"tool_choice": "required",
"max_turns": 1,
"reasoning": { "effort": "low" },
"max_output_tokens": 32,
"store": false
}L’uso degli strumenti viene addebitato separatamente dai token. Ricerca web e interprete di codice si basano sul numero di chiamate. La ricerca su X si basa sul numero di post e profili recuperati, inclusi gli elementi recuperati più volte; il numero di chiamate di ricerca su X non è la sua unità di fatturazione. Controlla usage.server_side_tool_usage_details e i registri di utilizzo del tuo account.
Consumo e prezzi
I prezzi dipendono dalla lunghezza totale dell’input. Sotto 200.000 token di input, usa la fascia standard. Da 200.000 token in su, usa la fascia di contesto lungo per l’intera richiesta; l’input nella cache conta nella scelta della fascia. service_tier: "priority" e "fast" raddoppiano le tariffe dei token in entrambe le fasce. auto e default selezionano il servizio standard. I costi degli strumenti vengono calcolati a parte e non raddoppiano con questo moltiplicatore dei token.
| Formato | Conteggio dell’input | Conteggio dell’output |
|---|---|---|
| Responses | input_tokens include input_tokens_details.cached_tokens | output_tokens include il ragionamento; non aggiungere di nuovo il dettaglio dei token di ragionamento |
| Chat | prompt_tokens include prompt_tokens_details.cached_tokens | xAI riporta separatamente i completion_tokens visibili; l’output totale fatturabile è total_tokens - prompt_tokens, ragionamento incluso |
| Messages | input_tokens esclude cache_read_input_tokens; aggiungi i campi della cache per ottenere l’input totale | output_tokens è l’output totale |
Le risposte pubbliche includono contatori di utilizzo, non campi con importi monetari. I registri di utilizzo mostrano l’addebito finale. Le richieste non riuscite non vengono addebitate.
Cronologia della conversazione e limiti attuali
Per continuare senza stato, invia l’input precedente, tutti gli elementi di output restituiti e il messaggio successivo dell’utente come nuovo input. Con Chat o Messages, invia la cronologia completa dei messaggi nel formato corrispondente. Mantieni invariati gli elementi di ragionamento cifrato e degli strumenti, quando vengono restituiti.
Il servizio attuale non può continuare tramite previous_response_id, recuperare o eliminare una risposta memorizzata, elencare gli elementi di input memorizzati o restituire completamenti Chat differiti. store: true può essere accettato alla creazione, ma ciò non dimostra il supporto per la memorizzazione o il recupero delle risposte. Questi campi rimangono nel contratto ufficiale e nel Playground; questa limitazione non ridefinisce il loro comportamento previsto.
Gli allegati non hanno funzionato con gli input testati di testo inline e URL di PDF. Le richieste di generazione di immagini hanno restituito testo senza immagini e la ricerca di strumenti non ha completato il rilevamento lato server. Queste funzionalità non sono state verificate come disponibili. La ricerca Collections richiede inoltre una risorsa collection valida e non è stata verificata.
Chat ignora frequency_penalty, presence_penalty, logit_bias, stop, logprobs e top_logprobs. Responses ignora background, context_management, metadata, truncation, logprobs e top_logprobs. Questi campi non vengono inoltrati né proposti come controlli attivi.
Errori
Una richiesta non valida restituisce un errore invece di una risposta completata. Controlla i valori dei campi e il riferimento pubblico degli errori. Le richieste che restituiscono un errore non vengono addebitate.
