Text
Grok 4.7
Grok 4.7 mit nativen Anfragen in Chat Completions, Responses oder Messages nutzen. Parameter, Streaming, Tokenverbrauch und aktuelle Grenzen.
Verwenden Sie grok-4.7 mit einem der drei folgenden Formate. Zur Authentifizierung dient Ihr SeedRouter API-Schlüssel. Auf der Modellseite finden Sie einen Playground und die aktuellen Tokenpreise. Der Preisleitfaden erklärt gecachte Eingaben und Reasoning.
Schnellstart
curl https://api.seedrouter.ai/v1/responses \
-H "Authorization: Bearer $SEEDROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"grok-4.7","input":"What is 2 + 2?","reasoning":{"effort":"low"},"max_output_tokens":64,"store":false}'Die JSON-Antwort enthält output-Elemente und usage. Übernehmen Sie beim Aufbau des Gesprächsverlaufs alle Ausgabeelemente, einschließlich Reasoning- und Tool-Elementen.
Anfrageformate
| Format | Endpunkt | Pflichtfelder |
|---|---|---|
| Responses | POST /v1/responses | model, input |
| Chat Completions | POST /v1/chat/completions | model, messages |
| Messages | POST /v1/messages | model, messages, max_tokens |
Verwenden Sie Content-Type: application/json und Authorization: Bearer $SEEDROUTER_API_KEY. Messages-Clients können zusätzlich anthropic-version: 2023-06-01 senden.
Parameter und Einschränkungen
Die OpenAPI-Spezifikation enthält die vollständigen verschachtelten Anfrage- und Antwortschemas. Die folgenden Tabellen listen sämtliche unterstützten Anfragefelder auf oberster Ebene auf. Unbekannte Felder sowie Parameter, die dieses Modell laut offizieller Vorgabe ignoriert, werden verworfen. Ein unterstützter Parameter mit einem ungültigen Wert bleibt ungültig.
Optionale Felder, die null zulassen, akzeptieren explizit null. Wird ein Feld weggelassen, gilt sein API-Standardwert. Der Playground blendet user aus und setzt model fest auf grok-4.7. API-Clients können weiterhin user senden.
- Kontext: 500.000 Token, einschließlich Gespräch und Ausgabe.
- Reasoning-Aufwand:
low,medium,high,xhigh; Standard:high. max_completion_tokensundmax_output_tokenshaben einen Standardwert von 128.000 sichtbaren Ausgabe-Token. Reasoning- und Funktionsaufruf-Token fallen nicht unter dieses Limit für sichtbare Ausgaben. Dies ist ein Standardwert, keine Aussage über die maximal mögliche Ausgabe.- Ausgabelimits müssen positive ganze Zahlen sein. Die API setzt außerdem ihre bestehende Sicherheitsobergrenze für Ganzzahlen von 1.073.741.823 durch. Die Kontextkapazität gilt weiterhin.
temperature: 0 bis 2, Standard: 1.top_p: größer als 0 und höchstens 1, Standard: 1. Bei Responses gilt fürmin_p: 0 bis 1; fürtop_k: ganze Zahl ab 1.- Bis zu 350 Tool-Definitionen.
stream_optionssetztstream: truevoraus. instructionsundprevious_response_iddürfen nicht kombiniert werden. Reasoning-Zusammenfassungen sind immer detailliert.
Responses-Parameter
| Feld | Typ | Regel |
|---|---|---|
include | Array oder null | Array zusätzlicher Antwortfelder, die aufgenommen werden sollen. |
input (erforderlich) | Objekt oder alternative Form | Text als Zeichenfolge oder vollständiges Array von Eingabeelementen. |
instructions | Zeichenfolge oder null | Systemanweisungen; nicht mit previous_response_id kombinierbar. |
max_output_tokens | Ganzzahl oder null | Limit für sichtbare Ausgaben; Standard: 128.000. |
max_turns | Ganzzahl oder null | Maximale Anzahl der Agentenrunden als ganze Zahl. |
min_p | Zahl oder null | Zahl von 0 bis 1. |
model (erforderlich) | Zeichenfolge | Fest auf grok-4.7 gesetzt. |
parallel_tool_calls | Boolescher Wert oder null | Boolescher Wert; Standard: true. |
previous_response_id | Zeichenfolge oder null | Antwort-ID als Zeichenfolge; Fortsetzung per ID ist derzeit nicht verfügbar. |
prompt_cache_key | Zeichenfolge oder null | Cache-Schlüssel als Zeichenfolge. |
reasoning | Objekt | Reasoning-Konfiguration; Standardaufwand: high. |
reasoning_effort | Zeichenfolge oder null | low, medium, high, xhigh; Standard: high. |
safety_identifier | Zeichenfolge oder null | Optionale Sicherheitskennung, die der Aufrufer bereitstellt. |
search_parameters | Objekt | Suchkonfiguration. |
service_tier | Zeichenfolge | auto, default, priority, fast; priority und fast verdoppeln die Tokenpreise. |
store | Boolescher Wert oder null | Boolescher Wert; Standard: true. Operationen für gespeicherte Antworten sind derzeit nicht verfügbar. |
stream | Boolescher Wert oder null | Boolescher Wert; Standard: false. |
temperature | Zahl oder null | Zahl von 0 bis 2; Standard: 1. |
text | Objekt | Konfiguration der Textantwort, einschließlich format. |
tool_choice | Objekt oder alternative Form | Automatisch, deaktiviert, erforderlich oder ein ausgewähltes Tool; die Syntax hängt vom Format ab. |
tools | Array oder null | Tool-Definitionen; höchstens 350. |
top_k | Ganzzahl oder null | Ganze Zahl; bei Responses mindestens 1. |
top_p | Zahl oder null | Zahl größer als 0 und höchstens 1; Standard: 1. |
user | Zeichenfolge oder null | Optionale Kennung des Aufrufers; im Playground ausgeblendet. |
Parameter für Chat Completions
| Feld | Typ | Regel |
|---|---|---|
deferred | Boolescher Wert oder null | Boolescher Wert; Standard: false. Verzögerte Fertigstellung ist derzeit nicht verfügbar. |
max_completion_tokens | Ganzzahl oder null | Limit für sichtbare Ausgaben; Standard: 128.000. |
max_tokens | Ganzzahl oder null | Positives Limit für sichtbare Ausgaben. Bei Messages erforderlich. |
messages (erforderlich) | Array | Gesprächsnachrichten in diesem Format. |
model (erforderlich) | Zeichenfolge | Fest auf grok-4.7 gesetzt. |
n | Ganzzahl oder null | Ganze Zahl ab 1; Standard: 1. |
parallel_tool_calls | Boolescher Wert oder null | Boolescher Wert; Standard: true. |
prompt_cache_key | Zeichenfolge oder null | Cache-Schlüssel als Zeichenfolge. |
reasoning_effort | Zeichenfolge oder null | low, medium, high, xhigh; Standard: high. |
response_format | Objekt oder alternative Form | Text, JSON-Objekt oder Ausgabe nach JSON-Schema. |
safety_identifier | Zeichenfolge oder null | Optionale Sicherheitskennung, die der Aufrufer bereitstellt. |
search_parameters | Objekt | Suchkonfiguration. |
seed | Ganzzahl oder null | Ganzzahliger Startwert für das Sampling. |
service_tier | Zeichenfolge | auto, default, priority, fast; priority und fast verdoppeln die Tokenpreise. |
stream | Boolescher Wert oder null | Boolescher Wert; Standard: false. |
stream_options | Objekt | Streaming-Optionen; setzt stream: true voraus. |
temperature | Zahl oder null | Zahl von 0 bis 2; Standard: 1. |
tool_choice | Objekt oder alternative Form | Automatisch, deaktiviert, erforderlich oder ein ausgewähltes Tool; die Syntax hängt vom Format ab. |
tools | Array oder null | Tool-Definitionen; höchstens 350. |
top_p | Zahl oder null | Zahl größer als 0 und höchstens 1; Standard: 1. |
user | Zeichenfolge oder null | Optionale Kennung des Aufrufers; im Playground ausgeblendet. |
web_search_options | Objekt | Suchoptionen für das Kompatibilitätsformat. |
Messages-Parameter
| Feld | Typ | Regel |
|---|---|---|
max_tokens (erforderlich) | Ganzzahl | Positives Limit für sichtbare Ausgaben. Bei Messages erforderlich. |
messages (erforderlich) | Array | Gesprächsnachrichten in diesem Format. |
metadata | Objekt | Metadatenobjekt für Messages. |
model (erforderlich) | Zeichenfolge | Fest auf grok-4.7 gesetzt. |
stop_sequences | Array oder null | Array von Stoppzeichenfolgen. |
stream | Boolescher Wert oder null | Boolescher Wert; Standard: false. |
system | Objekt oder alternative Form | Systemzeichenfolge oder Inhaltsblöcke. |
temperature | Zahl oder null | Zahl von 0 bis 2; Standard: 1. |
tool_choice | Objekt oder alternative Form | Automatisch, deaktiviert, erforderlich oder ein ausgewähltes Tool; die Syntax hängt vom Format ab. |
tools | Array oder null | Tool-Definitionen; höchstens 350. |
top_k | Ganzzahl oder null | Ganze Zahl; bei Responses mindestens 1. |
top_p | Zahl oder null | Zahl größer als 0 und höchstens 1; Standard: 1. |
Streaming
Setzen Sie stream auf true. Chat sendet Completion-Chunks, Responses benannte Antwortereignisse und Messages Nachrichten- sowie Inhaltsblockereignisse. Lesen Sie neben den Textdeltas auch das abschließende Nutzungsereignis. Tool-Aufrufe und Reasoning können separate Ausgabeelemente sein. Beschränken Sie den Stream beim Speichern des Verlaufs nicht auf den sichtbaren Text.
{
"model": "grok-4.7",
"input": "Explain a mutex in one sentence.",
"reasoning": { "effort": "low" },
"max_output_tokens": 128,
"store": false,
"stream": true
}Tools und strukturierte Ausgabe
Verwenden Sie die Tool-Definition Ihres gewählten Formats. Chat nutzt response_format, Responses nutzt text.format. Funktionen, Websuche, X-Suche, Code-Interpreter und MCP-Aufrufe wurden mit diesem Modell praktisch getestet. Shell liefert einen Aufruf zurück, der vom Client auszuführen ist; ein Befehl wird nicht automatisch auf Ihrem Computer ausgeführt. Das vollständige Schema beschreibt weitere Tool-Typen. Ein Schemaeintrag allein belegt jedoch nicht, dass ein bestimmter externer Dienst konfiguriert ist.
{
"model": "grok-4.7",
"input": "Use the code interpreter once to compute 13*17. Return the number.",
"tools": [{ "type": "code_interpreter" }],
"tool_choice": "required",
"max_turns": 1,
"reasoning": { "effort": "low" },
"max_output_tokens": 32,
"store": false
}Tool-Nutzung wird getrennt von Token berechnet. Websuche und Code-Interpreter werden nach Aufrufen abgerechnet. Bei der X-Suche zählen abgerufene Beiträge und Profile, einschließlich wiederholt abgerufener Elemente. Die Anzahl der X-Suchaufrufe ist nicht die Abrechnungseinheit. Prüfen Sie usage.server_side_tool_usage_details und die Nutzungsaufzeichnungen Ihres Kontos.
Tokenverbrauch und Preise
Die Preise hängen von der gesamten Eingabelänge ab. Unter 200.000 Eingabe-Token gilt die Standardstufe. Ab 200.000 gilt die Stufe für langen Kontext für die gesamte Anfrage. Bei der Auswahl der Stufe zählt gecachte Eingabe mit. service_tier: "priority" und "fast" verdoppeln die Tokenpreise in beiden Stufen. auto und default wählen den Standardservice. Tool-Kosten werden separat berechnet und durch diesen Tokenmultiplikator nicht verdoppelt.
| Format | Eingabeberechnung | Ausgabeberechnung |
|---|---|---|
| Responses | input_tokens enthält input_tokens_details.cached_tokens | output_tokens enthält Reasoning; addieren Sie die Reasoning-Aufschlüsselung nicht erneut |
| Chat | prompt_tokens enthält prompt_tokens_details.cached_tokens | xAI meldet sichtbare completion_tokens separat; die gesamte abrechenbare Ausgabe ist total_tokens - prompt_tokens, einschließlich Reasoning |
| Messages | input_tokens enthält cache_read_input_tokens nicht; addieren Sie die Cache-Felder für die gesamte Eingabe | output_tokens ist die Gesamtausgabe |
Öffentliche Antworten enthalten Nutzungszähler, keine Geldbeträge. Die endgültige Gebühr erscheint in Ihren Nutzungsaufzeichnungen. Fehlgeschlagene Anfragen werden nicht berechnet.
Gesprächsverlauf und aktuelle Grenzen
Senden Sie für eine zustandslose Fortsetzung die vorherige Eingabe, jedes zurückgegebene Ausgabeelement und die nächste Nutzernachricht als neues input. Bei Chat oder Messages senden Sie den vollständigen Nachrichtenverlauf im jeweiligen Format. Behalten Sie zurückgegebene verschlüsselte Reasoning- und Tool-Elemente unverändert bei.
Der aktuelle Dienst kann weder per previous_response_id fortsetzen noch gespeicherte Antworten abrufen oder löschen, gespeicherte Eingabeelemente auflisten oder verzögerte Antworten von Chat Completions zurückgeben. store: true kann bei der Erstellung akzeptiert werden, belegt aber keine Unterstützung für das Speichern oder Abrufen von Antworten. Diese Felder bleiben im offiziellen Vertrag und im Playground enthalten. Die Einschränkung ersetzt nicht die Definition ihres vorgesehenen Verhaltens.
Dateianhänge funktionierten mit den getesteten Inline-Text- und PDF-URL-Eingaben nicht. Anfragen zur Bildgenerierung lieferten Text ohne Bilder, und die Tool-Suche schloss die serverseitige Erkennung nicht ab. Diese Funktionen sind nicht als verfügbar bestätigt. Die Collections-Suche benötigt außerdem eine gültige collection-Ressource und wurde nicht verifiziert.
Chat ignoriert frequency_penalty, presence_penalty, logit_bias, stop, logprobs und top_logprobs. Responses ignoriert background, context_management, metadata, truncation, logprobs und top_logprobs. Sie werden weder weitergeleitet noch als aktive Steuerelemente angeboten.
Fehler
Eine ungültige Anfrage liefert einen Fehler statt einer abgeschlossenen Antwort. Prüfen Sie die Feldwerte und die öffentliche Fehlerreferenz. Anfragen, die einen Fehler zurückgeben, werden nicht berechnet.
