Claude Opus 5.5 ist auf SeedRouter verfügbar
LogoSeedRouter

Modelle nach Namen suchen, z. B. „nano banana“

Modelle nach Namen suchen, z. B. „nano banana“

Text

Grok 4.7

View Markdown

Grok 4.7 mit nativen Anfragen in Chat Completions, Responses oder Messages nutzen. Parameter, Streaming, Tokenverbrauch und aktuelle Grenzen.

Verwenden Sie grok-4.7 mit einem der drei folgenden Formate. Zur Authentifizierung dient Ihr SeedRouter API-Schlüssel. Auf der Modellseite finden Sie einen Playground und die aktuellen Tokenpreise. Der Preisleitfaden erklärt gecachte Eingaben und Reasoning.

Schnellstart

curl https://api.seedrouter.ai/v1/responses \
  -H "Authorization: Bearer $SEEDROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"grok-4.7","input":"What is 2 + 2?","reasoning":{"effort":"low"},"max_output_tokens":64,"store":false}'

Die JSON-Antwort enthält output-Elemente und usage. Übernehmen Sie beim Aufbau des Gesprächsverlaufs alle Ausgabeelemente, einschließlich Reasoning- und Tool-Elementen.

Anfrageformate

FormatEndpunktPflichtfelder
ResponsesPOST /v1/responsesmodel, input
Chat CompletionsPOST /v1/chat/completionsmodel, messages
MessagesPOST /v1/messagesmodel, messages, max_tokens

Verwenden Sie Content-Type: application/json und Authorization: Bearer $SEEDROUTER_API_KEY. Messages-Clients können zusätzlich anthropic-version: 2023-06-01 senden.

Parameter und Einschränkungen

Die OpenAPI-Spezifikation enthält die vollständigen verschachtelten Anfrage- und Antwortschemas. Die folgenden Tabellen listen sämtliche unterstützten Anfragefelder auf oberster Ebene auf. Unbekannte Felder sowie Parameter, die dieses Modell laut offizieller Vorgabe ignoriert, werden verworfen. Ein unterstützter Parameter mit einem ungültigen Wert bleibt ungültig.

Optionale Felder, die null zulassen, akzeptieren explizit null. Wird ein Feld weggelassen, gilt sein API-Standardwert. Der Playground blendet user aus und setzt model fest auf grok-4.7. API-Clients können weiterhin user senden.

  • Kontext: 500.000 Token, einschließlich Gespräch und Ausgabe.
  • Reasoning-Aufwand: low, medium, high, xhigh; Standard: high.
  • max_completion_tokens und max_output_tokens haben einen Standardwert von 128.000 sichtbaren Ausgabe-Token. Reasoning- und Funktionsaufruf-Token fallen nicht unter dieses Limit für sichtbare Ausgaben. Dies ist ein Standardwert, keine Aussage über die maximal mögliche Ausgabe.
  • Ausgabelimits müssen positive ganze Zahlen sein. Die API setzt außerdem ihre bestehende Sicherheitsobergrenze für Ganzzahlen von 1.073.741.823 durch. Die Kontextkapazität gilt weiterhin.
  • temperature: 0 bis 2, Standard: 1. top_p: größer als 0 und höchstens 1, Standard: 1. Bei Responses gilt für min_p: 0 bis 1; für top_k: ganze Zahl ab 1.
  • Bis zu 350 Tool-Definitionen. stream_options setzt stream: true voraus.
  • instructions und previous_response_id dürfen nicht kombiniert werden. Reasoning-Zusammenfassungen sind immer detailliert.

Responses-Parameter

FeldTypRegel
includeArray oder nullArray zusätzlicher Antwortfelder, die aufgenommen werden sollen.
input (erforderlich)Objekt oder alternative FormText als Zeichenfolge oder vollständiges Array von Eingabeelementen.
instructionsZeichenfolge oder nullSystemanweisungen; nicht mit previous_response_id kombinierbar.
max_output_tokensGanzzahl oder nullLimit für sichtbare Ausgaben; Standard: 128.000.
max_turnsGanzzahl oder nullMaximale Anzahl der Agentenrunden als ganze Zahl.
min_pZahl oder nullZahl von 0 bis 1.
model (erforderlich)ZeichenfolgeFest auf grok-4.7 gesetzt.
parallel_tool_callsBoolescher Wert oder nullBoolescher Wert; Standard: true.
previous_response_idZeichenfolge oder nullAntwort-ID als Zeichenfolge; Fortsetzung per ID ist derzeit nicht verfügbar.
prompt_cache_keyZeichenfolge oder nullCache-Schlüssel als Zeichenfolge.
reasoningObjektReasoning-Konfiguration; Standardaufwand: high.
reasoning_effortZeichenfolge oder nulllow, medium, high, xhigh; Standard: high.
safety_identifierZeichenfolge oder nullOptionale Sicherheitskennung, die der Aufrufer bereitstellt.
search_parametersObjektSuchkonfiguration.
service_tierZeichenfolgeauto, default, priority, fast; priority und fast verdoppeln die Tokenpreise.
storeBoolescher Wert oder nullBoolescher Wert; Standard: true. Operationen für gespeicherte Antworten sind derzeit nicht verfügbar.
streamBoolescher Wert oder nullBoolescher Wert; Standard: false.
temperatureZahl oder nullZahl von 0 bis 2; Standard: 1.
textObjektKonfiguration der Textantwort, einschließlich format.
tool_choiceObjekt oder alternative FormAutomatisch, deaktiviert, erforderlich oder ein ausgewähltes Tool; die Syntax hängt vom Format ab.
toolsArray oder nullTool-Definitionen; höchstens 350.
top_kGanzzahl oder nullGanze Zahl; bei Responses mindestens 1.
top_pZahl oder nullZahl größer als 0 und höchstens 1; Standard: 1.
userZeichenfolge oder nullOptionale Kennung des Aufrufers; im Playground ausgeblendet.

Parameter für Chat Completions

FeldTypRegel
deferredBoolescher Wert oder nullBoolescher Wert; Standard: false. Verzögerte Fertigstellung ist derzeit nicht verfügbar.
max_completion_tokensGanzzahl oder nullLimit für sichtbare Ausgaben; Standard: 128.000.
max_tokensGanzzahl oder nullPositives Limit für sichtbare Ausgaben. Bei Messages erforderlich.
messages (erforderlich)ArrayGesprächsnachrichten in diesem Format.
model (erforderlich)ZeichenfolgeFest auf grok-4.7 gesetzt.
nGanzzahl oder nullGanze Zahl ab 1; Standard: 1.
parallel_tool_callsBoolescher Wert oder nullBoolescher Wert; Standard: true.
prompt_cache_keyZeichenfolge oder nullCache-Schlüssel als Zeichenfolge.
reasoning_effortZeichenfolge oder nulllow, medium, high, xhigh; Standard: high.
response_formatObjekt oder alternative FormText, JSON-Objekt oder Ausgabe nach JSON-Schema.
safety_identifierZeichenfolge oder nullOptionale Sicherheitskennung, die der Aufrufer bereitstellt.
search_parametersObjektSuchkonfiguration.
seedGanzzahl oder nullGanzzahliger Startwert für das Sampling.
service_tierZeichenfolgeauto, default, priority, fast; priority und fast verdoppeln die Tokenpreise.
streamBoolescher Wert oder nullBoolescher Wert; Standard: false.
stream_optionsObjektStreaming-Optionen; setzt stream: true voraus.
temperatureZahl oder nullZahl von 0 bis 2; Standard: 1.
tool_choiceObjekt oder alternative FormAutomatisch, deaktiviert, erforderlich oder ein ausgewähltes Tool; die Syntax hängt vom Format ab.
toolsArray oder nullTool-Definitionen; höchstens 350.
top_pZahl oder nullZahl größer als 0 und höchstens 1; Standard: 1.
userZeichenfolge oder nullOptionale Kennung des Aufrufers; im Playground ausgeblendet.
web_search_optionsObjektSuchoptionen für das Kompatibilitätsformat.

Messages-Parameter

FeldTypRegel
max_tokens (erforderlich)GanzzahlPositives Limit für sichtbare Ausgaben. Bei Messages erforderlich.
messages (erforderlich)ArrayGesprächsnachrichten in diesem Format.
metadataObjektMetadatenobjekt für Messages.
model (erforderlich)ZeichenfolgeFest auf grok-4.7 gesetzt.
stop_sequencesArray oder nullArray von Stoppzeichenfolgen.
streamBoolescher Wert oder nullBoolescher Wert; Standard: false.
systemObjekt oder alternative FormSystemzeichenfolge oder Inhaltsblöcke.
temperatureZahl oder nullZahl von 0 bis 2; Standard: 1.
tool_choiceObjekt oder alternative FormAutomatisch, deaktiviert, erforderlich oder ein ausgewähltes Tool; die Syntax hängt vom Format ab.
toolsArray oder nullTool-Definitionen; höchstens 350.
top_kGanzzahl oder nullGanze Zahl; bei Responses mindestens 1.
top_pZahl oder nullZahl größer als 0 und höchstens 1; Standard: 1.

Streaming

Setzen Sie stream auf true. Chat sendet Completion-Chunks, Responses benannte Antwortereignisse und Messages Nachrichten- sowie Inhaltsblockereignisse. Lesen Sie neben den Textdeltas auch das abschließende Nutzungsereignis. Tool-Aufrufe und Reasoning können separate Ausgabeelemente sein. Beschränken Sie den Stream beim Speichern des Verlaufs nicht auf den sichtbaren Text.

{
  "model": "grok-4.7",
  "input": "Explain a mutex in one sentence.",
  "reasoning": { "effort": "low" },
  "max_output_tokens": 128,
  "store": false,
  "stream": true
}

Tools und strukturierte Ausgabe

Verwenden Sie die Tool-Definition Ihres gewählten Formats. Chat nutzt response_format, Responses nutzt text.format. Funktionen, Websuche, X-Suche, Code-Interpreter und MCP-Aufrufe wurden mit diesem Modell praktisch getestet. Shell liefert einen Aufruf zurück, der vom Client auszuführen ist; ein Befehl wird nicht automatisch auf Ihrem Computer ausgeführt. Das vollständige Schema beschreibt weitere Tool-Typen. Ein Schemaeintrag allein belegt jedoch nicht, dass ein bestimmter externer Dienst konfiguriert ist.

{
  "model": "grok-4.7",
  "input": "Use the code interpreter once to compute 13*17. Return the number.",
  "tools": [{ "type": "code_interpreter" }],
  "tool_choice": "required",
  "max_turns": 1,
  "reasoning": { "effort": "low" },
  "max_output_tokens": 32,
  "store": false
}

Tool-Nutzung wird getrennt von Token berechnet. Websuche und Code-Interpreter werden nach Aufrufen abgerechnet. Bei der X-Suche zählen abgerufene Beiträge und Profile, einschließlich wiederholt abgerufener Elemente. Die Anzahl der X-Suchaufrufe ist nicht die Abrechnungseinheit. Prüfen Sie usage.server_side_tool_usage_details und die Nutzungsaufzeichnungen Ihres Kontos.

Tokenverbrauch und Preise

Die Preise hängen von der gesamten Eingabelänge ab. Unter 200.000 Eingabe-Token gilt die Standardstufe. Ab 200.000 gilt die Stufe für langen Kontext für die gesamte Anfrage. Bei der Auswahl der Stufe zählt gecachte Eingabe mit. service_tier: "priority" und "fast" verdoppeln die Tokenpreise in beiden Stufen. auto und default wählen den Standardservice. Tool-Kosten werden separat berechnet und durch diesen Tokenmultiplikator nicht verdoppelt.

FormatEingabeberechnungAusgabeberechnung
Responsesinput_tokens enthält input_tokens_details.cached_tokensoutput_tokens enthält Reasoning; addieren Sie die Reasoning-Aufschlüsselung nicht erneut
Chatprompt_tokens enthält prompt_tokens_details.cached_tokensxAI meldet sichtbare completion_tokens separat; die gesamte abrechenbare Ausgabe ist total_tokens - prompt_tokens, einschließlich Reasoning
Messagesinput_tokens enthält cache_read_input_tokens nicht; addieren Sie die Cache-Felder für die gesamte Eingabeoutput_tokens ist die Gesamtausgabe

Öffentliche Antworten enthalten Nutzungszähler, keine Geldbeträge. Die endgültige Gebühr erscheint in Ihren Nutzungsaufzeichnungen. Fehlgeschlagene Anfragen werden nicht berechnet.

Gesprächsverlauf und aktuelle Grenzen

Senden Sie für eine zustandslose Fortsetzung die vorherige Eingabe, jedes zurückgegebene Ausgabeelement und die nächste Nutzernachricht als neues input. Bei Chat oder Messages senden Sie den vollständigen Nachrichtenverlauf im jeweiligen Format. Behalten Sie zurückgegebene verschlüsselte Reasoning- und Tool-Elemente unverändert bei.

Der aktuelle Dienst kann weder per previous_response_id fortsetzen noch gespeicherte Antworten abrufen oder löschen, gespeicherte Eingabeelemente auflisten oder verzögerte Antworten von Chat Completions zurückgeben. store: true kann bei der Erstellung akzeptiert werden, belegt aber keine Unterstützung für das Speichern oder Abrufen von Antworten. Diese Felder bleiben im offiziellen Vertrag und im Playground enthalten. Die Einschränkung ersetzt nicht die Definition ihres vorgesehenen Verhaltens.

Dateianhänge funktionierten mit den getesteten Inline-Text- und PDF-URL-Eingaben nicht. Anfragen zur Bildgenerierung lieferten Text ohne Bilder, und die Tool-Suche schloss die serverseitige Erkennung nicht ab. Diese Funktionen sind nicht als verfügbar bestätigt. Die Collections-Suche benötigt außerdem eine gültige collection-Ressource und wurde nicht verifiziert.

Chat ignoriert frequency_penalty, presence_penalty, logit_bias, stop, logprobs und top_logprobs. Responses ignoriert background, context_management, metadata, truncation, logprobs und top_logprobs. Sie werden weder weitergeleitet noch als aktive Steuerelemente angeboten.

Fehler

Eine ungültige Anfrage liefert einen Fehler statt einer abgeschlossenen Antwort. Prüfen Sie die Feldwerte und die öffentliche Fehlerreferenz. Anfragen, die einen Fehler zurückgeben, werden nicht berechnet.