Claude Opus 5.5 ist auf SeedRouter verfügbar
LogoSeedRouter

Modelle nach Namen suchen, z. B. „nano banana“

Modelle nach Namen suchen, z. B. „nano banana“

Grok 4.7 Preise: Cache-Eingaben, Reasoning und Anfragekosten

Grok 4.7 Preise, Cache-Eingaben und Reasoning verstehen. Schätzen Sie Anfragekosten mit aktuellen Tokenpreisen, ohne Cache-Token doppelt zu zählen.

Als Markdown lesen

Die Preise für Grok 4.7 hängen von Eingabe-Token, gecachter Eingabe und Ausgabe ab. Die offiziellen Einstiegspreise betragen 2 US-Dollar pro Million Eingabe-Token und 6 US-Dollar pro Million Ausgabe-Token. Diese Basispreise beschreiben den Listenpreis des Modells. Verwenden Sie für die Kalkulation einer SeedRouter-Anfrage die aktuelle SeedRouter-Tabelle unten.[1]

Die sichtbare Länge der Antwort ist nur ein Teil der Berechnung. Eine kurze Antwort kann zusätzliche Reasoning-Token enthalten, während ein großer Prompt gecachte Eingaben enthalten kann. Auf der Modellseite für Grok 4.7 finden Sie den Playground und die aktuellen Preise.

Was kostet Grok 4.7?

Die offizielle Ankündigung nennt die oben aufgeführten Eingabe- und Ausgabepreise als Einstiegspreise von Grok 4.7. Sie beschreibt außerdem eine separate fast-Variante mit einem anderen Preis. Dieser Leitfaden behandelt das Modell grok-4.7. Der Preis einer ähnlich benannten Variante ist damit nicht austauschbar.[2]

Verwenden Sie für eine Anfrage über SeedRouter diese aktuellen Tokenpreise:

Preisgestaltung ist vorübergehend nicht verfügbar. Komm bald zurück.

Lesen Sie die Preise für die Eingabelängenstufe Ihrer Anfrage ab. Bei SeedRouter gilt für Eingaben unter 200.000 Token die Standardstufe. Ab 200.000 Token gilt für die gesamte Anfrage die Stufe für langen Kontext. Eingabe, gecachte Eingabe und Ausgabe verwenden jeweils die passende Stufe. Der Schwellenwert ist eine Preisgrenze und keine Reservierung dieser Tokenmenge.

Bei service_tier: "priority" oder "fast" verdoppeln Sie die Tokenpreise der gewählten Eingabelängenstufe. Dieser Multiplikator gilt für Tokenkosten. Tool-Kosten werden separat berechnet.

Die offizielle API-Übersicht nennt ein Kontextfenster von 500.000 Token. Diese Kapazitätsgrenze bedeutet nicht, dass bei jeder Anfrage das gesamte Fenster berechnet wird.[1]

Welche Nutzungsfelder gehören in die Berechnung?

Übernehmen Sie bei der Responses API drei Werte aus dem zurückgegebenen usage:

NutzungsfeldVerwendung
input_tokensGesamte Eingabe, einschließlich des gecachten Anteils
input_tokens_details.cached_tokensEingabeanteil, der zum Preis für gecachte Eingaben berechnet wird
output_tokensGesamte Ausgabe für die Tokenberechnung

Ziehen Sie gecachte Token von der gesamten Eingabe ab, bevor Sie den normalen Eingabepreis anwenden. Andernfalls berechnen Sie dieselben gecachten Token in Ihrer Schätzung einmal als normale Eingabe und erneut als gecachte Eingabe.

Bei Preisen pro Million Token gilt:

uncached input = input_tokens - cached_tokens

token cost = (
  uncached input × input rate
  + cached_tokens × cached-input rate
  + output_tokens × output rate
) / 1,000,000

Verwenden Sie für jeden Term die Preise aus der aktuellen Tabelle. Wählen Sie die Eingabelängenstufe anhand der gesamten Eingabe, bevor Sie gecachte Token abziehen. Eine Tokenschätzung enthält nicht automatisch separate Tool-Kosten. Nutzt eine Anfrage ein kostenpflichtiges Suchtool, müssen Sie auch dessen Nutzung berücksichtigen.

Warum kann eine kurze Antwort mehr Ausgabe-Token verbrauchen?

Reasoning zählt zur Ausgabe, selbst wenn die endgültige Antwort kurz ist. Eine am 10. Oktober 2026 verifizierte, abgeschlossene Responses-Anfrage mit Grok 4.7 lieferte beispielsweise:

{
  "input_tokens": 3340,
  "input_tokens_details": { "cached_tokens": 1152 },
  "output_tokens": 22,
  "output_tokens_details": { "reasoning_tokens": 21 },
  "total_tokens": 3362
}

Diese Anfrage enthält 2.188 ungecachte Eingabe-Token, 1.152 gecachte Eingabe-Token und 22 Ausgabe-Token. Die 21 Reasoning-Token sind eine Aufschlüsselung der Gesamtausgabe. Würden Sie sie erneut addieren, würden aus 22 Token 43, und Sie würden die Ausgabekosten überschätzen.

Diese Zahlen beschreiben eine abgeschlossene Anfrage, keinen Durchschnitt und keine Prognose für andere Prompts. Für die Budgetplanung Ihrer Anwendung sollten Sie den gemeldeten Verbrauch repräsentativer Aufgaben erfassen und prüfen, ob jedes Ergebnis die Anforderungen erfüllt.

Ändert Streaming den Tokenpreis?

Streaming verändert, wie die Antwort ankommt. Die Schätzung verwendet weiterhin die Eingabe, gecachte Eingabe und Ausgabe der abgeschlossenen Anfrage. Bewahren Sie die abschließenden Nutzungsdaten auf, statt jedes Textfragment als separate abrechenbare Anfrage zu behandeln.

Bei der Verifizierung von Grok 4.7 durch SeedRouter wurden Chat- und Responses-Anfragen mit und ohne Streaming abgeschlossen und gecachte Eingaben berücksichtigt. Damit wurde die Nutzungsberechnung geprüft. Es bedeutet nicht, dass zwei separat erzeugte Antworten exakt gleich viele Token verbrauchen.

Wie vergleiche ich die Kosten zweier Prompts?

Halten Sie Aufgabe und Akzeptanzkriterien gleich. Erfassen Sie für jeden Versuch die gesamte Eingabe, gecachte Eingabe und Ausgabe sowie die Nutzbarkeit der Antwort. Vergleichen Sie die Gesamtkosten bis zu einem akzeptablen Ergebnis. Berücksichtigen Sie auch erfolgreiche Generierungen, die Sie wegen unzureichender Antworten wiederholen mussten.

Entfernen Sie bei langen Gesprächen irrelevanten Verlauf erst, nachdem Sie geprüft haben, dass die gekürzte Version weiterhin korrekt antwortet. Prüfen Sie bei wiederholtem Kontext die Anzahl gecachter Token. Wiederholter Text allein belegt keinen Cache-Treffer. Vergleichen Sie bei Aufgaben mit viel Reasoning den tatsächlichen Ausgabeverbrauch, statt nur die sichtbaren Wörter der Antwort zu zählen.

Häufige Preisfragen

Ist der offizielle Basispreis der Preis, den ich bei SeedRouter zahle?

Verwenden Sie für SeedRouter die Live-Tabelle oben. Der offizielle Einstiegspreis liefert einen hilfreichen Anhaltspunkt. Maßgeblich für Ihre Schätzung sind jedoch die aktuellen Eingabelängenstufen und Tokenpreise des Dienstes.

Soll ich reasoning_tokens zu output_tokens addieren?

Nein. In den oben gezeigten Responses-Nutzungsdaten ist Reasoning bereits in der Gesamtausgabe enthalten. Nutzen Sie die Reasoning-Aufschlüsselung, um die geleistete Arbeit zu verstehen, nicht als zweite Ausgabeposition.

Garantiert ein wiederholter Prompt einen Rabatt für gecachte Eingaben?

Nein. Verwenden Sie die in der Antwort gemeldete Anzahl gecachter Token. Wenden Sie den Cache-Eingabepreis nur auf diesen Anteil an und den normalen Eingabepreis auf den Rest.

Wo kann ich die endgültige Gebühr prüfen?

Ihre Nutzungsaufzeichnungen zeigen die Gebühr der abgeschlossenen Anfrage. Aktualisieren Sie für eine neue Schätzung den Preisabschnitt für Grok 4.7 und verwenden Sie die gemeldeten Nutzungsdaten dieser Anfrage. Anfragen, die einen Fehler zurückgeben, werden nicht berechnet.

Quellen

  1. SpaceXAI API: Grok-Modelle und Preise, geprüft am 10. Oktober 2026.
  2. Vorstellung von Grok 4.7, 21. September 2026.

Verwandte Leitfäden