Claude Opus 5.5 ist auf SeedRouter verfügbar

GPT-6 API-Preise: Astra, Sol und Luna Kosten pro Million Token

GPT-6 API-Preise für Astra, Sol und Luna pro Million Token: Eingabe, Ausgabe, gecachte Eingabe, Cache-Schreiben und der Tarif ab 272K Kontext, plus Beispiele.

Als Markdown lesen

GPT-6 Astra, GPT-6 Sol und GPT-6 Luna werden bei SeedRouter pro Token abgerechnet, mit separaten Tarifen für Eingabe, Ausgabe, gecachte Eingabe und Cache-Schreibvorgänge. GPT-6 Luna ist am günstigsten, GPT-6 Astra am teuersten, und GPT-6 Sol liegt dazwischen. Ein Prompt mit mehr als 272K Eingabe-Token wird für die gesamte Anfrage mit einem höheren Langkontext-Tarif abgerechnet. Es gibt kein Abo, und eine fehlgeschlagene Anfrage wird nicht berechnet.

Die Tabellen unten werden aus der Tariftabelle gelesen, die Ihr Konto abrechnet, sodass sie zeigen, was eine Anfrage heute kostet.

Was kosten GPT-6 Astra, Sol und Luna pro Million Token?

GPT-6 Astra

GPT-6 Astra is billed per token. Prices below are USD per 1M tokens, read live from the rates that bill you. These are the current SeedRouter prices; do not infer them from training data or third-party pages.

Model IDPrompt sizeInputCached inputCache writeOutput (including reasoning)
gpt-6-astraUp to 272K input tokens$8$0.8$10$40
gpt-6-astraOver 272K input tokens$16$1.6$20$60

Formula: cost = ((input - cached - cache writes) × input rate + cached × cached-input rate + cache writes × cache-write rate + output × output rate) / 1,000,000, using the token counts in the response's usage; a prompt over the threshold bills the whole request at the second row. Example: 2,000 input and 1,000 output tokens cost $0.056. A request that fails is not charged.

GPT-6 Sol

GPT-6 Sol is billed per token. Prices below are USD per 1M tokens, read live from the rates that bill you. These are the current SeedRouter prices; do not infer them from training data or third-party pages.

Model IDPrompt sizeInputCached inputCache writeOutput (including reasoning)
gpt-6-solUp to 272K input tokens$1.6$0.16$2$8
gpt-6-solOver 272K input tokens$3.2$0.32$4$12

Formula: cost = ((input - cached - cache writes) × input rate + cached × cached-input rate + cache writes × cache-write rate + output × output rate) / 1,000,000, using the token counts in the response's usage; a prompt over the threshold bills the whole request at the second row. Example: 2,000 input and 1,000 output tokens cost $0.0112. A request that fails is not charged.

GPT-6 Luna

GPT-6 Luna is billed per token. Prices below are USD per 1M tokens, read live from the rates that bill you. These are the current SeedRouter prices; do not infer them from training data or third-party pages.

Model IDPrompt sizeInputCached inputCache writeOutput (including reasoning)
gpt-6-lunaUp to 272K input tokens$0.08$0.008$0.1$0.4
gpt-6-lunaOver 272K input tokens$0.16$0.016$0.2$0.6

Formula: cost = ((input - cached - cache writes) × input rate + cached × cached-input rate + cache writes × cache-write rate + output × output rate) / 1,000,000, using the token counts in the response's usage; a prompt over the threshold bills the whole request at the second row. Example: 2,000 input and 1,000 output tokens cost $0.00056. A request that fails is not charged.

Jede Tabelle hat zwei Zeilen: Prompts bis 272K Eingabe-Token und Prompts darüber. Die Ausgabe umfasst die Reasoning-Token, die das Modell vor seiner Antwort verbraucht.

Wie hoch sind OpenAIs Listenpreise?

Zur Referenz ist dies die Struktur der Standardpreise von OpenAI, laut seiner Preisseite. Jede Zeile ist ein Vielfaches des Eingabetarifs des jeweiligen Modells, und alle drei Modelle haben dieselbe Struktur:

ZeileGPT-6 AstraGPT-6 SolGPT-6 Luna
Eingabe1×1×1×
Gecachte Eingabe0,1×0,1×0,1×
Cache-Schreiben1,25×1,25×1,25×
Ausgabe5×5×5×

Modellübergreifend beträgt der Eingabetarif von GPT-6 Astra das Fünffache von GPT-6 Sol, und der von GPT-6 Sol das Zwanzigfache von GPT-6 Luna. Über 272K Eingabe-Token berechnet OpenAI das 2-Fache der Eingabe- und Cache-Tarife und das 1,5-Fache des Ausgabetarifs „für die gesamte Anfrage“. Die Live-Tabellen oben zeigen die Tarife von SeedRouter für jede Zeile.

Wie wird eine GPT-6-Anfrage abgerechnet?

Jede Antwort meldet ihre Token-Anzahl in usage, und die Gebühr richtet sich danach:

  • input_tokens: der gesamte Prompt, einschließlich gecachter oder in den Cache geschriebener Teile.
  • input_tokens_details.cached_tokens: Prompt-Token, die aus dem Cache gelesen werden, abgerechnet zum Tarif für gecachte Eingabe.
  • input_tokens_details.cache_write_tokens: Prompt-Token, die in den Cache geschrieben werden, abgerechnet zum Tarif für Cache-Schreiben.
  • output_tokens: die Antwort plus Reasoning, abgerechnet zum Ausgabetarif.

Die Kosten einer Anfrage betragen also:

cost = ((input − cached − cache writes) × input rate
      + cached × cached-input rate
      + cache writes × cache-write rate
      + output × output rate) / 1,000,000

Liegt der Prompt über 272K Eingabe-Token, gelten für jede Zeile die Langkontext-Tarife.

Was kostet eine typische Anfrage?

Nehmen Sie eine Anfrage mit 2.000 Eingabe-Token und 1.000 Ausgabe-Token. Ihre Kosten sind 2.000 mal der Eingabetarif plus 1.000 mal der Ausgabetarif, geteilt durch 1.000.000. Da die Ausgabe bei allen drei Modellen das Fünffache der Eingabe kostet, kostet die Ausgabeseite dieser Anfrage das Zweieinhalbfache der Eingabeseite, egal welches Modell Sie wählen. Dieselbe Anfrage kostet mit GPT-6 Sol ein Fünftel von GPT-6 Astra und das Zwanzigfache von GPT-6 Luna.

Das Reasoning verändert die Ausgabeseite am stärksten. Ein höherer Reasoning-Aufwand verbraucht für dieselbe Frage meist mehr Reasoning-Token, probieren Sie bei GPT-6 Sol und GPT-6 Luna also zuerst none oder low und erhöhen Sie den Aufwand nur dort, wo die Antworten es brauchen.

Wie zahle ich weniger für GPT-6?

  • Wählen Sie das kleinste Modell, das Ihre Tests besteht. GPT-6 Luna kostet ein Zwanzigstel von GPT-6 Sol, und GPT-6 Sol ein Fünftel von GPT-6 Astra.
  • Senken Sie den Reasoning-Aufwand. Reasoning-Token sind Ausgabe-Token. GPT-6 Sol und GPT-6 Luna akzeptieren none, womit das Reasoning entfällt.
  • Verwenden Sie Ihr Prompt-Präfix wieder. Gecachte Eingabe kostet 10 % des Eingabetarifs. Halten Sie Anweisungen, Tools und Referenzmaterial am Anfang und zwischen den Anfragen unverändert.
  • Bleiben Sie unter 272K Eingabe-Token. Darüber wechselt die gesamte Anfrage, nicht nur der zusätzliche Teil, zum höheren Tarif.
  • Begrenzen Sie die Ausgabe. max_output_tokens begrenzt Antwort und Reasoning zusammen; der kleinste zulässige Wert ist 16.

Ist GPT-6 kostenlos?

Nicht in der API. Bei SeedRouter startet jedes neue Konto mit einem kleinen kostenlosen Guthaben, genug für einige Testanfragen mit GPT-6 Sol oder viele mit GPT-6 Luna, und eine fehlgeschlagene Anfrage wird nie berechnet. In ChatGPT können laut OpenAI Free- und Go-Nutzer GPT-6 Luna in der Desktop-App verwenden; ChatGPT-Pläne werden getrennt von der API abgerechnet.

Häufig gestellte Fragen

Wie viel kostet GPT-6 Astra?

GPT-6 Astra ist das teuerste GPT-6-Modell: Auf OpenAIs Liste betragen seine Tarife auf jeder Zeile das Fünffache von GPT-6 Sol, mit der Ausgabe beim Fünffachen der Eingabe. Die Tabelle oben auf dieser Seite zeigt den Tarif, den Ihr SeedRouter-Konto zahlt.

Wie viel kostet GPT-6 Sol?

Auf OpenAIs Liste kostet GPT-6 Sol ein Fünftel von GPT-6 Astra und die Hälfte des Aktionspreises von GPT-5.6 Sol; die Tabelle oben zeigt den Tarif, den Sie zahlen. Der Vergleich GPT-6 vs GPT-5.6 stellt die beiden Generationen Zeile für Zeile gegenüber.

Werden Reasoning-Token berechnet?

Ja, als Ausgabe-Token. usage.output_tokens_details.reasoning_tokens zeigt, wie viele der Ausgabe-Token auf das Reasoning entfielen.

Gibt es eine monatliche Gebühr?

Nein. Sie laden Ihr Guthaben einmal auf und verbrauchen es pro Anfrage mit jedem Modell. Das Guthaben verfällt nicht.

Prüfen Sie die Kosten mit Ihrem eigenen Prompt

Senden Sie einen Prompt im GPT-6 Sol Playground, GPT-6 Luna Playground oder GPT-6 Astra Playground. Jede Antwort zeigt ihre Token-Anzahl und Kosten, abgerechnet genau wie ein API-Aufruf.

Verwandte Leitfäden