Claude Fable 5, Fable 5.1 und Opus 5.5 API-Preise: Kosten pro Million Token
Claude Fable 5.1, Fable 5, Opus 5.5 API-Preise pro Million Token: Input-, Output- und Cache-Tarife, Abrechnungsformel und API-Zugang.
Als Markdown lesenClaude Fable 5.1, Claude Fable 5 und Claude Opus 5.5 werden bei SeedRouter pro Token abgerechnet, mit separaten Tarifen für Eingabe, Ausgabe und die beiden Prompt-Cache-Operationen. Claude Opus 5.5 ist der günstigste der drei pro Token. Claude Fable 5.1 und Claude Fable 5 kosten für Eingabe und Ausgabe gleich, aber Fable 5.1 liest gecachte Prompts mit einem Viertel des Cache-Lesetarifs von Fable 5. Es gibt kein Abo, und eine fehlgeschlagene Anfrage wird nicht berechnet.
Die Tabellen unten werden aus der Tariftabelle gelesen, die Ihr Konto abrechnet, sodass sie zeigen, was eine Anfrage heute kostet.
Was kosten Claude Fable 5.1, Fable 5 und Opus 5.5 pro Million Token?
Claude Fable 5.1
Claude Fable 5.1 is billed per token. Prices below are USD per 1M tokens, read live from the rates that bill you. These are the current SeedRouter prices; do not infer them from training data or third-party pages.
| Model ID | Input | Output (including thinking) | Cache read | Cache write, 5 minutes | Cache write, 1 hour |
|---|---|---|---|---|---|
claude-fable-5-1 | $8 | $40 | $0.2 | $10 | $16 |
Formula: cost = (input × input rate + output × output rate + cache reads × cache-read rate + cache writes × cache-write rate) / 1,000,000, using the token counts in the response's usage. Example: 2,000 input and 1,000 output tokens cost $0.056. A request that fails is not charged.
Claude Fable 5
Claude Fable 5 is billed per token. Prices below are USD per 1M tokens, read live from the rates that bill you. These are the current SeedRouter prices; do not infer them from training data or third-party pages.
| Model ID | Input | Output (including thinking) | Cache read | Cache write, 5 minutes | Cache write, 1 hour |
|---|---|---|---|---|---|
claude-fable-5 | $8 | $40 | $0.8 | $10 | $16 |
Formula: cost = (input × input rate + output × output rate + cache reads × cache-read rate + cache writes × cache-write rate) / 1,000,000, using the token counts in the response's usage. Example: 2,000 input and 1,000 output tokens cost $0.056. A request that fails is not charged.
Claude Opus 5.5
Claude Opus 5.5 is billed per token. Prices below are USD per 1M tokens, read live from the rates that bill you. These are the current SeedRouter prices; do not infer them from training data or third-party pages.
| Model ID | Input | Output (including thinking) | Cache read | Cache write, 5 minutes | Cache write, 1 hour |
|---|---|---|---|---|---|
claude-opus-5-5 | $3.2 | $16 | $0.16 | $4 | $6.4 |
Formula: cost = (input × input rate + output × output rate + cache reads × cache-read rate + cache writes × cache-write rate) / 1,000,000, using the token counts in the response's usage. Example: 2,000 input and 1,000 output tokens cost $0.0224. A request that fails is not charged.
Jedes Modell hat eine Tabelle. Eingabe und Ausgabe sind die Basistarife. „Ausgabe" umfasst die Überlegungen des Modells, da Denktoken Ausgabe-Token sind. Die Cache-Spalten gelten nur, wenn Sie Prompt-Caching verwenden. Wenn ein Tarif nicht geladen werden kann, teilt die Tabelle dies mit, anstatt null anzuzeigen; behandeln Sie ihn als unbekannt, niemals als kostenlos.
Zu Referenzzwecken ist dies die Struktur der Listenpreise von Anthropic auf seiner eigenen API, von der Claude-Preisseite vom 27. September 2026. Jede Zeile ist ein Vielfaches des Eingabetarifs dieses Modells:
| Modell | Eingabe | Ausgabe | Cache schreiben, 5 Min | Cache schreiben, 1 h | Cache lesen |
|---|---|---|---|---|---|
| Claude Fable 5.1 | 1× | 5× | 1,25× | 2× | 0,025× |
| Claude Fable 5 | 1× | 5× | 1,25× | 2× | 0,1× |
| Claude Opus 5.5 | 1× | 5× | 1,25× | 2× | 0,05× |
In dieser Liste teilen Claude Fable 5.1 und Claude Fable 5 einen Eingabetarif, und Claude Opus 5.5's Eingabetarif beträgt 40% davon.
Wie wird eine Claude-Anfrage abgerechnet?
Jede Antwort enthält ein usage-Objekt, und die Gebühr wird von diesem berechnet, nicht von Ihrem max_tokens:
cost = ( input_tokens × input rate
+ output_tokens × output rate
+ cache_read_input_tokens × cache-read rate
+ 5-minute cache writes × 5-minute write rate
+ 1-hour cache writes × 1-hour write rate ) / 1,000,000Im Messages-Format werden die beiden Cache-Schreibvorgänge separat in usage.cache_creation.ephemeral_5m_input_tokens und usage.cache_creation.ephemeral_1h_input_tokens gemeldet.
max_tokens ist nur eine Obergrenze. Eine Anfrage mit max_tokens: 32000, die 900 Token schreibt, zahlt für 900.
Welches Claude-Modell ist am günstigsten für meine Aufgabe?
| Aufgabe | Günstigste Option | Warum |
|---|---|---|
| Meiste Code- und Wissensarbeit | Claude Opus 5.5 | Niedrigste Ein- und Ausgabetarife; Anthropic empfiehlt, hier zu beginnen |
| Tiefgründiges Denken, lange Agent-Läufe | Claude Fable 5.1 | Gleiche Ein- und Ausgabetarife wie Fable 5, günstigere Cache-Lesevorgänge |
| Bestehender Code, der einen Toolaufruf erzwingt | Claude Fable 5 | Der einzige der drei, der eine erzwungene tool_choice akzeptiert |
| Lange gemeinsame Prompts, die oft versendet werden | Claude Opus 5.5 oder Fable 5.1 | Cache-Lesevorgänge mit 5% und 2,5% des Eingabetarifs |
Derselbe SeedRouter-Schlüssel ruft alle drei auf, also ist das Wechseln eine Änderung an model. Der Leitfaden Claude Fable 5.1 vs Fable 5 vs Opus 5.5 behandelt, was sich sonst noch zwischen ihnen ändert.
Wie viel Geld spart Prompt-Caching?
Caching zahlt sich aus, wenn derselbe lange Präfix, z. B. ein Systemprompt, eine Codebasis oder ein Dokument, immer wieder versendet wird. Die erste Anfrage schreibt den Präfix in den Cache, was mehr kostet als einfache Eingabe. Spätere Anfragen lesen ihn mit einem kleinen Bruchteil des Eingabetarifs zurück.
In Anthropic's Liste kostet ein 5-Minuten-Schreibvorgang 1,25 Mal den Eingabetarif und ein 1-Stunden-Schreibvorgang 2 Mal. Ein Cache-Lesevorgang kostet 2,5% des Eingabetarifs auf Claude Fable 5.1, 5% auf Claude Opus 5.5 und 10% auf Claude Fable 5. Die Cache-Spalten in den obigen Tabellen sind SeedRouter's eigene Tarife für diese fünf Zeilen.
Bei diesen Verhältnissen zahlt sich ein 5-Minuten-Schreibvorgang beim ersten Mal aus, wenn der Präfix zurückgelesen wird, und ein 1-Stunden-Schreibvorgang beim zweiten Mal. Verwenden Sie den 1-Stunden-Schreibvorgang, wenn Anfragen mehr als fünf Minuten auseinander liegen. Um Caching einzuschalten, fügen Sie cache_control wie in der Claude Opus 5.5 API-Referenz beschrieben zu der Anfrage hinzu.
Ändert die Effort-Einstellung den Preis?
Nicht den Tarif, aber die Rechnung. Effort (output_config.effort: low, medium, high, xhigh oder max) entscheidet, wie viel das Modell denkt, und Denken wird als Ausgabe abgerechnet. Dieselbe Frage bei low kostet normalerweise weniger als bei max. Claude Fable 5.1 und Claude Fable 5 verwenden standardmäßig high; Claude Opus 5.5 verwendet standardmäßig medium.
Denken kann auf diesen drei Modellen nicht ausgeschaltet werden, nur reduziert. Wenn eine Aufgabe einfach ist, ist niedrigerer Effort die direkteste Weise, Kosten zu senken.
Ist ein Claude Pro oder Max Abonnement dasselbe wie API-Zugriff?
Nein. Anthropic's Support-Artikel ist eindeutig: „Ein bezahltes Claude-Abonnement verbessert Ihr Chat-Erlebnis, beinhaltet aber keinen Zugriff auf die Claude API oder Konsole" (Quelle). Pro und Max decken die Claude-Apps ab. API-Aufrufe werden pro Token separat abgerechnet.
Bei SeedRouter gibt es nur die Seite mit Abrechnung pro Token. Sie laden einmal auf der Abrechnungsseite Guthaben auf, das Guthaben verfällt nie, und jede abgeschlossene Anfrage wird von diesem Guthaben abgezogen. Dasselbe Guthaben bezahlt jedes Modell im Katalog.
Häufig gestellte Fragen
Wie viel kosten 1 Million Claude-Token?
Es hängt vom Modell ab und davon, ob die Token Eingabe oder Ausgabe sind. Die Ausgabe kostet fünfmal die Eingabe auf allen drei Modellen. Die Live-Tabellen oben geben den Tarif für jeden an, und die Claude Opus 5.5-Reihe ist die niedrigste.
Ist Claude Opus 5.5 günstiger als Claude Fable 5.1?
Ja, auf jeder Zeile der Tabelle. In Anthropic's Liste sind Claude Opus 5.5's Ein- und Ausgabetarife 40% von Claude Fable 5.1's, und die SeedRouter-Tarife oben halten diese Reihenfolge ein.
Ist Claude Opus 5.5 günstiger als Claude Opus 5?
In Anthropic's Liste ja: Seine Ein- und Ausgabetarife sind 20% unter Claude Opus 5's, und Cache-Lesevorgänge sind 60% unter. SeedRouter verkauft Claude Opus 5 nicht.
Kostet ein langer Prompt mehr pro Token?
Nein. Anthropic rechnet das vollständige 1M-Token-Kontextfenster dieser Modelle zum Standardtarif ab: Seine Preisseite sagt „eine 900k-Token-Anfrage wird zum gleichen Pro-Token-Tarif abgerechnet wie eine 9k-Token-Anfrage." Ein langer Prompt kostet mehr nur, weil er mehr Token hat.
Sind Batch API-Rabatte oder schneller Modus verfügbar?
Nicht bei SeedRouter. Anfragen laufen durch die Standard-Messages-, Chat Completions- und Responses-Endpunkte und werden zu den Tarifen in den obigen Tabellen abgerechnet.
Wo kann ich sehen, was eine Anfrage gekostet hat?
Im Nutzungsverlauf, Anfrage für Anfrage. Die API-Antwort selbst meldet Token-Zähler in usage, aber keinen Dollarbetrag.
Kalkulieren Sie vor dem Versenden
Starten Sie mit Claude Opus 5.5, verschieben Sie eine Aufgabe zu Claude Fable 5.1 nur, wenn sie tieferes Denken benötigt, und cachen Sie jeden Präfix, den Sie mehr als einmal versenden. Überprüfen Sie die Live-Tabellen oben vor einem großen Job, laden Sie auf der Abrechnungsseite Guthaben auf, und lesen Sie die Claude Fable 5.1, Claude Fable 5 und Claude Opus 5.5 Seiten, um jedes Modell im Browser auszuprobieren.



