Claude Opus 5.5 ist auf SeedRouter verfügbar

DeepSeek V4.1 Flash API-Preise: Hauptzeit, Nebenzeit und Cache-Treffer

DeepSeek V4.1 Flash API-Preise pro Million Token: Tarife in Hauptzeit und Nebenzeit, Cache-Treffer, Uhrzeiten, Abrechnungsformel und Kosten pro Anfrage.

Als Markdown lesen

DeepSeek V4.1 Flash wird pro Token abgerechnet, und der Tarif hängt von der Uhrzeit ab. Die Hauptzeit ist montags bis freitags von 01:00–04:00 und 06:00–10:00 UTC; jede andere Stunde, Wochenenden eingeschlossen, ist Nebenzeit zum halben Tarif der Hauptzeit. Eingabe, die den Cache trifft, kostet einen kleinen Bruchteil frischer Eingabe, und das Schreiben in den Cache ist kostenlos. Bei SeedRouter gibt es kein Abo, und eine fehlgeschlagene Anfrage wird nicht berechnet.

Die Tabelle unten wird aus der Tariftabelle gelesen, nach der Ihr Konto abgerechnet wird, und zeigt daher, was eine Anfrage heute kostet.

Was kostet DeepSeek V4.1 Flash pro Million Token?

DeepSeek V4.1 Flash

Current rates are temporarily unavailable. No price estimate is provided; unavailable rates must not be interpreted as free usage.

Die Nebenzeit umfasst 133 der 168 Stunden einer Woche: den ganzen Samstag und Sonntag sowie jede Werktagsstunde außerhalb der beiden Hauptzeitfenster.

Wie hoch sind DeepSeeks Listenpreise?

Zur Einordnung zeigt diese Tabelle die Struktur der eigenen Preise von DeepSeek für das Modell, aus der Seite Models & Pricing. Jede Zeile ist ein Vielfaches des Eingabetarifs in der Hauptzeit:

PositionHauptzeitNebenzeit
Eingabe, Cache-Fehlschlag1×0.5×
Eingabe, Cache-Treffer0.02×0.01×
Ausgabe4×2×

Die Live-Tabelle oben zeigt den SeedRouter-Tarif für jede Zeile, und die Seite zu DeepSeek V4.1 Flash stellt sie neben DeepSeeks Listenpreis. DeepSeeks eigene Tabelle führt außerdem chinesische Feiertage als Nebenzeit; SeedRouter wendet jede Woche den Werktagsplan an.

Wie wird eine DeepSeek V4.1 Flash-Anfrage abgerechnet?

Jede Antwort meldet ihre Token-Zahlen in usage, und die Kosten richten sich danach:

  • prompt_cache_miss_tokens: frisch gelesene Prompt-Token.
  • prompt_cache_hit_tokens: aus dem Cache bediente Prompt-Token.
  • completion_tokens: die Antwort plus das Reasoning, wenn der Denkmodus aktiv ist.

Die Kosten, zu den Tarifen der Stunde, in der die Anfrage läuft:

cost = ( cache-miss input × input rate
       + cache-hit input × cache-hit rate
       + completion × output rate ) / 1,000,000

Was kostet eine DeepSeek V4.1 Flash-Aufgabe?

Der Denkmodus verändert vor allem die Ausgabeseite. In unserem Test mit derselben Primzahlfrage verbrauchte der ausgeschaltete Denkmodus 2 Ausgabe-Token, der Aufwand low 258 und max 319. Drei beispielhafte Arbeitslasten, in Token:

AufgabeEingabeAusgabe
Eine Klassifizierung ohne Denkmodusetwa 150etwa 10
Ein Code-Review mit Aufwand highetwa 5.000etwa 1.500
Ein Agentenschritt in einem großen Repositoryetwa 200.000, überwiegend Cache-Trefferetwa 3.000

Multiplizieren Sie jeden Wert mit den Live-Tarifen oben und halbieren Sie ihn in der Nebenzeit. Ausgabe kostet pro Token das Vierfache der Eingabe, daher bestimmen Reasoning und Antworten meist die Rechnung. Bei einem Agenten, der dieselben Dateien erneut liest, senken Cache-Treffer die Eingabeseite auf etwa 2 % frischer Eingabe.

Hat sich der Preis von DeepSeek V4 Flash geändert?

Zweimal im Jahr 2026. Am 16. August stellte DeepSeek seine V4-Modelle auf Preise für Hauptzeit und Nebenzeit um, mit der Nebenzeit zum halben Tarif der Hauptzeit. Am 10. September, als V4.1 Flash V4 Flash ablöste, heißt es im Änderungsprotokoll: „API prices have been reduced accordingly“. Die jüngste Änderung war eine Senkung, und die alten Modellnamen laufen jetzt zum Preis von V4.1 Flash auf V4.1 Flash.

Wie zahle ich weniger für DeepSeek V4.1 Flash?

  • Flexible Arbeit in der Nebenzeit ausführen. Batch-Jobs, Evaluierungen und Backfills kosten außerhalb der Hauptzeitfenster die Hälfte.
  • Denkmodus bei einfachen Schritten ausschalten. Klassifizierung und Extraktion brauchen selten Reasoning, und Reasoning ist Ausgabe.
  • Wiederverwendeten Kontext an den Anfang des Prompts stellen. Caching ist automatisch und braucht keine Einrichtung; wiederholte Präfixe werden zum Cache-Treffer-Tarif abgerechnet.
  • max_tokens setzen, damit eine lange Antwort nicht über das hinausgeht, was Sie bezahlen wollten.

Häufig gestellte Fragen

Wann ist bei DeepSeek V4.1 Flash Hauptzeit?

Montags bis freitags von 01:00–04:00 und 06:00–10:00 UTC. Alles andere ist Nebenzeit.

Kostet das Schreiben in den Cache etwas?

Nein. DeepSeek V4.1 Flash berechnet Cache-Fehlschläge und Cache-Treffer; das Schreiben in den Cache wird nicht separat berechnet.

Gibt es ein Abo für DeepSeek V4.1 Flash?

Nicht bei SeedRouter. Sie laden Guthaben auf und zahlen pro Token, ohne Tarif und ohne Monatsgebühr.

Wie fange ich an?

Der API-Leitfaden zu DeepSeek V4.1 Flash zeigt, wie Sie einen Schlüssel erhalten und den ersten Aufruf machen.

Verwandte Leitfäden