Claude Opus 5.5 ist auf SeedRouter verfügbar
DeepSeekTextgenerierung

DeepSeek V4.1 Flash — schnelles, günstiges Reasoning mit Bildern

DeepSeek V4.1 Flash ist das schnelle, günstige Modell von DeepSeek mit einem 1M-Token-Kontextfenster und Bildeingabe. $0.24 / 1M Eingabe, $0.96 / 1M Ausgabe pro 1M Token zur Hauptzeit; zur Nebenzeit die Hälfte.

Verfügbar$0.24 / 1M Eingabe · $0.96 / 1M Ausgabe$0.30 / 1M Eingabe · $1.20 / 1M Ausgabe-20%
  • Denken an oder aus
  • 1M-Token-Kontextfenster
  • Bildeingabe
  • Günstigere Tarife zur Nebenzeit
  • Streaming
Kontextfenster
1M Token
Maximale Ausgabe
384K Token
Reasoning-Stufen
none, low, high, max
Veröffentlicht
10. September 2026

DeepSeek V4.1 Flash ausprobieren

Chatte mit DeepSeek V4.1 Flash, hänge Bilder an und sieh bei jeder Antwort die Token und Kosten.

Parameter

deepseek-v4.1-flash$0.24 Eingabe · $0.96 Ausgabe pro 1M Tokens (jetzt Hauptzeit)

Denken
Reasoning effort

Mit aktivem Denken hat temperature keine Wirkung, und top_p unter 0.95 läuft als 0.95.

Log probabilities

Wird akzeptiert, aber es werden keine Log-Wahrscheinlichkeiten zurückgegeben.

Gesamtkosten der Unterhaltung$0.000000
Bereit

Probier einen dieser Prompts

Nachrichten werden aus deinem Guthaben zu den unten angegebenen Tarifen abgerechnet, wie ein API-Aufruf. Fehlgeschlagene Anfragen sind kostenlos.

Echte Ausgabe von DeepSeek V4.1 Flash

Ein Prompt, an DeepSeek V4.1 Flash mit ausgeschaltetem Denken gesendet. Unbearbeitet.

Explain the difference between a mutex and a semaphore in two short paragraphs, and say when to use each.

A mutex is a locking mechanism designed for mutual exclusion: only the thread that locked it may unlock it, and it has a notion of ownership. It's binary (locked/unlocked) and is used to protect a shared resource so that only one thread accesses it at a time. A semaphore is a signaling mechanism built around a counter: it tracks how many permits are available, any thread can wait (decrement) or post (increment) it, and it doesn't care which thread does what. A binary semaphore looks similar to a mutex, but lacks ownership, so it can be released by a different thread—useful for signaling between threads rather than guarding a critical section. Use a mutex when you need to protect a shared resource (a data structure, file, or device) from concurrent access, which is the common case for locking critical sections. Use a semaphore when you need to control access to a pool of N identical resources (e.g., limiting concurrent database connections) or to signal between threads, such as a producer notifying a consumer that data is ready or a task-completion event. As a rule of thumb: mutex for mutual exclusion, semaphore for counting or signaling.

Generiert am 2026-09-28. Antworten variieren von Durchlauf zu Durchlauf.

DeepSeek V4.1 Flash Preise

DeepSeek V4.1 Flash wird pro Token von deinem Guthaben abgerechnet, je nach Uhrzeit zu Hauptzeit- oder Nebenzeit-Tarifen. Die Tarife unten sind live – dieselben, die deinem Konto berechnet werden.

Eine typische Anfrage2.000 Input-Token, 1.000 Output-Token, Hauptzeit
$0.0014pro Anfrage
Zur Nebenzeit kostet dieselbe Anfrage die Hälfte.
Was $20.00 dir bringtOutput-Token zum Hauptzeit-Tarif
20,833,333Output-Token
Zur Nebenzeit doppelt so viele. Gecachte Eingabe kostet einen Bruchteil der Eingabe.

Beispielgrößen dienen nur der Veranschaulichung und nutzen Hauptzeit-Tarife. Deine Abrechnung folgt den Token, die jede Anfrage meldet, und der Uhrzeit, zu der sie läuft.

PostenGezählt alsTarifAbrechnung
Eingabe, HauptzeitPrompt-Token ohne Cache-Treffer, 01:00–04:00 und 06:00–10:00 UTC, Mo–Fr$0.24 / 1MPro 1M Token
Ausgabe, HauptzeitAntwort- und Reasoning-Token, Hauptzeit$0.96 / 1MPro 1M Token
Gecachte Eingabe, HauptzeitPrompt-Token mit Cache-Treffer, Hauptzeit$0.0048 / 1MPro 1M Token
Eingabe, NebenzeitPrompt-Token ohne Cache-Treffer, alle übrigen Stunden, Wochenenden inklusive$0.12 / 1MPro 1M Token
Ausgabe, NebenzeitAntwort- und Reasoning-Token, Nebenzeit$0.48 / 1MPro 1M Token
Gecachte Eingabe, NebenzeitPrompt-Token mit Cache-Treffer, Nebenzeit$0.0024 / 1MPro 1M Token
Fehlgeschlagene AnfrageJede Anfrage, die einen Fehler zurückgibtKostenlosNicht berechnet

Was ist DeepSeek V4.1 Flash?

DeepSeek V4.1 Flash ist das schnelle, günstige Modell von DeepSeek, veröffentlicht am 10. September 2026. Es ist ein Mixture-of-Experts-Modell mit 552B Parametern, das 8B Parameter zum Lesen und 16B zum Schreiben aktiviert, Bilder nativ liest und bis zu 1M Token Kontext aufnimmt.

DeepSeek V4.1 Flash denkt standardmäßig vor der Antwort nach, mit Reasoning-Aufwand high. Schalte das Denken für schnelle, einfache Schritte aus, oder erhöhe den Reasoning-Aufwand für harte Probleme auf max. In der eigenen API von DeepSeek heißt das Modell deepseek-flash.

Modell-ID: deepseek-v4.1-flash · Eingabe: Text, Bilder · Ausgabe: Text · Formate: Chat Completions, Responses, Anthropic Messages.

Modell-ID
deepseek-v4.1-flash
Kontextfenster
1M Token
Maximale Ausgabe
384K Token
Reasoning-Stufen
none, low, high, max
Eingabe
Text, Bilder

Zwei Wege, DeepSeek V4.1 Flash zu nutzen

Rufe es aus deinem Code auf, oder lass deinen Coding-Agenten es tun.

API

Vom Backend aufrufen

Ideal für Apps und Services

Richte das OpenAI SDK auf SeedRouter aus und behalte deinen Code. DeepSeek V4.1 Flash antwortet im Chat-Completions-, Responses- und Anthropic-Messages-Format.

  1. 1API-Schlüssel erstellen
  2. 2Base URL auf https://api.seedrouter.ai/v1 setzen
  3. 3deepseek-v4.1-flash als Modell senden
Agent

Überlass es deinem Coding-Agenten

Ideal für Codex, Claude Code und andere Agenten

Kopiere einen fertigen Prompt. Dein Agent zeigt die Anfrage und die Kosten, bevor etwas ausgegeben wird.

  1. 1Prompt kopieren
  2. 2In deinen Agenten einfügen
  3. 3Anfrage bestätigen

Wofür DeepSeek V4.1 Flash gut ist

DeepSeek V4.1 Flash ist für Arbeit mit hohem Volumen gebaut, bei der Geschwindigkeit und Kosten zählen.

Agenten-Loops

DeepSeek V4.1 Flash führt viele günstige Schritte aus, und gecachter Kontext hält wiederholtes Lesen günstig.

Programmieren im Alltag

Schreibe, prüfe und korrigiere Code mit DeepSeek V4.1 Flash in Codex, Claude Code oder deinen eigenen Tools.

Bilder im Prompt

DeepSeek V4.1 Flash liest Screenshots, Diagramme und Fotos per URL oder base64.

Strukturierte Ausgabe

Fordere bei DeepSeek V4.1 Flash json_object-Ausgabe an und parse die Antwort direkt.

Denken an oder aus

Überspring das Reasoning von DeepSeek V4.1 Flash für schnelle Antworten, oder dreh es für schwierige hoch.

Nebenzeit-Tarife

Batch-Jobs außerhalb der Hauptzeit zahlen die Hälfte des Hauptzeit-Preises.

Was Teams mit DeepSeek V4.1 Flash bauen

Klassifizierung im großen Maßstab

Verschlagworte Tickets, Bewertungen und Logs mit DeepSeek V4.1 Flash bei ausgeschaltetem Denken, zu den niedrigsten Kosten.

Coding-Agenten

Lass DeepSeek V4.1 Flash in Codex für schnelle, günstige Edit-and-Run-Loops laufen.

Screenshots auslesen

Wandle Screenshots und Diagramme in Text oder JSON um.

DeepSeek V4.1 Flash in vier Schritten nutzen

  1. 01

    Schlüssel erstellen

    Meld dich an und erstelle einen API-Schlüssel. Füge Guthaben hinzu, wann immer du es brauchst; es gibt kein Abo.

  2. 02

    Base URL ändern

    Richte das OpenAI SDK auf https://api.seedrouter.ai/v1 aus. Dein Code bleibt gleich.

  3. 03

    DeepSeek V4.1 Flash wählen

    Sende deepseek-v4.1-flash als Modell. Schalte das Denken aus oder setze den Reasoning-Aufwand pro Anfrage.

  4. 04

    Abrechnung prüfen

    Jede Anfrage zeigt ihre Token und Kosten in deinem Nutzungsverlauf.

API-Schlüssel holen

DeepSeek V4.1 Flash auf SeedRouter auf einen Blick

Was du heute nutzen kannst.

MerkmalDeepSeek V4.1 Flash
Chat CompletionsJa, offizielles Format
ResponsesJa, funktioniert mit Codex
Anthropic MessagesJa, funktioniert mit Claude Code
BildeingabeJa, per URL oder base64
StreamingJa
Kontext-CachingJa, automatisch, Cache-Treffer werden günstiger abgerechnet
JSON-AusgabeJa, json_object
Fehlgeschlagene AnfragenNicht berechnet

FIM und Chat Prefix Completion (Beta), die Files API und Log-Wahrscheinlichkeiten werden nicht angeboten.

DeepSeek V4.1 Flash Limits

1M-Token-Kontextfenster

Bei DeepSeek V4.1 Flash teilen sich Prompt, Bilder und Verlauf ein Fenster von 1M Token.

384K Token raus

Eine Anfrage an DeepSeek V4.1 Flash schreibt bis zu 393.216 Token, Reasoning inklusive.

Sampling bei aktivem Denken

Bei aktivem Denken hat temperature keine Wirkung, und top_p bleibt bei 0.95 oder darüber.

Bildgröße

Eine Bild-URL für DeepSeek V4.1 Flash darf auf eine Datei von bis zu 32 MiB verweisen.

Warum DeepSeek V4.1 Flash über SeedRouter aufrufen

Ein Schlüssel, drei Formate

Ruf DeepSeek V4.1 Flash mit Chat Completions, Responses oder Anthropic Messages auf – mit demselben Schlüssel.

Zahle pro Token

Lade einmal auf und gib es für jedes Modell aus. Kein Plan, keine monatliche Gebühr.

Fehler sind kostenlos

Eine Anfrage, die einen Fehler zurückgibt, wird nicht berechnet.

Live-Preisgestaltung

Die Tarife auf dieser Seite sind die Tarife, die dein Konto zahlt, zur Hauptzeit und zur Nebenzeit.

Kontext-Caching

Wiederholte Prompt-Präfixe werden zu einem günstigeren DeepSeek V4.1 Flash Tarif aus dem Cache gelesen.

Reasoning in der Antwort

Bei aktivem Denken kommt das Reasoning in reasoning_content neben der Antwort zurück.

Streaming

Streame die Token von DeepSeek V4.1 Flash mit stream: true, sobald sie ankommen.

Verwandte Modelle

Andere Modelle, die du mit demselben Schlüssel aufrufen kannst.

Kimi K3
kimi-k3

Kimi K3 mit dem OpenAI- oder Anthropic-SDK nutzen: 1M-Token-Kontextfenster, Reasoning immer aktiv (low, high, max), Live-Preise pro Token und Playground.

Preisgestaltung ansehen
claude-fable-5
claude-fable-5

Anthropic

Preisgestaltung ansehen
claude-fable-5-1
claude-fable-5-1

Anthropic

Preisgestaltung ansehen
claude-opus-5-5
claude-opus-5-5

Anthropic

Preisgestaltung ansehen
dreamina-seedance-2-0
dreamina-seedance-2-0

ByteDance

Preisgestaltung ansehen
dreamina-seedance-2-0-fast
dreamina-seedance-2-0-fast

ByteDance

Preisgestaltung ansehen

DeepSeek V4.1 Flash FAQ

Was ist DeepSeek V4.1 Flash?+

DeepSeek V4.1 Flash ist das schnelle, günstige Modell von DeepSeek, veröffentlicht am 10. September 2026. Es ist ein Mixture-of-Experts-Modell mit 552B Parametern, nativer Bildeingabe, einem Kontextfenster von 1M Token und Denken, das du ein- oder ausschalten kannst.

Was kostet DeepSeek V4.1 Flash?+

DeepSeek V4.1 Flash kostet zur Hauptzeit (01:00–04:00 und 06:00–10:00 UTC, Montag bis Freitag) $0.24 / 1M Eingabe und $0.96 / 1M Ausgabe pro 1M Token. Alle übrigen Stunden sind Nebenzeit mit halben Tarifen, und Cache-Treffer kosten einen Bruchteil der Eingabe.

Kann ich DeepSeek V4.1 Flash kostenlos nutzen?+

Jedes neue SeedRouter-Konto startet mit $0.10 Gratis-Guthaben, genug, um DeepSeek V4.1 Flash mit vielen kurzen Anfragen auszuprobieren. Danach zahlst du pro Token, ohne Abo, und eine fehlgeschlagene Anfrage wird nicht berechnet.

Unterstützt DeepSeek V4.1 Flash Bilder?+

Ja. DeepSeek V4.1 Flash liest Bilder nativ. Sende sie per öffentlicher URL oder als base64 in der Anfrage; es gibt Text zurück.

Wie schalte ich das Denken bei DeepSeek V4.1 Flash aus?+

Setze thinking auf disabled oder reasoning_effort auf none. Die Antwort kommt dann sofort und verbraucht weniger Output-Token.

Ist DeepSeek V4.1 Flash dasselbe wie DeepSeek V4 Flash?+

Nein. DeepSeek V4.1 Flash hat V4 Flash am 10. September 2026 abgelöst, mit neuer Architektur und nativer Bildeingabe. DeepSeek hat V4 Flash eingestellt und leitet dessen alte Modellnamen auf DeepSeek V4.1 Flash um.

Kann ich DeepSeek V4.1 Flash lokal ausführen?+

Die Gewichte liegen auf Hugging Face. Mit 552B Parametern braucht es Multi-GPU-Hardware, deshalb rufen die meisten Teams DeepSeek V4.1 Flash über eine API auf.

Wie lautet die Modell-ID von DeepSeek V4.1 Flash und wie rufe ich es auf?+

Auf SeedRouter ist die Modell-ID deepseek-v4.1-flash. Erstelle einen SeedRouter API-Schlüssel, richte das OpenAI SDK auf https://api.seedrouter.ai/v1 aus und sende deepseek-v4.1-flash als Modell.

Zahle ich, wenn eine DeepSeek V4.1 Flash Anfrage fehlschlägt?+

Nein. Eine DeepSeek V4.1 Flash Anfrage, die einen Fehler zurückgibt, wird nicht berechnet. Du zahlst nur für die Token, die eine abgeschlossene Anfrage meldet.

DeepSeek V4.1 Flash jetzt testen

Sende deine erste DeepSeek V4.1 Flash Anfrage in wenigen Minuten aus dem Playground oder deinem eigenen Code.