Claude Opus 5.5 est disponible sur SeedRouter
DeepSeekGénération de texte

DeepSeek V4.1 Flash — un raisonnement rapide et économique, avec images

DeepSeek V4.1 Flash est le modèle rapide et économique de DeepSeek, avec une fenêtre de contexte d'1M tokens et l'entrée d'images. $0.24 / 1M en entrée, $0.96 / 1M en sortie par 1M de tokens aux heures pleines ; moitié moins aux heures creuses.

Disponible$0.24 / 1M en entrée · $0.96 / 1M en sortie$0.30 / 1M en entrée · $1.20 / 1M en sortie-20%
  • Réflexion activée ou désactivée
  • Fenêtre de contexte d'1M tokens
  • Entrée d'images
  • Tarifs aux heures creuses
  • Streaming
Fenêtre de contexte
1M tokens
Sortie maximale
384K tokens
Niveaux de raisonnement
none, low, high, max
Date de sortie
10 septembre 2026

Essayer DeepSeek V4.1 Flash

Discutez avec DeepSeek V4.1 Flash, joignez des images, et voyez les tokens et le coût de chaque réponse.

Paramètres

deepseek-v4.1-flash$0.24 entrée · $0.96 sortie par million de tokens (heures pleines actuellement)

Réflexion
Reasoning effort

Avec la réflexion activée, temperature n'a aucun effet et un top_p inférieur à 0.95 est appliqué comme 0.95.

Log probabilities

Accepté, mais aucune log probability n'est renvoyée.

Total de la conversation$0.000000
Prêt

Essayez l'un de ces prompts

Les messages sont facturés sur votre solde aux tarifs ci-dessous, comme un appel API. Les requêtes en échec sont gratuites.

Sortie réelle de DeepSeek V4.1 Flash

Un prompt, envoyé à DeepSeek V4.1 Flash avec la réflexion désactivée. Sans modification.

Explain the difference between a mutex and a semaphore in two short paragraphs, and say when to use each.

A mutex is a locking mechanism designed for mutual exclusion: only the thread that locked it may unlock it, and it has a notion of ownership. It's binary (locked/unlocked) and is used to protect a shared resource so that only one thread accesses it at a time. A semaphore is a signaling mechanism built around a counter: it tracks how many permits are available, any thread can wait (decrement) or post (increment) it, and it doesn't care which thread does what. A binary semaphore looks similar to a mutex, but lacks ownership, so it can be released by a different thread—useful for signaling between threads rather than guarding a critical section. Use a mutex when you need to protect a shared resource (a data structure, file, or device) from concurrent access, which is the common case for locking critical sections. Use a semaphore when you need to control access to a pool of N identical resources (e.g., limiting concurrent database connections) or to signal between threads, such as a producer notifying a consumer that data is ready or a task-completion event. As a rule of thumb: mutex for mutual exclusion, semaphore for counting or signaling.

Généré le 2026-09-28. Les réponses varient d'une exécution à l'autre.

Tarifs de DeepSeek V4.1 Flash

DeepSeek V4.1 Flash est facturé par token sur votre solde, au tarif heures pleines ou heures creuses selon l'heure. Les tarifs ci-dessous sont en direct : ce sont ceux que votre compte paie.

Une requête typique2 000 tokens en entrée, 1 000 tokens en sortie, heures pleines
$0.0014par requête
Aux heures creuses, la même requête coûte moitié moins.
Ce que $20.00 achèteTokens de sortie au tarif heures pleines
20,833,333tokens de sortie
Deux fois plus aux heures creuses. L'entrée en cache ne coûte qu'une fraction de l'entrée.

Les tailles d'exemple sont données à titre d'illustration et utilisent les tarifs heures pleines. Votre facture se base sur les tokens déclarés par chaque requête et sur l'heure à laquelle elle s'exécute.

ÉlémentCompté commeTarifFacturation
Entrée, heures pleinesTokens de prompt absents du cache, de 01:00 à 04:00 et de 06:00 à 10:00 UTC, du lundi au vendredi$0.24 / 1MPar million de tokens
Sortie, heures pleinesTokens de réponse et de raisonnement, heures pleines$0.96 / 1MPar million de tokens
Entrée en cache, heures pleinesTokens de prompt trouvés dans le cache, heures pleines$0.0048 / 1MPar million de tokens
Entrée, heures creusesTokens de prompt absents du cache, toutes les autres heures, week-ends compris$0.12 / 1MPar million de tokens
Sortie, heures creusesTokens de réponse et de raisonnement, heures creuses$0.48 / 1MPar million de tokens
Entrée en cache, heures creusesTokens de prompt trouvés dans le cache, heures creuses$0.0024 / 1MPar million de tokens
Requête en échecN'importe quelle requête qui retourne une erreurGratuitNon facturé

Qu'est-ce que DeepSeek V4.1 Flash ?

DeepSeek V4.1 Flash est le modèle rapide et économique de DeepSeek, sorti le 10 septembre 2026. C'est un modèle mixture-of-experts de 552 milliards de paramètres qui en active 8 milliards pour lire et 16 milliards pour écrire ; il lit nativement les images et accepte jusqu'à 1M tokens de contexte.

Par défaut, DeepSeek V4.1 Flash réfléchit avant de répondre, avec un effort de raisonnement high. Désactivez la réflexion pour les étapes simples et rapides, ou montez l'effort de raisonnement à max pour les problèmes difficiles. L'API de DeepSeek elle-même appelle ce modèle deepseek-flash.

ID de modèle : deepseek-v4.1-flash · Entrée : texte, images · Sortie : texte · Formats : Chat Completions, Responses, Anthropic Messages.

ID de modèle
deepseek-v4.1-flash
Fenêtre de contexte
1M tokens
Sortie maximale
384K tokens
Niveaux de raisonnement
none, low, high, max
Entrée
Texte, images

Deux façons d'utiliser DeepSeek V4.1 Flash

Appelez-le depuis votre code, ou laissez votre agent de codage le faire.

API

Appelez-le depuis votre serveur d'application

Idéal pour les applications et services

Pointez le SDK OpenAI vers SeedRouter et gardez votre code. DeepSeek V4.1 Flash répond aux formats Chat Completions, Responses et Anthropic Messages.

  1. 1Créez une clé API
  2. 2Définissez l'URL de base sur https://api.seedrouter.ai/v1
  3. 3Envoyez deepseek-v4.1-flash comme modèle
Agent

Confiez-le à votre agent de codage

Idéal pour Codex, Claude Code et autres agents

Copiez un prompt prêt. Votre agent affiche la requête et le coût avant que quoi que ce soit ne soit dépensé.

  1. 1Copiez le prompt
  2. 2Collez-le dans votre agent
  3. 3Approuvez la requête

Ce que DeepSeek V4.1 Flash fait bien

DeepSeek V4.1 Flash est conçu pour le travail à fort volume, où la vitesse et le coût comptent.

Boucles d'agent

DeepSeek V4.1 Flash enchaîne de nombreuses étapes peu coûteuses, et le contexte en cache garde les relectures bon marché.

Codage au quotidien

Écrivez, relisez et corrigez du code avec DeepSeek V4.1 Flash dans Codex, Claude Code ou vos propres outils.

Images dans le prompt

DeepSeek V4.1 Flash lit les captures d'écran, graphiques et photos par URL ou en base64.

Sortie structurée

Demandez à DeepSeek V4.1 Flash une sortie json_object et analysez directement la réponse.

Réflexion activée ou désactivée

Sautez le raisonnement de DeepSeek V4.1 Flash pour des réponses rapides, ou renforcez-le pour les questions difficiles.

Tarifs heures creuses

Les traitements par lots hors heures pleines paient moitié moins que le tarif heures pleines.

Ce que les équipes construisent avec DeepSeek V4.1 Flash

Classification à grande échelle

Étiquetez tickets, avis et logs avec DeepSeek V4.1 Flash, réflexion désactivée, au coût le plus bas.

Agents de codage

Exécutez DeepSeek V4.1 Flash dans Codex pour des boucles modifier-exécuter rapides et peu coûteuses.

Lecture de captures d'écran

Transformez captures d'écran et graphiques en texte ou en JSON.

Commencer à utiliser DeepSeek V4.1 Flash en quatre étapes

  1. 01

    Créez une clé

    Connectez-vous et créez une clé API. Ajoutez du crédit chaque fois que vous en avez besoin ; il n'y a pas d'abonnement.

  2. 02

    Changez l'URL de base

    Pointez le SDK OpenAI vers https://api.seedrouter.ai/v1. Votre code reste le même.

  3. 03

    Choisissez DeepSeek V4.1 Flash

    Envoyez deepseek-v4.1-flash comme modèle. Désactivez la réflexion ou réglez l'effort de raisonnement à chaque requête.

  4. 04

    Vérifiez la facture

    Chaque requête affiche ses tokens et son montant facturé dans votre historique d'utilisation.

Obtenir une clé API

DeepSeek V4.1 Flash sur SeedRouter en un coup d'œil

Ce que vous pouvez utiliser aujourd'hui.

FonctionnalitéDeepSeek V4.1 Flash
Chat CompletionsOui, format officiel
ResponsesOui, compatible avec Codex
Anthropic MessagesOui, compatible avec Claude Code
Entrée d'imagesOui, par URL ou base64
StreamingOui
Mise en cache du contexteOui, automatique, les accès au cache sont facturés moins cher
Sortie JSONOui, json_object
Requêtes en échecNon facturé

Le FIM et la complétion par préfixe de chat (bêta), la Files API et les log probabilities ne sont pas proposés.

Limites de DeepSeek V4.1 Flash

Fenêtre de contexte d'1M tokens

Sur DeepSeek V4.1 Flash, le prompt, les images et l'historique partagent une fenêtre d'1M tokens.

384K tokens en sortie

Une requête DeepSeek V4.1 Flash écrit jusqu'à 393 216 tokens, raisonnement inclus.

Échantillonnage avec la réflexion activée

Avec la réflexion activée, temperature n'a aucun effet et top_p reste à 0.95 ou plus.

Taille des images

Une URL d'image pour DeepSeek V4.1 Flash peut pointer vers un fichier de 32 Mio au maximum.

Pourquoi appeler DeepSeek V4.1 Flash via SeedRouter

Une clé, trois formats

Appelez DeepSeek V4.1 Flash avec Chat Completions, Responses ou Anthropic Messages, avec la même clé.

Paiement par token

Rechargez une fois et utilisez votre solde sur n'importe quel modèle. Pas de forfait, pas de frais mensuels.

Les échecs sont gratuits

Une requête qui génère une erreur n'est pas facturée.

Tarifs en direct

Les tarifs sur cette page sont ceux que votre compte paie, aux heures pleines comme aux heures creuses.

Mise en cache du contexte

Les préfixes de prompt répétés sont lus depuis le cache à un tarif DeepSeek V4.1 Flash plus bas.

Le raisonnement renvoyé dans la réponse

Avec la réflexion activée, le raisonnement est renvoyé dans reasoning_content, à côté de la réponse.

Streaming

Recevez les tokens de DeepSeek V4.1 Flash au fur et à mesure avec stream: true.

Modèles connexes

Autres modèles que vous pouvez appeler avec la même clé.

Kimi K3
kimi-k3

Appelez Kimi K3 avec le SDK OpenAI ou Anthropic. Contexte d'1M tokens, raisonnement toujours actif (low, high ou max), tarifs par token en direct et Playground.

Afficher les tarifs
claude-fable-5
claude-fable-5

Anthropic

Afficher les tarifs
claude-fable-5-1
claude-fable-5-1

Anthropic

Afficher les tarifs
claude-opus-5-5
claude-opus-5-5

Anthropic

Afficher les tarifs
dreamina-seedance-2-0
dreamina-seedance-2-0

ByteDance

Afficher les tarifs
dreamina-seedance-2-0-fast
dreamina-seedance-2-0-fast

ByteDance

Afficher les tarifs

Guides DeepSeek V4.1 Flash

Procédures pas à pas et comparaisons pour ce modèle.

FAQ DeepSeek V4.1 Flash

Qu'est-ce que DeepSeek V4.1 Flash ?+

DeepSeek V4.1 Flash est le modèle rapide et économique de DeepSeek, sorti le 10 septembre 2026. C'est un modèle mixture-of-experts de 552 milliards de paramètres, avec une entrée d'images native, une fenêtre de contexte d'1M tokens et une réflexion que vous pouvez activer ou désactiver.

Combien coûte DeepSeek V4.1 Flash ?+

DeepSeek V4.1 Flash est facturé $0.24 / 1M en entrée et $0.96 / 1M en sortie par million de tokens aux heures pleines (de 01:00 à 04:00 et de 06:00 à 10:00 UTC, du lundi au vendredi). Toutes les autres heures sont des heures creuses, à la moitié de ces tarifs, et les accès au cache ne coûtent qu'une fraction de l'entrée.

Peut-on utiliser DeepSeek V4.1 Flash gratuitement ?+

Chaque nouveau compte SeedRouter démarre avec $0.10 de solde offert, de quoi tester DeepSeek V4.1 Flash avec de nombreuses requêtes courtes. Ensuite, vous payez par token, sans abonnement, et une requête en échec n'est pas facturée.

DeepSeek V4.1 Flash prend-il en charge les images ?+

Oui. DeepSeek V4.1 Flash lit nativement les images. Envoyez-les par URL publique ou en base64 dans la requête ; il renvoie du texte.

Comment désactiver la réflexion de DeepSeek V4.1 Flash ?+

Réglez thinking sur disabled, ou reasoning_effort sur none. La réponse arrive alors immédiatement et utilise moins de tokens de sortie.

DeepSeek V4.1 Flash est-il identique à DeepSeek V4 Flash ?+

Non. DeepSeek V4.1 Flash a remplacé V4 Flash le 10 septembre 2026, avec une nouvelle architecture et une entrée d'images native. DeepSeek a retiré V4 Flash et redirige ses anciens noms de modèle vers DeepSeek V4.1 Flash.

Peut-on exécuter DeepSeek V4.1 Flash en local ?+

Ses poids sont disponibles sur Hugging Face. Avec 552 milliards de paramètres, il faut du matériel multi-GPU : la plupart des équipes appellent donc DeepSeek V4.1 Flash via une API.

Quel est l'ID de modèle de DeepSeek V4.1 Flash et comment l'appeler ?+

Sur SeedRouter, l'ID de modèle est deepseek-v4.1-flash. Créez une clé API SeedRouter, pointez le SDK OpenAI vers https://api.seedrouter.ai/v1 et envoyez deepseek-v4.1-flash comme modèle.

Suis-je facturé si une requête DeepSeek V4.1 Flash échoue ?+

Non. Une requête DeepSeek V4.1 Flash qui retourne une erreur n'est pas facturée. Vous ne payez que les tokens qu'une requête terminée rapporte.

Essayez DeepSeek V4.1 Flash maintenant

Envoyez votre première requête DeepSeek V4.1 Flash depuis le Playground ou votre propre code en quelques minutes.