Tarifs de l’API DeepSeek V4.1 Flash : heures pleines, heures creuses et cache
Tarifs de l’API DeepSeek V4.1 Flash par million de tokens : heures pleines et creuses, cache, horaires, formule de facturation et coût d’une requête.
Lire en MarkdownDeepSeek V4.1 Flash est facturé au token, et le tarif dépend de l'heure. Les heures pleines vont de 01:00 à 04:00 et de 06:00 à 10:00 UTC, du lundi au vendredi ; toutes les autres heures, week-ends compris, sont des heures creuses à moitié prix. L'entrée trouvée dans le cache coûte une petite fraction d'une entrée fraîche, et l'écriture en cache n'est pas facturée. Sur SeedRouter, il n'y a pas d'abonnement, et une requête qui échoue n'est pas facturée.
Le tableau ci-dessous est lu dans la grille qui facture votre compte : il montre donc ce que coûte une requête aujourd'hui.
Combien coûte DeepSeek V4.1 Flash par million de tokens ?
DeepSeek V4.1 Flash
Current rates are temporarily unavailable. No price estimate is provided; unavailable rates must not be interpreted as free usage.
Les heures creuses couvrent 133 des 168 heures de la semaine : tout le samedi et le dimanche, et chaque heure de semaine en dehors des deux plages d'heures pleines.
Quels sont les prix catalogue de DeepSeek ?
Pour référence, voici la structure des prix de DeepSeek pour ce modèle, d'après sa page Models & Pricing. Chaque ligne est un multiple du tarif d'entrée en heures pleines :
| Ligne | Heures pleines | Heures creuses |
|---|---|---|
| Entrée, absente du cache | 1× | 0.5× |
| Entrée, trouvée dans le cache | 0.02× | 0.01× |
| Sortie | 4× | 2× |
Le tableau en direct ci-dessus montre le tarif SeedRouter de chaque ligne, et la page DeepSeek V4.1 Flash les affiche à côté du prix catalogue de DeepSeek. La grille de DeepSeek classe aussi les jours fériés chinois en heures creuses ; SeedRouter applique le calendrier de semaine chaque semaine.
Comment une requête DeepSeek V4.1 Flash est-elle facturée ?
Chaque réponse indique ses nombres de tokens dans usage, et la facturation les suit :
prompt_cache_miss_tokens: tokens de prompt lus à neuf.prompt_cache_hit_tokens: tokens de prompt servis depuis le cache.completion_tokens: la réponse, plus le raisonnement quand la réflexion est activée.
Le coût, aux tarifs de l'heure où la requête s'exécute :
cost = ( cache-miss input × input rate
+ cache-hit input × cache-hit rate
+ completion × output rate ) / 1,000,000Combien coûte une tâche DeepSeek V4.1 Flash ?
La réflexion change surtout le côté sortie. Dans notre test sur la même question de comptage de nombres premiers, la réflexion coupée a utilisé 2 tokens de sortie, l'effort low 258 et max 319. Trois profils de travail indicatifs, en tokens :
| Tâche | Entrée | Sortie |
|---|---|---|
| Une classification sans réflexion | environ 150 | environ 10 |
Une revue de code avec l'effort high | environ 5 000 | environ 1 500 |
| Une étape d'agent sur un grand dépôt | environ 200 000, surtout trouvés dans le cache | environ 3 000 |
Multipliez chacun par les tarifs en direct ci-dessus, et divisez par deux en heures creuses. La sortie coûte quatre fois l'entrée par token, donc le raisonnement et les réponses décident généralement de la facture. Pour un agent qui relit les mêmes fichiers, le cache ramène le côté entrée à environ 2 % d'une entrée fraîche.
Le prix de DeepSeek V4 Flash a-t-il changé ?
Deux fois en 2026. Le 16 août, DeepSeek a fait passer ses modèles V4 à une tarification heures pleines / heures creuses, les heures creuses étant à moitié prix. Le 10 septembre, quand V4.1 Flash a remplacé V4 Flash, son journal des changements indique « API prices have been reduced accordingly ». Le changement le plus récent était une baisse, et les anciens noms de modèle tournent désormais sur V4.1 Flash au prix de V4.1 Flash.
Comment payer DeepSeek V4.1 Flash moins cher ?
- Lancez le travail flexible en heures creuses. Traitements par lots, évaluations et backfills coûtent moitié moins en dehors des plages d'heures pleines.
- Coupez la réflexion pour les étapes simples. La classification et l'extraction ont rarement besoin de raisonnement, et le raisonnement est de la sortie.
- Placez le contexte réutilisé au début du prompt. Le cache est automatique et ne demande aucune configuration ; les préfixes répétés sont facturés au tarif cache.
- Définissez
max_tokenspour qu'une longue réponse ne dépasse pas ce que vous comptiez payer.
Questions fréquentes
Quelles sont les heures pleines de DeepSeek V4.1 Flash ?
De 01:00 à 04:00 et de 06:00 à 10:00 UTC, du lundi au vendredi. Tout le reste est en heures creuses.
L'écriture en cache est-elle facturée ?
Non. DeepSeek V4.1 Flash facture les entrées absentes et trouvées dans le cache ; l'écriture en cache n'est pas facturée à part.
Existe-t-il un abonnement DeepSeek V4.1 Flash ?
Pas sur SeedRouter. Vous rechargez un solde et payez au token, sans forfait ni frais mensuels.
Comment démarrer ?
Le guide de l'API DeepSeek V4.1 Flash montre comment obtenir une clé et faire le premier appel.



