Claude Opus 5.5 ya está disponible en SeedRouter
DeepSeekGeneración de texto

DeepSeek V4.1 Flash — razonamiento rápido y económico con imágenes

DeepSeek V4.1 Flash es el modelo rápido y económico de DeepSeek, con una ventana de contexto de 1M de tokens y entrada de imágenes. $0.24 / 1M entrada, $0.96 / 1M salida por 1M de tokens en horas pico; la mitad en horas valle.

Disponible$0.24 / 1M entrada · $0.96 / 1M salida$0.30 / 1M entrada · $1.20 / 1M salida-20%
  • Pensamiento activado o desactivado
  • Ventana de contexto de 1M de tokens
  • Entrada de imágenes
  • Precios en horas valle
  • Streaming
Ventana de contexto
1M de tokens
Salida máxima
384K tokens
Niveles de razonamiento
none, low, high, max
Lanzamiento
10 sept 2026

Prueba DeepSeek V4.1 Flash

Chatea con DeepSeek V4.1 Flash, adjunta imágenes y ve los tokens y el costo de cada respuesta.

Parámetros

deepseek-v4.1-flash$0.24 entrada · $0.96 salida por millón de tokens (ahora: horas pico)

Pensamiento
Reasoning effort

Con el pensamiento activado, temperature no tiene efecto y un top_p por debajo de 0.95 se ejecuta como 0.95.

Log probabilities

Se acepta, pero no se devuelven probabilidades logarítmicas.

Total de la conversación$0.000000
Listo

Prueba uno de estos prompts

Los mensajes se facturan a partir de tu saldo a las tarifas de abajo, como una llamada a la API. Las solicitudes fallidas son gratis.

Salida real de DeepSeek V4.1 Flash

Un prompt, enviado a DeepSeek V4.1 Flash con el pensamiento desactivado. Sin editar.

Explain the difference between a mutex and a semaphore in two short paragraphs, and say when to use each.

A mutex is a locking mechanism designed for mutual exclusion: only the thread that locked it may unlock it, and it has a notion of ownership. It's binary (locked/unlocked) and is used to protect a shared resource so that only one thread accesses it at a time. A semaphore is a signaling mechanism built around a counter: it tracks how many permits are available, any thread can wait (decrement) or post (increment) it, and it doesn't care which thread does what. A binary semaphore looks similar to a mutex, but lacks ownership, so it can be released by a different thread—useful for signaling between threads rather than guarding a critical section. Use a mutex when you need to protect a shared resource (a data structure, file, or device) from concurrent access, which is the common case for locking critical sections. Use a semaphore when you need to control access to a pool of N identical resources (e.g., limiting concurrent database connections) or to signal between threads, such as a producer notifying a consumer that data is ready or a task-completion event. As a rule of thumb: mutex for mutual exclusion, semaphore for counting or signaling.

Generado 2026-09-28. Las respuestas varían de una ejecución a otra.

Precios de DeepSeek V4.1 Flash

DeepSeek V4.1 Flash se factura por token a partir de tu saldo, con tarifas de horas pico o de horas valle según la hora. Las tarifas de abajo son en vivo, las mismas que se cobran a tu cuenta.

Una solicitud típica2.000 tokens de entrada, 1.000 tokens de salida, horas pico
$0.0014por solicitud
En horas valle, la misma solicitud cuesta la mitad.
Qué compra $20.00Tokens de salida a la tarifa de horas pico
20,833,333tokens de salida
El doble en horas valle. La entrada en caché cuesta una fracción de la entrada.

Los tamaños de ejemplo son ilustrativos y usan las tarifas de horas pico. Tu factura se basa en los tokens que informa cada solicitud y en la hora en que se ejecuta.

ElementoContado comoTarifaFacturación
Entrada, horas picoTokens del prompt que no aciertan en la caché, 01:00–04:00 y 06:00–10:00 UTC, lun–vie$0.24 / 1MPor 1M de tokens
Salida, horas picoTokens de respuesta y de razonamiento, horas pico$0.96 / 1MPor 1M de tokens
Entrada en caché, horas picoTokens del prompt que aciertan en la caché, horas pico$0.0048 / 1MPor 1M de tokens
Entrada, horas valleTokens del prompt que no aciertan en la caché, todas las demás horas, fines de semana incluidos$0.12 / 1MPor 1M de tokens
Salida, horas valleTokens de respuesta y de razonamiento, horas valle$0.48 / 1MPor 1M de tokens
Entrada en caché, horas valleTokens del prompt que aciertan en la caché, horas valle$0.0024 / 1MPor 1M de tokens
Solicitud fallidaCualquier solicitud que devuelva un errorGratisNo se factura

¿Qué es DeepSeek V4.1 Flash?

DeepSeek V4.1 Flash es el modelo rápido y económico de DeepSeek, lanzado el 10 de septiembre de 2026. Es un modelo mixture-of-experts de 552B parámetros que activa 8B parámetros para leer y 16B para escribir, lee imágenes de forma nativa y acepta hasta 1M de tokens de contexto.

Por defecto, DeepSeek V4.1 Flash piensa antes de responder, con esfuerzo de razonamiento high. Desactiva el pensamiento para pasos rápidos y sencillos, o sube el esfuerzo de razonamiento a max para problemas difíciles. La API propia de DeepSeek llama al modelo deepseek-flash.

ID de modelo: deepseek-v4.1-flash · Entrada: texto, imágenes · Salida: texto · Formatos: Chat Completions, Responses, Anthropic Messages.

ID de modelo
deepseek-v4.1-flash
Ventana de contexto
1M de tokens
Salida máxima
384K tokens
Niveles de razonamiento
none, low, high, max
Entrada
Texto, imágenes

Dos formas de usar DeepSeek V4.1 Flash

Llámalo desde tu código, o deja que tu agente de codificación lo haga.

API

Llámalo desde tu backend

Mejor para aplicaciones y servicios

Apunta el SDK de OpenAI a SeedRouter y mantén tu código. DeepSeek V4.1 Flash responde en los formatos Chat Completions, Responses y Anthropic Messages.

  1. 1Crea una clave API
  2. 2Establece la URL base en https://api.seedrouter.ai/v1
  3. 3Envía deepseek-v4.1-flash como el modelo
Agente

Entrégalo a tu agente de codificación

Mejor para Codex, Claude Code y otros agentes

Copia un prompt listo. Tu agente muestra la solicitud y el costo antes de gastar nada.

  1. 1Copia el prompt
  2. 2Pégala en tu agente
  3. 3Aprueba la solicitud

En qué es bueno DeepSeek V4.1 Flash

DeepSeek V4.1 Flash está hecho para trabajo de alto volumen donde importan la velocidad y el costo.

Bucles de agentes

DeepSeek V4.1 Flash ejecuta muchos pasos baratos, y el contexto en caché mantiene bajo el costo de las lecturas repetidas.

Programación diaria

Escribe, revisa y corrige código con DeepSeek V4.1 Flash en Codex, Claude Code o tus propias herramientas.

Imágenes en el prompt

DeepSeek V4.1 Flash lee capturas de pantalla, gráficos y fotos por URL o en base64.

Salida estructurada

Pide a DeepSeek V4.1 Flash una salida json_object y analiza la respuesta directamente.

Pensamiento activado o desactivado

Omite el razonamiento de DeepSeek V4.1 Flash para respuestas rápidas, o súbelo para las difíciles.

Tarifas en horas valle

Los trabajos por lotes fuera de las horas pico pagan la mitad del precio de horas pico.

Lo que los equipos construyen con DeepSeek V4.1 Flash

Clasificación a escala

Etiqueta tickets, reseñas y logs con DeepSeek V4.1 Flash, con el pensamiento desactivado, al menor costo.

Agentes de programación

Ejecuta DeepSeek V4.1 Flash en Codex para bucles rápidos y baratos de editar y ejecutar.

Lectura de capturas de pantalla

Convierte capturas de pantalla y gráficos en texto o JSON.

Empieza a usar DeepSeek V4.1 Flash en cuatro pasos

  1. 01

    Crea una clave

    Inicia sesión y crea una clave API. Añade crédito cuando lo necesites; no hay suscripción.

  2. 02

    Cambia la URL base

    Apunta el SDK de OpenAI a https://api.seedrouter.ai/v1. Tu código sigue siendo el mismo.

  3. 03

    Elige DeepSeek V4.1 Flash

    Envía deepseek-v4.1-flash como el modelo. Desactiva el pensamiento o ajusta su esfuerzo de razonamiento en cada solicitud.

  4. 04

    Revisa la factura

    Cada solicitud muestra sus tokens y costo en tus registros de uso.

Obtén una clave API

DeepSeek V4.1 Flash en SeedRouter de un vistazo

Lo que puedes usar hoy.

CaracterísticaDeepSeek V4.1 Flash
Chat CompletionsSí, formato oficial
ResponsesSí, compatible con Codex
Anthropic MessagesSí, compatible con Claude Code
Entrada de imágenesSí, por URL o base64
StreamingSí
Caché de contextoSí, automática; los aciertos de caché se facturan a menor precio
Salida JSONSí, json_object
Solicitudes fallidasNo se factura

No se ofrecen FIM ni el completado con prefijo de chat (beta), la Files API ni las probabilidades logarítmicas.

Límites de DeepSeek V4.1 Flash

Ventana de contexto de 1M de tokens

En DeepSeek V4.1 Flash, el prompt, las imágenes y el historial comparten una ventana de 1M de tokens.

384K tokens de salida

Una solicitud de DeepSeek V4.1 Flash escribe hasta 393.216 tokens, razonamiento incluido.

Muestreo con el pensamiento activado

Con el pensamiento activado, temperature no tiene efecto y top_p se mantiene en 0.95 o más.

Tamaño de imagen

Una URL de imagen de DeepSeek V4.1 Flash puede apuntar a un archivo de hasta 32 MiB.

Por qué llamar a DeepSeek V4.1 Flash a través de SeedRouter

Una clave, tres formatos

Llama a DeepSeek V4.1 Flash con Chat Completions, Responses o Anthropic Messages, todo con la misma clave.

Pago por token

Recarga una vez y gástalo en cualquier modelo. Sin plan, sin cuota mensual.

Los fallos son gratis

Una solicitud que genera un error no se factura.

Precios en vivo

Las tarifas en esta página son las tarifas que tu cuenta paga, en horas pico y en horas valle.

Caché de contexto

Los prefijos de prompt repetidos se leen desde la caché a una tarifa de DeepSeek V4.1 Flash más baja.

El razonamiento vuelve en la respuesta

Con el pensamiento activado, el razonamiento vuelve en reasoning_content junto a la respuesta.

Streaming

Recibe los tokens de DeepSeek V4.1 Flash en streaming a medida que llegan con stream: true.

Modelos relacionados

Otros modelos que puedes llamar con la misma clave.

Kimi K3
kimi-k3

Usa Kimi K3 con el SDK de OpenAI o Anthropic. Contexto de 1M de tokens, razonamiento siempre activo (low, high o max), precios por token en vivo y Playground.

Ver precios
claude-fable-5
claude-fable-5

Anthropic

Ver precios
claude-fable-5-1
claude-fable-5-1

Anthropic

Ver precios
claude-opus-5-5
claude-opus-5-5

Anthropic

Ver precios
dreamina-seedance-2-0
dreamina-seedance-2-0

ByteDance

Ver precios
dreamina-seedance-2-0-fast
dreamina-seedance-2-0-fast

ByteDance

Ver precios

Preguntas frecuentes sobre DeepSeek V4.1 Flash

¿Qué es DeepSeek V4.1 Flash?+

DeepSeek V4.1 Flash es el modelo rápido y económico de DeepSeek, lanzado el 10 de septiembre de 2026. Es un modelo mixture-of-experts de 552B parámetros con entrada de imágenes nativa, una ventana de contexto de 1M de tokens y un pensamiento que puedes activar o desactivar.

¿Cuánto cuesta DeepSeek V4.1 Flash?+

DeepSeek V4.1 Flash se factura a $0.24 / 1M de entrada y $0.96 / 1M de salida por 1M de tokens en horas pico (01:00–04:00 y 06:00–10:00 UTC, de lunes a viernes). Todas las demás horas son horas valle, a la mitad de esas tarifas, y los aciertos de caché cuestan una fracción de la entrada.

¿Puedo usar DeepSeek V4.1 Flash gratis?+

Cada cuenta nueva de SeedRouter empieza con $0.10 de saldo gratis, suficiente para probar DeepSeek V4.1 Flash con muchas solicitudes cortas. Después pagas por token, sin suscripción, y una solicitud fallida no se factura.

¿DeepSeek V4.1 Flash admite imágenes?+

Sí. DeepSeek V4.1 Flash lee imágenes de forma nativa. Envíalas por URL pública o en base64 en la solicitud; devuelve texto.

¿Cómo desactivo el pensamiento en DeepSeek V4.1 Flash?+

Establece thinking en disabled, o reasoning_effort en none. La respuesta llega entonces de inmediato y usa menos tokens de salida.

¿DeepSeek V4.1 Flash es lo mismo que DeepSeek V4 Flash?+

No. DeepSeek V4.1 Flash sustituyó a V4 Flash el 10 de septiembre de 2026, con una arquitectura nueva y entrada de imágenes nativa. DeepSeek retiró V4 Flash y redirige sus antiguos nombres de modelo a DeepSeek V4.1 Flash.

¿Puedo ejecutar DeepSeek V4.1 Flash en local?+

Sus pesos están en Hugging Face. Con 552B parámetros necesita hardware con varias GPU, así que la mayoría de los equipos llama a DeepSeek V4.1 Flash a través de una API.

¿Cuál es el ID de modelo de DeepSeek V4.1 Flash y cómo lo llamo?+

En SeedRouter el ID de modelo es deepseek-v4.1-flash. Crea una clave API de SeedRouter, apunta el SDK de OpenAI a https://api.seedrouter.ai/v1 y envía deepseek-v4.1-flash como el modelo.

¿Se me cobra si una solicitud de DeepSeek V4.1 Flash falla?+

No. Una solicitud de DeepSeek V4.1 Flash que devuelve un error no se factura. Solo pagas los tokens que informa una solicitud finalizada.

Prueba DeepSeek V4.1 Flash ahora

Envía tu primera solicitud a DeepSeek V4.1 Flash desde el Playground o desde tu propio código en minutos.