DeepSeek V4.1 Flash — razonamiento rápido y económico con imágenes
DeepSeek V4.1 Flash es el modelo rápido y económico de DeepSeek, con una ventana de contexto de 1M de tokens y entrada de imágenes. $0.24 / 1M entrada, $0.96 / 1M salida por 1M de tokens en horas pico; la mitad en horas valle.
- Pensamiento activado o desactivado
- Ventana de contexto de 1M de tokens
- Entrada de imágenes
- Precios en horas valle
- Streaming
Prueba DeepSeek V4.1 Flash
Chatea con DeepSeek V4.1 Flash, adjunta imágenes y ve los tokens y el costo de cada respuesta.
deepseek-v4.1-flash$0.24 entrada · $0.96 salida por millón de tokens (ahora: horas pico)
Con el pensamiento activado, temperature no tiene efecto y un top_p por debajo de 0.95 se ejecuta como 0.95.
Se acepta, pero no se devuelven probabilidades logarítmicas.
Prueba uno de estos prompts
Los mensajes se facturan a partir de tu saldo a las tarifas de abajo, como una llamada a la API. Las solicitudes fallidas son gratis.
Salida real de DeepSeek V4.1 Flash
Un prompt, enviado a DeepSeek V4.1 Flash con el pensamiento desactivado. Sin editar.
Explain the difference between a mutex and a semaphore in two short paragraphs, and say when to use each.
A mutex is a locking mechanism designed for mutual exclusion: only the thread that locked it may unlock it, and it has a notion of ownership. It's binary (locked/unlocked) and is used to protect a shared resource so that only one thread accesses it at a time. A semaphore is a signaling mechanism built around a counter: it tracks how many permits are available, any thread can wait (decrement) or post (increment) it, and it doesn't care which thread does what. A binary semaphore looks similar to a mutex, but lacks ownership, so it can be released by a different thread—useful for signaling between threads rather than guarding a critical section. Use a mutex when you need to protect a shared resource (a data structure, file, or device) from concurrent access, which is the common case for locking critical sections. Use a semaphore when you need to control access to a pool of N identical resources (e.g., limiting concurrent database connections) or to signal between threads, such as a producer notifying a consumer that data is ready or a task-completion event. As a rule of thumb: mutex for mutual exclusion, semaphore for counting or signaling.
Generado 2026-09-28. Las respuestas varían de una ejecución a otra.
Precios de DeepSeek V4.1 Flash
DeepSeek V4.1 Flash se factura por token a partir de tu saldo, con tarifas de horas pico o de horas valle según la hora. Las tarifas de abajo son en vivo, las mismas que se cobran a tu cuenta.
Los tamaños de ejemplo son ilustrativos y usan las tarifas de horas pico. Tu factura se basa en los tokens que informa cada solicitud y en la hora en que se ejecuta.
| Elemento | Contado como | Tarifa | Facturación |
|---|---|---|---|
| Entrada, horas pico | Tokens del prompt que no aciertan en la caché, 01:00–04:00 y 06:00–10:00 UTC, lun–vie | $0.24 / 1M | Por 1M de tokens |
| Salida, horas pico | Tokens de respuesta y de razonamiento, horas pico | $0.96 / 1M | Por 1M de tokens |
| Entrada en caché, horas pico | Tokens del prompt que aciertan en la caché, horas pico | $0.0048 / 1M | Por 1M de tokens |
| Entrada, horas valle | Tokens del prompt que no aciertan en la caché, todas las demás horas, fines de semana incluidos | $0.12 / 1M | Por 1M de tokens |
| Salida, horas valle | Tokens de respuesta y de razonamiento, horas valle | $0.48 / 1M | Por 1M de tokens |
| Entrada en caché, horas valle | Tokens del prompt que aciertan en la caché, horas valle | $0.0024 / 1M | Por 1M de tokens |
| Solicitud fallida | Cualquier solicitud que devuelva un error | Gratis | No se factura |
¿Qué es DeepSeek V4.1 Flash?
DeepSeek V4.1 Flash es el modelo rápido y económico de DeepSeek, lanzado el 10 de septiembre de 2026. Es un modelo mixture-of-experts de 552B parámetros que activa 8B parámetros para leer y 16B para escribir, lee imágenes de forma nativa y acepta hasta 1M de tokens de contexto.
Por defecto, DeepSeek V4.1 Flash piensa antes de responder, con esfuerzo de razonamiento high. Desactiva el pensamiento para pasos rápidos y sencillos, o sube el esfuerzo de razonamiento a max para problemas difíciles. La API propia de DeepSeek llama al modelo deepseek-flash.
ID de modelo: deepseek-v4.1-flash · Entrada: texto, imágenes · Salida: texto · Formatos: Chat Completions, Responses, Anthropic Messages.
Dos formas de usar DeepSeek V4.1 Flash
Llámalo desde tu código, o deja que tu agente de codificación lo haga.
Llámalo desde tu backend
Apunta el SDK de OpenAI a SeedRouter y mantén tu código. DeepSeek V4.1 Flash responde en los formatos Chat Completions, Responses y Anthropic Messages.
- 1Crea una clave API
- 2Establece la URL base en https://api.seedrouter.ai/v1
- 3Envía deepseek-v4.1-flash como el modelo
Entrégalo a tu agente de codificación
Copia un prompt listo. Tu agente muestra la solicitud y el costo antes de gastar nada.
- 1Copia el prompt
- 2Pégala en tu agente
- 3Aprueba la solicitud
En qué es bueno DeepSeek V4.1 Flash
DeepSeek V4.1 Flash está hecho para trabajo de alto volumen donde importan la velocidad y el costo.
Bucles de agentes
DeepSeek V4.1 Flash ejecuta muchos pasos baratos, y el contexto en caché mantiene bajo el costo de las lecturas repetidas.
Programación diaria
Escribe, revisa y corrige código con DeepSeek V4.1 Flash en Codex, Claude Code o tus propias herramientas.
Imágenes en el prompt
DeepSeek V4.1 Flash lee capturas de pantalla, gráficos y fotos por URL o en base64.
Salida estructurada
Pide a DeepSeek V4.1 Flash una salida json_object y analiza la respuesta directamente.
Pensamiento activado o desactivado
Omite el razonamiento de DeepSeek V4.1 Flash para respuestas rápidas, o súbelo para las difíciles.
Tarifas en horas valle
Los trabajos por lotes fuera de las horas pico pagan la mitad del precio de horas pico.
Lo que los equipos construyen con DeepSeek V4.1 Flash
Clasificación a escala
Etiqueta tickets, reseñas y logs con DeepSeek V4.1 Flash, con el pensamiento desactivado, al menor costo.
Agentes de programación
Ejecuta DeepSeek V4.1 Flash en Codex para bucles rápidos y baratos de editar y ejecutar.
Lectura de capturas de pantalla
Convierte capturas de pantalla y gráficos en texto o JSON.
Empieza a usar DeepSeek V4.1 Flash en cuatro pasos
- 01
Crea una clave
Inicia sesión y crea una clave API. Añade crédito cuando lo necesites; no hay suscripción.
- 02
Cambia la URL base
Apunta el SDK de OpenAI a https://api.seedrouter.ai/v1. Tu código sigue siendo el mismo.
- 03
Elige DeepSeek V4.1 Flash
Envía deepseek-v4.1-flash como el modelo. Desactiva el pensamiento o ajusta su esfuerzo de razonamiento en cada solicitud.
- 04
Revisa la factura
Cada solicitud muestra sus tokens y costo en tus registros de uso.
DeepSeek V4.1 Flash en SeedRouter de un vistazo
Lo que puedes usar hoy.
| Característica | DeepSeek V4.1 Flash |
|---|---|
| Chat Completions | Sí, formato oficial |
| Responses | Sí, compatible con Codex |
| Anthropic Messages | Sí, compatible con Claude Code |
| Entrada de imágenes | Sí, por URL o base64 |
| Streaming | Sí |
| Caché de contexto | Sí, automática; los aciertos de caché se facturan a menor precio |
| Salida JSON | Sí, json_object |
| Solicitudes fallidas | No se factura |
No se ofrecen FIM ni el completado con prefijo de chat (beta), la Files API ni las probabilidades logarítmicas.
Límites de DeepSeek V4.1 Flash
Ventana de contexto de 1M de tokens
En DeepSeek V4.1 Flash, el prompt, las imágenes y el historial comparten una ventana de 1M de tokens.
384K tokens de salida
Una solicitud de DeepSeek V4.1 Flash escribe hasta 393.216 tokens, razonamiento incluido.
Muestreo con el pensamiento activado
Con el pensamiento activado, temperature no tiene efecto y top_p se mantiene en 0.95 o más.
Tamaño de imagen
Una URL de imagen de DeepSeek V4.1 Flash puede apuntar a un archivo de hasta 32 MiB.
Por qué llamar a DeepSeek V4.1 Flash a través de SeedRouter
Una clave, tres formatos
Llama a DeepSeek V4.1 Flash con Chat Completions, Responses o Anthropic Messages, todo con la misma clave.
Pago por token
Recarga una vez y gástalo en cualquier modelo. Sin plan, sin cuota mensual.
Los fallos son gratis
Una solicitud que genera un error no se factura.
Precios en vivo
Las tarifas en esta página son las tarifas que tu cuenta paga, en horas pico y en horas valle.
Caché de contexto
Los prefijos de prompt repetidos se leen desde la caché a una tarifa de DeepSeek V4.1 Flash más baja.
El razonamiento vuelve en la respuesta
Con el pensamiento activado, el razonamiento vuelve en reasoning_content junto a la respuesta.
Streaming
Recibe los tokens de DeepSeek V4.1 Flash en streaming a medida que llegan con stream: true.
Modelos relacionados
Otros modelos que puedes llamar con la misma clave.
Usa Kimi K3 con el SDK de OpenAI o Anthropic. Contexto de 1M de tokens, razonamiento siempre activo (low, high o max), precios por token en vivo y Playground.
Ver preciosGuías de DeepSeek V4.1 Flash
Tutoriales y comparaciones para este modelo.
Cómo usar la API de DeepSeek V4.1 Flash: consigue una clave, llámala con el SDK de OpenAI, activa o no el pensamiento, streaming, imágenes y errores comunes.
Precio de la API de DeepSeek V4.1 Flash por millón de tokens: horas pico y valle, aciertos de caché, horarios, fórmula de facturación y coste por solicitud.
Cómo usar DeepSeek V4.1 Flash como modelo en Claude Code y OpenAI Codex CLI con SeedRouter: variables de entorno, config.toml y resultados de nuestras pruebas.
DeepSeek V4.1 Flash frente a DeepSeek V4 Pro: precio por token, entrada de imágenes, concurrencia y benchmarks de DeepSeek, con una elección clara por tarea.
Qué cambió de DeepSeek V4 Flash 0731 a V4.1 Flash: nueva arquitectura, visión nativa, caché menor, precios más bajos, benchmarks y nombres antiguos.
¿DeepSeek V4.1 Flash es gratis? Los pesos se descargan gratis, la API se paga por token a precios bajos, y así puedes probarlo hoy por casi nada.
Preguntas frecuentes sobre DeepSeek V4.1 Flash
¿Qué es DeepSeek V4.1 Flash?+
DeepSeek V4.1 Flash es el modelo rápido y económico de DeepSeek, lanzado el 10 de septiembre de 2026. Es un modelo mixture-of-experts de 552B parámetros con entrada de imágenes nativa, una ventana de contexto de 1M de tokens y un pensamiento que puedes activar o desactivar.
¿Cuánto cuesta DeepSeek V4.1 Flash?+
DeepSeek V4.1 Flash se factura a $0.24 / 1M de entrada y $0.96 / 1M de salida por 1M de tokens en horas pico (01:00–04:00 y 06:00–10:00 UTC, de lunes a viernes). Todas las demás horas son horas valle, a la mitad de esas tarifas, y los aciertos de caché cuestan una fracción de la entrada.
¿Puedo usar DeepSeek V4.1 Flash gratis?+
Cada cuenta nueva de SeedRouter empieza con $0.10 de saldo gratis, suficiente para probar DeepSeek V4.1 Flash con muchas solicitudes cortas. Después pagas por token, sin suscripción, y una solicitud fallida no se factura.
¿DeepSeek V4.1 Flash admite imágenes?+
Sí. DeepSeek V4.1 Flash lee imágenes de forma nativa. Envíalas por URL pública o en base64 en la solicitud; devuelve texto.
¿Cómo desactivo el pensamiento en DeepSeek V4.1 Flash?+
Establece thinking en disabled, o reasoning_effort en none. La respuesta llega entonces de inmediato y usa menos tokens de salida.
¿DeepSeek V4.1 Flash es lo mismo que DeepSeek V4 Flash?+
No. DeepSeek V4.1 Flash sustituyó a V4 Flash el 10 de septiembre de 2026, con una arquitectura nueva y entrada de imágenes nativa. DeepSeek retiró V4 Flash y redirige sus antiguos nombres de modelo a DeepSeek V4.1 Flash.
¿Puedo ejecutar DeepSeek V4.1 Flash en local?+
Sus pesos están en Hugging Face. Con 552B parámetros necesita hardware con varias GPU, así que la mayoría de los equipos llama a DeepSeek V4.1 Flash a través de una API.
¿Cuál es el ID de modelo de DeepSeek V4.1 Flash y cómo lo llamo?+
En SeedRouter el ID de modelo es deepseek-v4.1-flash. Crea una clave API de SeedRouter, apunta el SDK de OpenAI a https://api.seedrouter.ai/v1 y envía deepseek-v4.1-flash como el modelo.
¿Se me cobra si una solicitud de DeepSeek V4.1 Flash falla?+
No. Una solicitud de DeepSeek V4.1 Flash que devuelve un error no se factura. Solo pagas los tokens que informa una solicitud finalizada.
Prueba DeepSeek V4.1 Flash ahora
Envía tu primera solicitud a DeepSeek V4.1 Flash desde el Playground o desde tu propio código en minutos.
