API de DeepSeek V4.1 Flash: consigue una clave y haz tu primera llamada
Cómo usar la API de DeepSeek V4.1 Flash: consigue una clave, llámala con el SDK de OpenAI, activa o no el pensamiento, streaming, imágenes y errores comunes.
Leer en MarkdownPara llamar a DeepSeek V4.1 Flash necesitas una clave de API de una plataforma que lo sirva y una solicitud con su ID de modelo. En la API de la propia DeepSeek el modelo se llama deepseek-flash, y los nombres antiguos deepseek-v4-flash y deepseek-v4-flash-vision-exp se redirigen a él. En SeedRouter el ID de modelo es deepseek-v4.1-flash, y una sola clave lo llama con pago por uso en el formato de solicitud oficial: apunta el SDK de OpenAI a https://api.seedrouter.ai/v1 y conserva tu código.
Esta guía usa SeedRouter; los cuerpos de las solicitudes son los mismos que en la API de la propia DeepSeek.
¿Cómo consigo una clave de API de DeepSeek V4.1 Flash?
- Inicia sesión en SeedRouter y abre API keys.
- Crea una clave y cópiala; solo se muestra una vez.
- Añade crédito cuando lo necesites. Las cuentas nuevas empiezan con un pequeño saldo gratuito y no hay suscripción.
Guarda la clave en una variable de entorno como SEEDROUTER_API_KEY y úsala solo desde código del lado del servidor.
¿Cómo llamo a DeepSeek V4.1 Flash desde Python?
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["SEEDROUTER_API_KEY"],
base_url="https://api.seedrouter.ai/v1",
)
completion = client.chat.completions.create(
model="deepseek-v4.1-flash",
messages=[{"role": "user", "content": "Give me three names for a coffee shop."}],
)
print(completion.choices[0].message.content)El modo de pensamiento está activado por defecto, así que el mensaje también incluye el razonamiento del modelo en reasoning_content, junto a la respuesta en content.
¿Cómo lo llamo desde Node.js o con cURL?
import OpenAI from "openai";
const client = new OpenAI({
apiKey: process.env.SEEDROUTER_API_KEY,
baseURL: "https://api.seedrouter.ai/v1",
});
const completion = await client.chat.completions.create({
model: "deepseek-v4.1-flash",
messages: [{ role: "user", content: "Give me three names for a coffee shop." }],
});
console.log(completion.choices[0].message.content);curl https://api.seedrouter.ai/v1/chat/completions \
-H "Authorization: Bearer $SEEDROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model": "deepseek-v4.1-flash", "messages": [{"role": "user", "content": "Give me three names for a coffee shop."}]}'La misma clave también responde a la Responses API (/v1/responses) y al formato Anthropic Messages (/v1/messages) para deepseek-v4.1-flash.
¿Cómo desactivo el pensamiento o ajusto su nivel de razonamiento?
El pensamiento está activado por defecto con el nivel high. Desactívalo con thinking o elige un nivel con reasoning_effort. El SDK de OpenAI pasa thinking a través de extra_body. La primera solicitud desactiva el pensamiento para obtener la respuesta más rápida y barata; la segunda usa el nivel más alto:
completion = client.chat.completions.create(
model="deepseek-v4.1-flash",
messages=[{"role": "user", "content": "Classify: 'my card was charged twice'"}],
extra_body={"thinking": {"type": "disabled"}},
)
completion = client.chat.completions.create(
model="deepseek-v4.1-flash",
messages=[{"role": "user", "content": "How many primes are there below 150?"}],
reasoning_effort="max",
)reasoning_effort | Efecto |
|---|---|
none | Pensamiento desactivado |
low | Razonamiento breve |
high (por defecto) | La mayoría de las tareas |
max | Los problemas más difíciles |
DeepSeek también acepta minimal (se ejecuta como low), medium y xhigh (se ejecutan como high). En nuestra prueba con una pregunta de conteo de números primos, el pensamiento desactivado usó 2 tokens de salida, low 258 y max 319. El razonamiento se factura como salida.
¿Cómo hago streaming de la respuesta?
Añade stream=True. Con el pensamiento activado, el razonamiento llega primero en delta.reasoning_content, luego la respuesta en delta.content, y el último chunk incluye el uso de tokens:
stream = client.chat.completions.create(
model="deepseek-v4.1-flash",
messages=[{"role": "user", "content": "Write a haiku about latency."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)¿Puedo enviar imágenes?
Sí. DeepSeek V4.1 Flash lee imágenes de forma nativa. Envía una URL pública o una data URI en base64 en una parte image_url:
completion = client.chat.completions.create(
model="deepseek-v4.1-flash",
messages=[{
"role": "user",
"content": [
{"type": "image_url", "image_url": {"url": "https://example.com/chart.png"}},
{"type": "text", "text": "What does this chart show?"},
],
}],
)Una URL de imagen puede tener hasta 8.192 caracteres y apuntar a un archivo de hasta 32 MiB.
¿Qué errores debo esperar?
| Error | Causa | Solución |
|---|---|---|
400 en response_format | json_schema no es compatible | Usa {"type": "json_object"} y describe la estructura en el prompt |
400 en temperature o top_p | Superior a 2 o superior a 1 | Mantenlos dentro del rango; con el pensamiento activado apenas tienen efecto |
| 400 en una URL de imagen | El archivo no se pudo descargar como imagen | Comprueba que la URL sea pública y apunte a una imagen |
| 401 | Clave ausente o incorrecta | Revisa la cabecera Authorization |
Los errores devuelven {"error": {"code": ..., "message": "..."}}, y una solicitud que falla no se cobra.
Preguntas frecuentes
¿La API de DeepSeek V4.1 Flash es compatible con OpenAI?
Sí. Acepta los formatos Chat Completions y Responses, así que el SDK de OpenAI funciona cambiando solo la URL base y el modelo. También acepta el formato Anthropic Messages.
¿Por qué el ID de modelo es distinto del de DeepSeek?
DeepSeek llama al modelo deepseek-flash en su propia API. SeedRouter usa deepseek-v4.1-flash para que la versión forme parte del nombre. Por lo demás, el cuerpo de la solicitud es el mismo.
¿Cuánto cuesta una solicitud de DeepSeek V4.1 Flash?
Se factura por token, a tarifa de horas pico o de horas valle según la hora. La guía de precios de DeepSeek V4.1 Flash tiene las tarifas en vivo y ejemplos de cálculo.
¿Dónde está la lista completa de parámetros?
La referencia de la API de DeepSeek V4.1 Flash enumera cada campo, y la página de DeepSeek V4.1 Flash ofrece un playground y precios en vivo.



