API do DeepSeek V4.1 Flash: obtenha uma chave e faça a primeira chamada
Como usar a API do DeepSeek V4.1 Flash: obtenha uma chave, chame com o SDK da OpenAI, ative ou desative o raciocínio, streaming, imagens e erros comuns.
Ler em MarkdownPara chamar o DeepSeek V4.1 Flash, você precisa de uma chave de API de uma plataforma que o ofereça e de uma solicitação com o ID do modelo. Na própria API da DeepSeek o modelo é deepseek-flash, e os nomes antigos deepseek-v4-flash e deepseek-v4-flash-vision-exp são redirecionados para ele. Na SeedRouter o ID do modelo é deepseek-v4.1-flash, e uma única chave o chama com pagamento por uso no formato oficial de solicitação: aponte o SDK da OpenAI para https://api.seedrouter.ai/v1 e mantenha o seu código.
Este guia usa a SeedRouter; os corpos das solicitações são os mesmos da API da DeepSeek.
Como obter uma chave de API do DeepSeek V4.1 Flash?
- Entre na SeedRouter e abra API keys.
- Crie uma chave e copie-a; ela é exibida uma única vez.
- Adicione crédito quando precisar. Contas novas começam com um pequeno saldo gratuito, e não há assinatura.
Guarde a chave em uma variável de ambiente como SEEDROUTER_API_KEY e use-a somente em código no servidor.
Como chamar o DeepSeek V4.1 Flash em Python?
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["SEEDROUTER_API_KEY"],
base_url="https://api.seedrouter.ai/v1",
)
completion = client.chat.completions.create(
model="deepseek-v4.1-flash",
messages=[{"role": "user", "content": "Give me three names for a coffee shop."}],
)
print(completion.choices[0].message.content)O raciocínio vem ativado por padrão, então a mensagem também traz o raciocínio do modelo em reasoning_content, ao lado da resposta em content.
Como chamar em Node.js ou cURL?
import OpenAI from "openai";
const client = new OpenAI({
apiKey: process.env.SEEDROUTER_API_KEY,
baseURL: "https://api.seedrouter.ai/v1",
});
const completion = await client.chat.completions.create({
model: "deepseek-v4.1-flash",
messages: [{ role: "user", content: "Give me three names for a coffee shop." }],
});
console.log(completion.choices[0].message.content);curl https://api.seedrouter.ai/v1/chat/completions \
-H "Authorization: Bearer $SEEDROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model": "deepseek-v4.1-flash", "messages": [{"role": "user", "content": "Give me three names for a coffee shop."}]}'A mesma chave também atende a Responses API (/v1/responses) e o formato Anthropic Messages (/v1/messages) para deepseek-v4.1-flash.
Como desativar o raciocínio ou definir o esforço?
O raciocínio vem ativado por padrão com esforço high. Desative-o com thinking ou escolha um esforço com reasoning_effort. O SDK da OpenAI repassa thinking por meio de extra_body. A primeira solicitação desativa o raciocínio para a resposta mais rápida e barata; a segunda usa o esforço mais alto:
completion = client.chat.completions.create(
model="deepseek-v4.1-flash",
messages=[{"role": "user", "content": "Classify: 'my card was charged twice'"}],
extra_body={"thinking": {"type": "disabled"}},
)
completion = client.chat.completions.create(
model="deepseek-v4.1-flash",
messages=[{"role": "user", "content": "How many primes are there below 150?"}],
reasoning_effort="max",
)reasoning_effort | Efeito |
|---|---|
none | Raciocínio desativado |
low | Raciocínio curto |
high (padrão) | A maioria das tarefas |
max | Os problemas mais difíceis |
A DeepSeek também aceita minimal (funciona como low), medium e xhigh (funcionam como high). No nosso teste com uma pergunta de contagem de números primos, o raciocínio desativado usou 2 tokens de saída, low 258 e max 319. O raciocínio é cobrado como saída.
Como fazer streaming da resposta?
Adicione stream=True. Com o raciocínio ativado, o raciocínio chega primeiro em delta.reasoning_content, depois a resposta em delta.content, e o último chunk traz o uso de tokens:
stream = client.chat.completions.create(
model="deepseek-v4.1-flash",
messages=[{"role": "user", "content": "Write a haiku about latency."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Posso enviar imagens?
Sim. O DeepSeek V4.1 Flash lê imagens nativamente. Envie uma URL pública ou um data URI em base64 em uma parte image_url:
completion = client.chat.completions.create(
model="deepseek-v4.1-flash",
messages=[{
"role": "user",
"content": [
{"type": "image_url", "image_url": {"url": "https://example.com/chart.png"}},
{"type": "text", "text": "What does this chart show?"},
],
}],
)A URL de uma imagem pode ter até 8.192 caracteres e apontar para um arquivo de até 32 MiB.
Quais erros posso encontrar?
| Erro | Causa | Solução |
|---|---|---|
400 em response_format | json_schema não é suportado | Use {"type": "json_object"} e descreva a estrutura no prompt |
400 em temperature ou top_p | Acima de 2 ou acima de 1 | Mantenha-os no intervalo; com o raciocínio ativado eles têm pouco efeito de qualquer forma |
| 400 em uma URL de imagem | Não foi possível baixar o arquivo como imagem | Verifique se a URL é pública e aponta para uma imagem |
| 401 | Chave ausente ou incorreta | Verifique o cabeçalho Authorization |
Os erros retornam {"error": {"code": ..., "message": "..."}}, e uma solicitação que falha não é cobrada.
Perguntas frequentes
A API do DeepSeek V4.1 Flash é compatível com a OpenAI?
Sim. Ela aceita os formatos Chat Completions e Responses, então o SDK da OpenAI funciona trocando apenas a URL base e o modelo. Também aceita o formato Anthropic Messages.
Por que o ID do modelo é diferente do da DeepSeek?
A DeepSeek chama o modelo de deepseek-flash na própria API. A SeedRouter usa deepseek-v4.1-flash para que a versão faça parte do nome. Fora isso, o corpo da solicitação é o mesmo.
Quanto custa uma solicitação ao DeepSeek V4.1 Flash?
É cobrada por token, com tarifas de horário de pico ou fora do horário de pico conforme a hora. O guia de preços do DeepSeek V4.1 Flash traz as tarifas atuais e exemplos calculados.
Onde está a lista completa de parâmetros?
A referência da API do DeepSeek V4.1 Flash lista todos os campos, e a página do DeepSeek V4.1 Flash tem um playground e os preços atuais.



