Claude Opus 5.5 já está disponível no SeedRouter

API do DeepSeek V4.1 Flash: obtenha uma chave e faça a primeira chamada

Como usar a API do DeepSeek V4.1 Flash: obtenha uma chave, chame com o SDK da OpenAI, ative ou desative o raciocínio, streaming, imagens e erros comuns.

Ler em Markdown

Para chamar o DeepSeek V4.1 Flash, você precisa de uma chave de API de uma plataforma que o ofereça e de uma solicitação com o ID do modelo. Na própria API da DeepSeek o modelo é deepseek-flash, e os nomes antigos deepseek-v4-flash e deepseek-v4-flash-vision-exp são redirecionados para ele. Na SeedRouter o ID do modelo é deepseek-v4.1-flash, e uma única chave o chama com pagamento por uso no formato oficial de solicitação: aponte o SDK da OpenAI para https://api.seedrouter.ai/v1 e mantenha o seu código.

Este guia usa a SeedRouter; os corpos das solicitações são os mesmos da API da DeepSeek.

Como obter uma chave de API do DeepSeek V4.1 Flash?

  1. Entre na SeedRouter e abra API keys.
  2. Crie uma chave e copie-a; ela é exibida uma única vez.
  3. Adicione crédito quando precisar. Contas novas começam com um pequeno saldo gratuito, e não há assinatura.

Guarde a chave em uma variável de ambiente como SEEDROUTER_API_KEY e use-a somente em código no servidor.

Como chamar o DeepSeek V4.1 Flash em Python?

import os
from openai import OpenAI

client = OpenAI(
    api_key=os.environ["SEEDROUTER_API_KEY"],
    base_url="https://api.seedrouter.ai/v1",
)

completion = client.chat.completions.create(
    model="deepseek-v4.1-flash",
    messages=[{"role": "user", "content": "Give me three names for a coffee shop."}],
)
print(completion.choices[0].message.content)

O raciocínio vem ativado por padrão, então a mensagem também traz o raciocínio do modelo em reasoning_content, ao lado da resposta em content.

Como chamar em Node.js ou cURL?

import OpenAI from "openai";

const client = new OpenAI({
  apiKey: process.env.SEEDROUTER_API_KEY,
  baseURL: "https://api.seedrouter.ai/v1",
});

const completion = await client.chat.completions.create({
  model: "deepseek-v4.1-flash",
  messages: [{ role: "user", content: "Give me three names for a coffee shop." }],
});
console.log(completion.choices[0].message.content);
curl https://api.seedrouter.ai/v1/chat/completions \
  -H "Authorization: Bearer $SEEDROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model": "deepseek-v4.1-flash", "messages": [{"role": "user", "content": "Give me three names for a coffee shop."}]}'

A mesma chave também atende a Responses API (/v1/responses) e o formato Anthropic Messages (/v1/messages) para deepseek-v4.1-flash.

Como desativar o raciocínio ou definir o esforço?

O raciocínio vem ativado por padrão com esforço high. Desative-o com thinking ou escolha um esforço com reasoning_effort. O SDK da OpenAI repassa thinking por meio de extra_body. A primeira solicitação desativa o raciocínio para a resposta mais rápida e barata; a segunda usa o esforço mais alto:

completion = client.chat.completions.create(
    model="deepseek-v4.1-flash",
    messages=[{"role": "user", "content": "Classify: 'my card was charged twice'"}],
    extra_body={"thinking": {"type": "disabled"}},
)

completion = client.chat.completions.create(
    model="deepseek-v4.1-flash",
    messages=[{"role": "user", "content": "How many primes are there below 150?"}],
    reasoning_effort="max",
)
reasoning_effortEfeito
noneRaciocínio desativado
lowRaciocínio curto
high (padrão)A maioria das tarefas
maxOs problemas mais difíceis

A DeepSeek também aceita minimal (funciona como low), medium e xhigh (funcionam como high). No nosso teste com uma pergunta de contagem de números primos, o raciocínio desativado usou 2 tokens de saída, low 258 e max 319. O raciocínio é cobrado como saída.

Como fazer streaming da resposta?

Adicione stream=True. Com o raciocínio ativado, o raciocínio chega primeiro em delta.reasoning_content, depois a resposta em delta.content, e o último chunk traz o uso de tokens:

stream = client.chat.completions.create(
    model="deepseek-v4.1-flash",
    messages=[{"role": "user", "content": "Write a haiku about latency."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Posso enviar imagens?

Sim. O DeepSeek V4.1 Flash lê imagens nativamente. Envie uma URL pública ou um data URI em base64 em uma parte image_url:

completion = client.chat.completions.create(
    model="deepseek-v4.1-flash",
    messages=[{
        "role": "user",
        "content": [
            {"type": "image_url", "image_url": {"url": "https://example.com/chart.png"}},
            {"type": "text", "text": "What does this chart show?"},
        ],
    }],
)

A URL de uma imagem pode ter até 8.192 caracteres e apontar para um arquivo de até 32 MiB.

Quais erros posso encontrar?

ErroCausaSolução
400 em response_formatjson_schema não é suportadoUse {"type": "json_object"} e descreva a estrutura no prompt
400 em temperature ou top_pAcima de 2 ou acima de 1Mantenha-os no intervalo; com o raciocínio ativado eles têm pouco efeito de qualquer forma
400 em uma URL de imagemNão foi possível baixar o arquivo como imagemVerifique se a URL é pública e aponta para uma imagem
401Chave ausente ou incorretaVerifique o cabeçalho Authorization

Os erros retornam {"error": {"code": ..., "message": "..."}}, e uma solicitação que falha não é cobrada.

Perguntas frequentes

A API do DeepSeek V4.1 Flash é compatível com a OpenAI?

Sim. Ela aceita os formatos Chat Completions e Responses, então o SDK da OpenAI funciona trocando apenas a URL base e o modelo. Também aceita o formato Anthropic Messages.

Por que o ID do modelo é diferente do da DeepSeek?

A DeepSeek chama o modelo de deepseek-flash na própria API. A SeedRouter usa deepseek-v4.1-flash para que a versão faça parte do nome. Fora isso, o corpo da solicitação é o mesmo.

Quanto custa uma solicitação ao DeepSeek V4.1 Flash?

É cobrada por token, com tarifas de horário de pico ou fora do horário de pico conforme a hora. O guia de preços do DeepSeek V4.1 Flash traz as tarifas atuais e exemplos calculados.

Onde está a lista completa de parâmetros?

A referência da API do DeepSeek V4.1 Flash lista todos os campos, e a página do DeepSeek V4.1 Flash tem um playground e os preços atuais.

Guias relacionados