Claude Opus 5.5 já está disponível no SeedRouter

Use o DeepSeek V4.1 Flash no Claude Code e no Codex: configuração testada

Como usar o DeepSeek V4.1 Flash como modelo no Claude Code e no Codex CLI da OpenAI pela SeedRouter: variáveis de ambiente, config.toml e os nossos testes.

Ler em Markdown

O DeepSeek V4.1 Flash funciona como modelo no Claude Code e no Codex CLI da OpenAI. O Claude Code fala o formato Anthropic Messages e o Codex fala o formato Responses, e a SeedRouter oferece o DeepSeek V4.1 Flash nos dois. Defina uma URL base e uma chave da SeedRouter, escolha deepseek-v4.1-flash, e cada solicitação é cobrada por token do seu saldo. Nos nossos testes de 28 de setembro de 2026, as duas ferramentas criaram um arquivo, o executaram e informaram a saída, com o DeepSeek V4.1 Flash fazendo o trabalho.

Como usar o DeepSeek V4.1 Flash no Claude Code?

Aponte o Claude Code para a SeedRouter com duas variáveis de ambiente e depois escolha o modelo:

export ANTHROPIC_BASE_URL=https://api.seedrouter.ai
export ANTHROPIC_API_KEY=sk-your-seedrouter-key
claude --model deepseek-v4.1-flash

O Claude Code também chama um modelo menor em segundo plano para algumas tarefas. Aponte esses também para o DeepSeek V4.1 Flash, para que toda solicitação vá para um modelo que a sua chave pode chamar:

export ANTHROPIC_DEFAULT_OPUS_MODEL=deepseek-v4.1-flash
export ANTHROPIC_DEFAULT_SONNET_MODEL=deepseek-v4.1-flash
export ANTHROPIC_DEFAULT_HAIKU_MODEL=deepseek-v4.1-flash

Para manter a configuração entre sessões, coloque as mesmas variáveis no bloco env de ~/.claude/settings.json:

{
  "env": {
    "ANTHROPIC_BASE_URL": "https://api.seedrouter.ai",
    "ANTHROPIC_API_KEY": "sk-your-seedrouter-key",
    "ANTHROPIC_MODEL": "deepseek-v4.1-flash",
    "ANTHROPIC_DEFAULT_OPUS_MODEL": "deepseek-v4.1-flash",
    "ANTHROPIC_DEFAULT_SONNET_MODEL": "deepseek-v4.1-flash",
    "ANTHROPIC_DEFAULT_HAIKU_MODEL": "deepseek-v4.1-flash"
  }
}

O Claude Code avisa que deepseek-v4.1-flash não é um dos seus nomes de modelo. É um aviso, não um erro: a sessão roda. O raciocínio do modelo aparece como blocos de thinking, como acontece com os modelos Claude.

Como usar o DeepSeek V4.1 Flash no Codex?

Adicione a SeedRouter a ~/.codex/config.toml:

model = "deepseek-v4.1-flash"
model_provider = "seedrouter"
model_context_window = 1048576
model_reasoning_effort = "high"
show_raw_agent_reasoning = true

[model_providers.seedrouter]
name = "SeedRouter"
base_url = "https://api.seedrouter.ai/v1"
env_key = "SEEDROUTER_API_KEY"
wire_api = "responses"

Depois exporte a chave e inicie o Codex:

export SEEDROUTER_API_KEY=sk-your-seedrouter-key
codex

wire_api = "responses" e show_raw_agent_reasoning = true seguem o próprio guia do Codex da DeepSeek. O segundo permite ver o raciocínio do modelo no Codex CLI com Ctrl + T. model_context_window informa ao Codex que o DeepSeek V4.1 Flash lê até 1.048.576 tokens.

O que testamos?

Demos ao Claude Code uma tarefa de duas etapas (criar um pequeno arquivo Python, executá-lo e informar a saída) e ao Codex uma de quatro etapas (criar o arquivo, executá-lo, alterá-lo, executá-lo de novo e informar as duas saídas).

FerramentaFormatoResultado
Claude CodeAnthropic MessagesArquivo criado e executado; saída informada corretamente
Codex CLIResponsesDuas edições e duas execuções; as duas saídas informadas corretamente

No Codex, o DeepSeek V4.1 Flash escreveu e executou o arquivo com a ferramenta de shell do Codex ao longo de vários turnos. O seu raciocínio foi levado de um turno para o seguinte, algo de que o modo de raciocínio da DeepSeek precisa em conversas com chamadas de ferramentas.

Qual esforço de raciocínio um agente de programação deve usar?

O DeepSeek V4.1 Flash usa high por padrão, o que atende à maior parte do trabalho de programação. Use max para os problemas mais difíceis e low para etapas rápidas e mecânicas. Os nomes de esforço do próprio Codex também funcionam: medium e xhigh funcionam como high, minimal como low.

Agentes releem os mesmos arquivos a cada turno, então a maior parte da entrada deles é servida pelo cache a cerca de 2% da tarifa de entrada nova. É na saída, incluindo o raciocínio, que está o custo de uma sessão de agente, e todas as tarifas caem pela metade fora do horário de pico.

Posso usar o DeepSeek V4.1 Flash em outras ferramentas de programação?

Qualquer ferramenta que permita definir uma URL base compatível com a OpenAI e um nome de modelo pode chamar o DeepSeek V4.1 Flash do mesmo jeito: URL base https://api.seedrouter.ai/v1, a sua chave da SeedRouter, modelo deepseek-v4.1-flash. Testamos o Claude Code e o Codex; veja na documentação da sua ferramenta onde ela aceita uma URL base personalizada.

Perguntas frequentes

Preciso de uma assinatura do Claude ou do ChatGPT para isso?

Não. Com uma chave da SeedRouter, o Claude Code e o Codex enviam as solicitações para a SeedRouter, e você paga por token do seu saldo na SeedRouter.

O DeepSeek V4.1 Flash oferece uso de ferramentas nesses agentes?

Sim. As duas ferramentas dependem de chamadas de ferramentas para ler, escrever e executar arquivos, e o DeepSeek V4.1 Flash lidou com elas nos nossos testes.

Posso enviar capturas de tela ao DeepSeek V4.1 Flash a partir de um agente?

Sim. O DeepSeek V4.1 Flash lê imagens nativamente. Agentes que anexam capturas de tela as codificam para você.

Quanto custa uma sessão de agente?

Depende da tarefa. O guia de preços do DeepSeek V4.1 Flash traz as tarifas atuais, e a página do DeepSeek V4.1 Flash as mostra ao lado do preço de tabela.

Guias relacionados