Usare DeepSeek V4.1 Flash in Claude Code e Codex: configurazione testata
Come usare DeepSeek V4.1 Flash come modello in Claude Code e nella Codex CLI di OpenAI tramite SeedRouter: variabili d'ambiente, config.toml e i nostri test.
Leggi in MarkdownDeepSeek V4.1 Flash funziona come modello in Claude Code e nella Codex CLI di OpenAI. Claude Code parla il formato Anthropic Messages e Codex il formato Responses, e SeedRouter offre DeepSeek V4.1 Flash in entrambi. Imposta un URL di base e una chiave SeedRouter, scegli deepseek-v4.1-flash, e ogni richiesta viene fatturata per token dal tuo saldo. Nei nostri test del 28 settembre 2026, entrambi gli strumenti hanno creato un file, lo hanno eseguito e hanno riportato l'output, con DeepSeek V4.1 Flash a fare il lavoro.
Come usare DeepSeek V4.1 Flash in Claude Code?
Punta Claude Code su SeedRouter con due variabili d'ambiente, poi scegli il modello:
export ANTHROPIC_BASE_URL=https://api.seedrouter.ai
export ANTHROPIC_API_KEY=sk-your-seedrouter-key
claude --model deepseek-v4.1-flashClaude Code chiama anche un modello più piccolo in background per alcune attività. Punta anche quelle su DeepSeek V4.1 Flash, così ogni richiesta va a un modello che la tua chiave può chiamare:
export ANTHROPIC_DEFAULT_OPUS_MODEL=deepseek-v4.1-flash
export ANTHROPIC_DEFAULT_SONNET_MODEL=deepseek-v4.1-flash
export ANTHROPIC_DEFAULT_HAIKU_MODEL=deepseek-v4.1-flashPer mantenere la configurazione tra una sessione e l'altra, metti le stesse variabili nel blocco env di ~/.claude/settings.json:
{
"env": {
"ANTHROPIC_BASE_URL": "https://api.seedrouter.ai",
"ANTHROPIC_API_KEY": "sk-your-seedrouter-key",
"ANTHROPIC_MODEL": "deepseek-v4.1-flash",
"ANTHROPIC_DEFAULT_OPUS_MODEL": "deepseek-v4.1-flash",
"ANTHROPIC_DEFAULT_SONNET_MODEL": "deepseek-v4.1-flash",
"ANTHROPIC_DEFAULT_HAIKU_MODEL": "deepseek-v4.1-flash"
}
}Claude Code segnala che deepseek-v4.1-flash non è uno dei suoi nomi di modello. È un avviso, non un errore: la sessione funziona. Il ragionamento del modello compare come blocchi di thinking, come succede con i modelli Claude.
Come usare DeepSeek V4.1 Flash in Codex?
Aggiungi SeedRouter a ~/.codex/config.toml:
model = "deepseek-v4.1-flash"
model_provider = "seedrouter"
model_context_window = 1048576
model_reasoning_effort = "high"
show_raw_agent_reasoning = true
[model_providers.seedrouter]
name = "SeedRouter"
base_url = "https://api.seedrouter.ai/v1"
env_key = "SEEDROUTER_API_KEY"
wire_api = "responses"Poi esporta la chiave e avvia Codex:
export SEEDROUTER_API_KEY=sk-your-seedrouter-key
codexwire_api = "responses" e show_raw_agent_reasoning = true seguono la guida Codex di DeepSeek. Il secondo ti permette di vedere il ragionamento del modello nella Codex CLI con Ctrl + T. model_context_window indica a Codex che DeepSeek V4.1 Flash legge fino a 1.048.576 token.
Cosa abbiamo testato?
Abbiamo dato a Claude Code un'attività in due passaggi (creare un piccolo file Python, eseguirlo e riportare l'output) e a Codex una in quattro passaggi (creare il file, eseguirlo, modificarlo, eseguirlo di nuovo e riportare entrambi gli output).
| Strumento | Formato | Risultato |
|---|---|---|
| Claude Code | Anthropic Messages | File creato ed eseguito; output riportato correttamente |
| Codex CLI | Responses | Due modifiche e due esecuzioni; entrambi gli output riportati correttamente |
In Codex, DeepSeek V4.1 Flash ha scritto ed eseguito il file con lo strumento shell di Codex in più turni. Il suo ragionamento è stato trasferito da un turno all'altro, cosa di cui la modalità di ragionamento di DeepSeek ha bisogno nelle conversazioni con chiamate a strumenti.
Quale sforzo di ragionamento dovrebbe usare un agente di coding?
DeepSeek V4.1 Flash usa high per impostazione predefinita, che va bene per la maggior parte del lavoro di coding. Usa max per i problemi più difficili e low per passaggi rapidi e meccanici. Funzionano anche i nomi di sforzo di Codex: medium e xhigh funzionano come high, minimal come low.
Gli agenti rileggono gli stessi file a ogni turno, quindi la maggior parte del loro input viene servita dalla cache a circa il 2% della tariffa dell'input nuovo. È l'output, ragionamento compreso, a determinare il costo di una sessione con un agente, e ogni tariffa è dimezzata in fascia fuori punta.
Posso usare DeepSeek V4.1 Flash in altri strumenti di coding?
Qualsiasi strumento che ti permetta di impostare un URL di base compatibile con OpenAI e un nome di modello può chiamare DeepSeek V4.1 Flash allo stesso modo: URL di base https://api.seedrouter.ai/v1, la tua chiave SeedRouter, modello deepseek-v4.1-flash. Abbiamo testato Claude Code e Codex; consulta la documentazione del tuo strumento per sapere dove accetta un URL di base personalizzato.
Domande frequenti
Serve un abbonamento a Claude o ChatGPT?
No. Con una chiave SeedRouter, Claude Code e Codex inviano le richieste a SeedRouter, e paghi per token dal tuo saldo SeedRouter.
DeepSeek V4.1 Flash supporta l'uso di strumenti in questi agenti?
Sì. Entrambi gli strumenti si basano sulle chiamate a strumenti per leggere, scrivere ed eseguire file, e DeepSeek V4.1 Flash le ha gestite nei nostri test.
Posso inviare screenshot a DeepSeek V4.1 Flash da un agente?
Sì. DeepSeek V4.1 Flash legge le immagini in modo nativo. Gli agenti che allegano screenshot li codificano per te.
Quanto costa una sessione con un agente?
Dipende dall'attività. La guida ai prezzi di DeepSeek V4.1 Flash riporta le tariffe aggiornate, e la pagina di DeepSeek V4.1 Flash le mostra accanto al prezzo di listino.



