Usa DeepSeek V4.1 Flash en Claude Code y Codex: configuración probada
Cómo usar DeepSeek V4.1 Flash como modelo en Claude Code y OpenAI Codex CLI con SeedRouter: variables de entorno, config.toml y resultados de nuestras pruebas.
Leer en MarkdownDeepSeek V4.1 Flash funciona como modelo en Claude Code y en Codex CLI de OpenAI. Claude Code habla el formato Anthropic Messages y Codex el formato Responses, y SeedRouter sirve DeepSeek V4.1 Flash en ambos. Define una URL base y una clave de SeedRouter, elige deepseek-v4.1-flash, y cada solicitud se factura por token de tu saldo. En nuestras pruebas del 28 de septiembre de 2026, ambas herramientas crearon un archivo, lo ejecutaron e informaron de la salida, con DeepSeek V4.1 Flash haciendo el trabajo.
¿Cómo uso DeepSeek V4.1 Flash en Claude Code?
Apunta Claude Code a SeedRouter con dos variables de entorno y luego elige el modelo:
export ANTHROPIC_BASE_URL=https://api.seedrouter.ai
export ANTHROPIC_API_KEY=sk-your-seedrouter-key
claude --model deepseek-v4.1-flashClaude Code también llama a un modelo más pequeño en segundo plano para algunas tareas. Apunta también esas llamadas a DeepSeek V4.1 Flash, para que cada solicitud vaya a un modelo que tu clave pueda llamar:
export ANTHROPIC_DEFAULT_OPUS_MODEL=deepseek-v4.1-flash
export ANTHROPIC_DEFAULT_SONNET_MODEL=deepseek-v4.1-flash
export ANTHROPIC_DEFAULT_HAIKU_MODEL=deepseek-v4.1-flashPara conservar la configuración entre sesiones, pon las mismas variables en el bloque env de ~/.claude/settings.json:
{
"env": {
"ANTHROPIC_BASE_URL": "https://api.seedrouter.ai",
"ANTHROPIC_API_KEY": "sk-your-seedrouter-key",
"ANTHROPIC_MODEL": "deepseek-v4.1-flash",
"ANTHROPIC_DEFAULT_OPUS_MODEL": "deepseek-v4.1-flash",
"ANTHROPIC_DEFAULT_SONNET_MODEL": "deepseek-v4.1-flash",
"ANTHROPIC_DEFAULT_HAIKU_MODEL": "deepseek-v4.1-flash"
}
}Claude Code avisa de que deepseek-v4.1-flash no es uno de sus propios nombres de modelo. Es un aviso, no un error: la sesión funciona. El razonamiento del modelo aparece como bloques de pensamiento, igual que con los modelos Claude.
¿Cómo uso DeepSeek V4.1 Flash en Codex?
Añade SeedRouter a ~/.codex/config.toml:
model = "deepseek-v4.1-flash"
model_provider = "seedrouter"
model_context_window = 1048576
model_reasoning_effort = "high"
show_raw_agent_reasoning = true
[model_providers.seedrouter]
name = "SeedRouter"
base_url = "https://api.seedrouter.ai/v1"
env_key = "SEEDROUTER_API_KEY"
wire_api = "responses"Después exporta la clave e inicia Codex:
export SEEDROUTER_API_KEY=sk-your-seedrouter-key
codexwire_api = "responses" y show_raw_agent_reasoning = true siguen la guía de Codex de la propia DeepSeek. La segunda te permite ver el razonamiento del modelo en Codex CLI con Ctrl + T. model_context_window le indica a Codex que DeepSeek V4.1 Flash lee hasta 1.048.576 tokens.
¿Qué probamos?
Le dimos a Claude Code una tarea de dos pasos (crear un pequeño archivo de Python, ejecutarlo e informar de la salida) y a Codex una de cuatro (crear el archivo, ejecutarlo, modificarlo, volver a ejecutarlo e informar de ambas salidas).
| Herramienta | Formato | Resultado |
|---|---|---|
| Claude Code | Anthropic Messages | Archivo creado y ejecutado; salida informada correctamente |
| Codex CLI | Responses | Dos ediciones y dos ejecuciones; ambas salidas informadas correctamente |
En Codex, DeepSeek V4.1 Flash escribió y ejecutó el archivo con la herramienta de shell de Codex a lo largo de varios turnos. Su razonamiento se trasladó de un turno al siguiente, que es lo que necesita el modo de pensamiento de DeepSeek en las conversaciones con llamadas a herramientas.
¿Qué nivel de razonamiento debería usar un agente de programación?
DeepSeek V4.1 Flash usa high por defecto, que sirve para la mayor parte del trabajo de programación. Usa max para los problemas más difíciles y low para pasos rápidos y mecánicos. Los nombres de nivel propios de Codex también funcionan: medium y xhigh se ejecutan como high, y minimal como low.
Los agentes vuelven a leer los mismos archivos en cada turno, así que la mayor parte de su entrada se sirve desde la caché a cerca del 2 % de la tarifa de entrada nueva. El coste de una sesión de agente se va en la salida, razonamiento incluido, y en horas valle todas las tarifas están a la mitad.
¿Puedo usar DeepSeek V4.1 Flash en otras herramientas de programación?
Cualquier herramienta que te permita definir una URL base compatible con OpenAI y un nombre de modelo puede llamar a DeepSeek V4.1 Flash de la misma forma: URL base https://api.seedrouter.ai/v1, tu clave de SeedRouter y el modelo deepseek-v4.1-flash. Hemos probado Claude Code y Codex; consulta la documentación de tu herramienta para ver dónde acepta una URL base personalizada.
Preguntas frecuentes
¿Necesito una suscripción de Claude o ChatGPT para esto?
No. Con una clave de SeedRouter, Claude Code y Codex envían sus solicitudes a SeedRouter, y pagas por token de tu saldo de SeedRouter.
¿DeepSeek V4.1 Flash admite el uso de herramientas en estos agentes?
Sí. Ambas herramientas dependen de llamadas a herramientas para leer, escribir y ejecutar archivos, y DeepSeek V4.1 Flash las gestionó en nuestras pruebas.
¿Puedo enviar capturas de pantalla a DeepSeek V4.1 Flash desde un agente?
Sí. DeepSeek V4.1 Flash lee imágenes de forma nativa. Los agentes que adjuntan capturas de pantalla las codifican por ti.
¿Cuánto cuesta una sesión de agente?
Depende de la tarea. La guía de precios de DeepSeek V4.1 Flash tiene las tarifas en vivo, y la página de DeepSeek V4.1 Flash las muestra junto al precio de lista.



