DeepSeek V4.1 Flash in Claude Code und Codex nutzen: getestetes Setup
So nutzen Sie DeepSeek V4.1 Flash über SeedRouter als Modell in Claude Code und der OpenAI Codex CLI: Umgebungsvariablen, config.toml und unsere Testergebnisse.
Als Markdown lesenDeepSeek V4.1 Flash funktioniert als Modell in Claude Code und in OpenAIs Codex CLI. Claude Code spricht das Anthropic-Messages-Format und Codex das Responses-Format, und SeedRouter bietet DeepSeek V4.1 Flash in beiden an. Setzen Sie eine Base-URL und einen SeedRouter-Schlüssel, wählen Sie deepseek-v4.1-flash, und jede Anfrage wird pro Token von Ihrem Guthaben abgerechnet. In unseren Testläufen am 28. September 2026 haben beide Tools eine Datei erstellt, ausgeführt und die Ausgabe gemeldet, wobei DeepSeek V4.1 Flash die Arbeit erledigte.
Wie nutze ich DeepSeek V4.1 Flash in Claude Code?
Richten Sie Claude Code mit zwei Umgebungsvariablen auf SeedRouter und wählen Sie dann das Modell:
export ANTHROPIC_BASE_URL=https://api.seedrouter.ai
export ANTHROPIC_API_KEY=sk-your-seedrouter-key
claude --model deepseek-v4.1-flashClaude Code ruft für manche Aufgaben im Hintergrund auch ein kleineres Modell auf. Richten Sie diese ebenfalls auf DeepSeek V4.1 Flash, damit jede Anfrage an ein Modell geht, das Ihr Schlüssel aufrufen kann:
export ANTHROPIC_DEFAULT_OPUS_MODEL=deepseek-v4.1-flash
export ANTHROPIC_DEFAULT_SONNET_MODEL=deepseek-v4.1-flash
export ANTHROPIC_DEFAULT_HAIKU_MODEL=deepseek-v4.1-flashDamit das Setup über Sitzungen hinweg erhalten bleibt, tragen Sie dieselben Variablen in den env-Block von ~/.claude/settings.json ein:
{
"env": {
"ANTHROPIC_BASE_URL": "https://api.seedrouter.ai",
"ANTHROPIC_API_KEY": "sk-your-seedrouter-key",
"ANTHROPIC_MODEL": "deepseek-v4.1-flash",
"ANTHROPIC_DEFAULT_OPUS_MODEL": "deepseek-v4.1-flash",
"ANTHROPIC_DEFAULT_SONNET_MODEL": "deepseek-v4.1-flash",
"ANTHROPIC_DEFAULT_HAIKU_MODEL": "deepseek-v4.1-flash"
}
}Claude Code weist darauf hin, dass deepseek-v4.1-flash keiner seiner eigenen Modellnamen ist. Das ist ein Hinweis, kein Fehler: Die Sitzung läuft. Das Reasoning des Modells erscheint als Thinking-Blöcke, wie bei Claude-Modellen.
Wie nutze ich DeepSeek V4.1 Flash in Codex?
Fügen Sie SeedRouter zu ~/.codex/config.toml hinzu:
model = "deepseek-v4.1-flash"
model_provider = "seedrouter"
model_context_window = 1048576
model_reasoning_effort = "high"
show_raw_agent_reasoning = true
[model_providers.seedrouter]
name = "SeedRouter"
base_url = "https://api.seedrouter.ai/v1"
env_key = "SEEDROUTER_API_KEY"
wire_api = "responses"Exportieren Sie dann den Schlüssel und starten Sie Codex:
export SEEDROUTER_API_KEY=sk-your-seedrouter-key
codexwire_api = "responses" und show_raw_agent_reasoning = true folgen DeepSeeks eigenem Codex-Leitfaden. Mit der zweiten Einstellung sehen Sie das Reasoning des Modells in der Codex CLI mit Strg + T. model_context_window teilt Codex mit, dass DeepSeek V4.1 Flash bis zu 1.048.576 Token liest.
Was haben wir getestet?
Wir haben Claude Code eine zweistufige Aufgabe gegeben (eine kleine Python-Datei erstellen, ausführen und die Ausgabe melden) und Codex eine vierstufige (die Datei erstellen, ausführen, ändern, erneut ausführen und beide Ausgaben melden).
| Tool | Format | Ergebnis |
|---|---|---|
| Claude Code | Anthropic Messages | Datei erstellt und ausgeführt; Ausgabe korrekt gemeldet |
| Codex CLI | Responses | Zwei Änderungen und zwei Ausführungen; beide Ausgaben korrekt gemeldet |
In Codex hat DeepSeek V4.1 Flash die Datei über mehrere Runden mit dem Shell-Tool von Codex geschrieben und ausgeführt. Sein Reasoning wurde von einer Runde zur nächsten mitgeführt, was DeepSeeks Denkmodus in Unterhaltungen mit Tool-Aufrufen benötigt.
Welchen Reasoning-Aufwand sollte ein Coding-Agent nutzen?
DeepSeek V4.1 Flash nutzt standardmäßig high, was für die meiste Coding-Arbeit passt. Verwenden Sie max für die schwierigsten Probleme und low für schnelle, mechanische Schritte. Auch Codex' eigene Aufwandsnamen funktionieren: medium und xhigh laufen als high, minimal als low.
Agenten lesen in jeder Runde dieselben Dateien erneut, daher wird der Großteil ihrer Eingabe zu etwa 2 % des Tarifs für frische Eingabe aus dem Cache bedient. Die Kosten einer Agentensitzung entstehen bei der Ausgabe, einschließlich Reasoning, und in der Nebenzeit ist jeder Tarif halbiert.
Kann ich DeepSeek V4.1 Flash in anderen Coding-Tools nutzen?
Jedes Tool, in dem Sie eine OpenAI-kompatible Base-URL und einen Modellnamen setzen können, kann DeepSeek V4.1 Flash auf dieselbe Weise aufrufen: Base-URL https://api.seedrouter.ai/v1, Ihr SeedRouter-Schlüssel, Modell deepseek-v4.1-flash. Wir haben Claude Code und Codex getestet; in der Dokumentation Ihres Tools steht, wo es eine eigene Base-URL annimmt.
Häufig gestellte Fragen
Brauche ich dafür ein Claude- oder ChatGPT-Abo?
Nein. Mit einem SeedRouter-Schlüssel senden Claude Code und Codex ihre Anfragen an SeedRouter, und Sie zahlen pro Token von Ihrem SeedRouter-Guthaben.
Unterstützt DeepSeek V4.1 Flash in diesen Agenten die Tool-Nutzung?
Ja. Beide Tools nutzen Tool-Aufrufe, um Dateien zu lesen, zu schreiben und auszuführen, und DeepSeek V4.1 Flash hat sie in unseren Tests bewältigt.
Kann ich aus einem Agenten Screenshots an DeepSeek V4.1 Flash senden?
Ja. DeepSeek V4.1 Flash liest Bilder nativ. Agenten, die Screenshots anhängen, kodieren sie für Sie.
Was kostet eine Agentensitzung?
Das hängt von der Aufgabe ab. Der Preisleitfaden zu DeepSeek V4.1 Flash enthält die Live-Tarife, und die Seite zu DeepSeek V4.1 Flash zeigt sie neben dem Listenpreis.



