Claude Opus 5.5 ist auf SeedRouter verfügbar

DeepSeek V4.1 Flash API nutzen: API-Key erhalten und erster Aufruf

DeepSeek V4.1 Flash API nutzen: API-Key erhalten, per OpenAI SDK aufrufen, Denkmodus an- oder ausschalten, streamen, Bilder senden, Fehler beheben.

Als Markdown lesen

Um DeepSeek V4.1 Flash aufzurufen, brauchen Sie einen API-Key von einer Plattform, die das Modell anbietet, und eine Anfrage mit seiner Modell-ID. In der API von DeepSeek selbst heißt das Modell deepseek-flash, und die alten Namen deepseek-v4-flash und deepseek-v4-flash-vision-exp werden darauf geleitet. Bei SeedRouter lautet die Modell-ID deepseek-v4.1-flash, und ein einziger Schlüssel ruft das Modell nutzungsbasiert im offiziellen Anfrageformat auf: Richten Sie das OpenAI SDK auf https://api.seedrouter.ai/v1 und behalten Sie Ihren Code.

Dieser Leitfaden verwendet SeedRouter; die Anfragekörper sind dieselben wie in der API von DeepSeek selbst.

Wie erhalte ich einen DeepSeek V4.1 Flash API-Key?

  1. Melden Sie sich bei SeedRouter an und öffnen Sie API keys.
  2. Erstellen Sie einen Schlüssel und kopieren Sie ihn; er wird nur einmal angezeigt.
  3. Laden Sie Guthaben auf, wenn Sie es brauchen. Neue Konten starten mit einem kleinen kostenlosen Guthaben, und es gibt kein Abo.

Bewahren Sie den Schlüssel in einer Umgebungsvariable wie SEEDROUTER_API_KEY auf und verwenden Sie ihn nur in serverseitigem Code.

Wie rufe ich DeepSeek V4.1 Flash aus Python auf?

import os
from openai import OpenAI

client = OpenAI(
    api_key=os.environ["SEEDROUTER_API_KEY"],
    base_url="https://api.seedrouter.ai/v1",
)

completion = client.chat.completions.create(
    model="deepseek-v4.1-flash",
    messages=[{"role": "user", "content": "Give me three names for a coffee shop."}],
)
print(completion.choices[0].message.content)

Der Denkmodus ist standardmäßig aktiv, daher enthält die Nachricht neben der Antwort in content auch das Reasoning des Modells in reasoning_content.

Wie rufe ich es aus Node.js oder mit cURL auf?

import OpenAI from "openai";

const client = new OpenAI({
  apiKey: process.env.SEEDROUTER_API_KEY,
  baseURL: "https://api.seedrouter.ai/v1",
});

const completion = await client.chat.completions.create({
  model: "deepseek-v4.1-flash",
  messages: [{ role: "user", content: "Give me three names for a coffee shop." }],
});
console.log(completion.choices[0].message.content);
curl https://api.seedrouter.ai/v1/chat/completions \
  -H "Authorization: Bearer $SEEDROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model": "deepseek-v4.1-flash", "messages": [{"role": "user", "content": "Give me three names for a coffee shop."}]}'

Mit demselben Schlüssel erreichen Sie deepseek-v4.1-flash auch über die Responses API (/v1/responses) und das Anthropic-Messages-Format (/v1/messages).

Wie schalte ich den Denkmodus aus oder stelle den Reasoning-Aufwand ein?

Der Denkmodus ist standardmäßig mit dem Aufwand high aktiv. Schalten Sie ihn mit thinking aus oder wählen Sie einen Aufwand mit reasoning_effort. Das OpenAI SDK übergibt thinking über extra_body. Die erste Anfrage schaltet den Denkmodus für die schnellste und günstigste Antwort aus; die zweite nutzt den höchsten Aufwand:

completion = client.chat.completions.create(
    model="deepseek-v4.1-flash",
    messages=[{"role": "user", "content": "Classify: 'my card was charged twice'"}],
    extra_body={"thinking": {"type": "disabled"}},
)

completion = client.chat.completions.create(
    model="deepseek-v4.1-flash",
    messages=[{"role": "user", "content": "How many primes are there below 150?"}],
    reasoning_effort="max",
)
reasoning_effortWirkung
noneDenkmodus aus
lowKurzes Reasoning
high (Standard)Die meisten Aufgaben
maxDie schwierigsten Probleme

DeepSeek akzeptiert außerdem minimal (läuft als low) sowie medium und xhigh (laufen als high). In unserem Test mit einer Frage zum Zählen von Primzahlen verbrauchte der ausgeschaltete Denkmodus 2 Ausgabe-Token, low 258 und max 319. Reasoning wird als Ausgabe abgerechnet.

Wie streame ich die Antwort?

Fügen Sie stream=True hinzu. Bei aktivem Denkmodus kommt zuerst das Reasoning in delta.reasoning_content, dann die Antwort in delta.content, und der letzte Chunk enthält den Token-Verbrauch:

stream = client.chat.completions.create(
    model="deepseek-v4.1-flash",
    messages=[{"role": "user", "content": "Write a haiku about latency."}],
    stream=True,
)
for chunk in stream:
    if chunk.choices and chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)

Kann ich Bilder senden?

Ja. DeepSeek V4.1 Flash liest Bilder nativ. Senden Sie eine öffentliche URL oder eine base64-Data-URI in einem image_url-Teil:

completion = client.chat.completions.create(
    model="deepseek-v4.1-flash",
    messages=[{
        "role": "user",
        "content": [
            {"type": "image_url", "image_url": {"url": "https://example.com/chart.png"}},
            {"type": "text", "text": "What does this chart show?"},
        ],
    }],
)

Eine Bild-URL darf bis zu 8.192 Zeichen lang sein und auf eine Datei von bis zu 32 MiB verweisen.

Mit welchen Fehlern muss ich rechnen?

FehlerUrsacheLösung
400 bei response_formatjson_schema wird nicht unterstützt{"type": "json_object"} verwenden und die Struktur im Prompt beschreiben
400 bei temperature oder top_pÜber 2 bzw. über 1Im gültigen Bereich bleiben; bei aktivem Denkmodus wirken sie ohnehin kaum
400 bei einer Bild-URLDie Datei ließ sich nicht als Bild herunterladenPrüfen, ob die URL öffentlich ist und auf ein Bild zeigt
401Fehlender oder falscher SchlüsselDen Authorization-Header prüfen

Fehler werden als {"error": {"code": ..., "message": "..."}} zurückgegeben, und eine fehlgeschlagene Anfrage wird nicht berechnet.

Häufig gestellte Fragen

Ist die DeepSeek V4.1 Flash API OpenAI-kompatibel?

Ja. Sie akzeptiert die Formate Chat Completions und Responses, sodass das OpenAI SDK funktioniert, wenn Sie nur Base-URL und Modell ändern. Sie akzeptiert auch das Anthropic-Messages-Format.

Warum unterscheidet sich die Modell-ID von der bei DeepSeek?

DeepSeek nennt das Modell in seiner eigenen API deepseek-flash. SeedRouter verwendet deepseek-v4.1-flash, damit die Version Teil des Namens ist. Ansonsten ist der Anfragekörper derselbe.

Was kostet eine DeepSeek V4.1 Flash-Anfrage?

Sie wird pro Token abgerechnet, je nach Uhrzeit zum Tarif der Hauptzeit oder der Nebenzeit. Der Preisleitfaden zu DeepSeek V4.1 Flash enthält die Live-Tarife und Rechenbeispiele.

Wo finde ich die vollständige Parameterliste?

Die DeepSeek V4.1 Flash API-Referenz listet jedes Feld auf; auf der Seite zu DeepSeek V4.1 Flash finden Sie einen Playground und Live-Preise.

Verwandte Leitfäden