API DeepSeek V4.1 Flash: jak uzyskać klucz i wykonać pierwsze wywołanie
Jak korzystać z API DeepSeek V4.1 Flash: uzyskaj klucz, wywołaj model w OpenAI SDK, włącz lub wyłącz myślenie, streamuj, wysyłaj obrazy i napraw typowe błędy.
Czytaj jako MarkdownAby wywołać DeepSeek V4.1 Flash, potrzebujesz klucza API z platformy, która go udostępnia, oraz żądania z identyfikatorem modelu. We własnym API DeepSeek model nazywa się deepseek-flash, a stare nazwy deepseek-v4-flash i deepseek-v4-flash-vision-exp są do niego kierowane. W SeedRouter identyfikator modelu to deepseek-v4.1-flash, a jeden klucz wywołuje go z płatnością za użycie, w oficjalnym formacie żądań: skieruj OpenAI SDK na https://api.seedrouter.ai/v1 i zachowaj swój kod.
Ten poradnik korzysta z SeedRouter; treść żądań jest taka sama jak we własnym API DeepSeek.
Jak uzyskać klucz API DeepSeek V4.1 Flash?
- Zaloguj się do SeedRouter i otwórz API keys.
- Utwórz klucz i skopiuj go; jest wyświetlany tylko raz.
- Doładuj saldo, gdy będzie potrzebne. Nowe konta startują z niewielkim darmowym saldem i nie ma subskrypcji.
Przechowuj klucz w zmiennej środowiskowej, np. SEEDROUTER_API_KEY, i używaj go tylko w kodzie po stronie serwera.
Jak wywołać DeepSeek V4.1 Flash z Pythona?
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["SEEDROUTER_API_KEY"],
base_url="https://api.seedrouter.ai/v1",
)
completion = client.chat.completions.create(
model="deepseek-v4.1-flash",
messages=[{"role": "user", "content": "Give me three names for a coffee shop."}],
)
print(completion.choices[0].message.content)Myślenie jest domyślnie włączone, więc wiadomość zawiera też rozumowanie modelu w reasoning_content, obok odpowiedzi w content.
Jak wywołać go z Node.js lub cURL?
import OpenAI from "openai";
const client = new OpenAI({
apiKey: process.env.SEEDROUTER_API_KEY,
baseURL: "https://api.seedrouter.ai/v1",
});
const completion = await client.chat.completions.create({
model: "deepseek-v4.1-flash",
messages: [{ role: "user", content: "Give me three names for a coffee shop." }],
});
console.log(completion.choices[0].message.content);curl https://api.seedrouter.ai/v1/chat/completions \
-H "Authorization: Bearer $SEEDROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model": "deepseek-v4.1-flash", "messages": [{"role": "user", "content": "Give me three names for a coffee shop."}]}'Ten sam klucz obsługuje też Responses API (/v1/responses) i format Anthropic Messages (/v1/messages) dla deepseek-v4.1-flash.
Jak wyłączyć myślenie lub ustawić jego poziom?
Myślenie jest domyślnie włączone z poziomem high. Wyłączysz je przez thinking albo wybierzesz poziom przez reasoning_effort. OpenAI SDK przekazuje thinking przez extra_body. Pierwsze żądanie wyłącza myślenie, aby uzyskać najszybszą i najtańszą odpowiedź; drugie używa najwyższego poziomu:
completion = client.chat.completions.create(
model="deepseek-v4.1-flash",
messages=[{"role": "user", "content": "Classify: 'my card was charged twice'"}],
extra_body={"thinking": {"type": "disabled"}},
)
completion = client.chat.completions.create(
model="deepseek-v4.1-flash",
messages=[{"role": "user", "content": "How many primes are there below 150?"}],
reasoning_effort="max",
)reasoning_effort | Efekt |
|---|---|
none | Myślenie wyłączone |
low | Krótkie rozumowanie |
high (domyślnie) | Większość zadań |
max | Najtrudniejsze problemy |
DeepSeek przyjmuje też minimal (działa jak low), medium i xhigh (działają jak high). W naszym teście z pytaniem o liczenie liczb pierwszych wyłączone myślenie zużyło 2 tokeny wyjścia, low 258, a max 319. Rozumowanie jest rozliczane jako wyjście.
Jak streamować odpowiedź?
Dodaj stream=True. Przy włączonym myśleniu rozumowanie przychodzi najpierw w delta.reasoning_content, potem odpowiedź w delta.content, a ostatni fragment zawiera zużycie tokenów:
stream = client.chat.completions.create(
model="deepseek-v4.1-flash",
messages=[{"role": "user", "content": "Write a haiku about latency."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Czy mogę wysyłać obrazy?
Tak. DeepSeek V4.1 Flash natywnie czyta obrazy. Wyślij publiczny URL lub data URI w base64 w części image_url:
completion = client.chat.completions.create(
model="deepseek-v4.1-flash",
messages=[{
"role": "user",
"content": [
{"type": "image_url", "image_url": {"url": "https://example.com/chart.png"}},
{"type": "text", "text": "What does this chart show?"},
],
}],
)URL obrazu może mieć do 8 192 znaków i wskazywać plik o rozmiarze do 32 MiB.
Jakich błędów się spodziewać?
| Błąd | Przyczyna | Rozwiązanie |
|---|---|---|
400 przy response_format | json_schema nie jest obsługiwany | Użyj {"type": "json_object"} i opisz strukturę w prompcie |
400 przy temperature lub top_p | Powyżej 2 lub powyżej 1 | Trzymaj je w zakresie; przy włączonym myśleniu i tak mają niewielki wpływ |
| 400 przy URL obrazu | Pliku nie dało się pobrać jako obrazu | Sprawdź, czy URL jest publiczny i wskazuje na obraz |
| 401 | Brak klucza lub błędny klucz | Sprawdź nagłówek Authorization |
Błędy zwracają {"error": {"code": ..., "message": "..."}}, a żądanie zakończone błędem nie jest rozliczane.
Najczęściej zadawane pytania
Czy API DeepSeek V4.1 Flash jest zgodne z OpenAI?
Tak. Przyjmuje formaty Chat Completions i Responses, więc OpenAI SDK działa po zmianie samego bazowego URL i modelu. Przyjmuje też format Anthropic Messages.
Dlaczego identyfikator modelu różni się od tego w DeepSeek?
DeepSeek nazywa model deepseek-flash we własnym API. SeedRouter używa deepseek-v4.1-flash, aby wersja była częścią nazwy. Poza tym treść żądania jest taka sama.
Ile kosztuje żądanie do DeepSeek V4.1 Flash?
Jest rozliczane za token, według stawek w godzinach szczytu lub poza godzinami szczytu, zależnie od godziny. Cennik DeepSeek V4.1 Flash zawiera aktualne stawki i przykłady wyliczeń.
Gdzie jest pełna lista parametrów?
Dokumentacja API DeepSeek V4.1 Flash opisuje każde pole, a strona DeepSeek V4.1 Flash oferuje playground i aktualne ceny.



