API di DeepSeek V4.1 Flash: ottieni una chiave e fai la prima chiamata
Come usare l'API di DeepSeek V4.1 Flash: ottieni una chiave, chiamala con l'SDK OpenAI, attiva o disattiva il ragionamento, streaming, immagini ed errori.
Leggi in MarkdownPer chiamare DeepSeek V4.1 Flash ti servono una chiave API di una piattaforma che lo offre e una richiesta con il suo ID modello. Nell'API di DeepSeek il modello si chiama deepseek-flash, e i vecchi nomi deepseek-v4-flash e deepseek-v4-flash-vision-exp vengono instradati verso di esso. Su SeedRouter l'ID modello è deepseek-v4.1-flash, e un'unica chiave lo chiama a consumo nel formato di richiesta ufficiale: punta l'SDK OpenAI su https://api.seedrouter.ai/v1 e mantieni il tuo codice.
Questa guida usa SeedRouter; i corpi delle richieste sono gli stessi dell'API di DeepSeek.
Come ottenere una chiave API di DeepSeek V4.1 Flash?
- Accedi a SeedRouter e apri API keys.
- Crea una chiave e copiala; viene mostrata una sola volta.
- Aggiungi credito quando ti serve. I nuovi account partono con un piccolo saldo gratuito e non c'è alcun abbonamento.
Conserva la chiave in una variabile d'ambiente come SEEDROUTER_API_KEY e usala solo da codice lato server.
Come chiamare DeepSeek V4.1 Flash da Python?
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["SEEDROUTER_API_KEY"],
base_url="https://api.seedrouter.ai/v1",
)
completion = client.chat.completions.create(
model="deepseek-v4.1-flash",
messages=[{"role": "user", "content": "Give me three names for a coffee shop."}],
)
print(completion.choices[0].message.content)Il ragionamento è attivo per impostazione predefinita, quindi il messaggio contiene anche il ragionamento del modello in reasoning_content, accanto alla risposta in content.
Come chiamarlo da Node.js o cURL?
import OpenAI from "openai";
const client = new OpenAI({
apiKey: process.env.SEEDROUTER_API_KEY,
baseURL: "https://api.seedrouter.ai/v1",
});
const completion = await client.chat.completions.create({
model: "deepseek-v4.1-flash",
messages: [{ role: "user", content: "Give me three names for a coffee shop." }],
});
console.log(completion.choices[0].message.content);curl https://api.seedrouter.ai/v1/chat/completions \
-H "Authorization: Bearer $SEEDROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model": "deepseek-v4.1-flash", "messages": [{"role": "user", "content": "Give me three names for a coffee shop."}]}'La stessa chiave risponde anche alla Responses API (/v1/responses) e al formato Anthropic Messages (/v1/messages) per deepseek-v4.1-flash.
Come disattivare il ragionamento o impostarne lo sforzo?
Il ragionamento è attivo per impostazione predefinita con sforzo high. Disattivalo con thinking, oppure scegli uno sforzo con reasoning_effort. L'SDK OpenAI passa thinking tramite extra_body. La prima richiesta disattiva il ragionamento per la risposta più rapida ed economica; la seconda usa lo sforzo più alto:
completion = client.chat.completions.create(
model="deepseek-v4.1-flash",
messages=[{"role": "user", "content": "Classify: 'my card was charged twice'"}],
extra_body={"thinking": {"type": "disabled"}},
)
completion = client.chat.completions.create(
model="deepseek-v4.1-flash",
messages=[{"role": "user", "content": "How many primes are there below 150?"}],
reasoning_effort="max",
)reasoning_effort | Effetto |
|---|---|
none | Ragionamento disattivato |
low | Ragionamento breve |
high (predefinito) | La maggior parte delle attività |
max | I problemi più difficili |
DeepSeek accetta anche minimal (funziona come low), medium e xhigh (funzionano come high). Nel nostro test su una domanda di conteggio dei numeri primi, con il ragionamento disattivato sono stati usati 2 token di output, con low 258 e con max 319. Il ragionamento viene fatturato come output.
Come ricevere la risposta in streaming?
Aggiungi stream=True. Con il ragionamento attivo, il ragionamento arriva prima in delta.reasoning_content, poi la risposta in delta.content, e l'ultimo chunk contiene l'utilizzo dei token:
stream = client.chat.completions.create(
model="deepseek-v4.1-flash",
messages=[{"role": "user", "content": "Write a haiku about latency."}],
stream=True,
)
for chunk in stream:
if chunk.choices and chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="", flush=True)Posso inviare immagini?
Sì. DeepSeek V4.1 Flash legge le immagini in modo nativo. Invia un URL pubblico o un data URI base64 in una parte image_url:
completion = client.chat.completions.create(
model="deepseek-v4.1-flash",
messages=[{
"role": "user",
"content": [
{"type": "image_url", "image_url": {"url": "https://example.com/chart.png"}},
{"type": "text", "text": "What does this chart show?"},
],
}],
)Un URL di immagine può essere lungo fino a 8.192 caratteri e puntare a un file fino a 32 MiB.
Quali errori puoi incontrare?
| Errore | Causa | Soluzione |
|---|---|---|
400 su response_format | json_schema non è supportato | Usa {"type": "json_object"} e descrivi la struttura nel prompt |
400 su temperature o top_p | Sopra 2 o sopra 1 | Mantienili nell'intervallo; con il ragionamento attivo hanno comunque poco effetto |
| 400 su un URL di immagine | Il file non è stato scaricato come immagine | Verifica che l'URL sia pubblico e punti a un'immagine |
| 401 | Chiave mancante o errata | Controlla l'header Authorization |
Gli errori restituiscono {"error": {"code": ..., "message": "..."}}, e una richiesta che fallisce non viene addebitata.
Domande frequenti
L'API di DeepSeek V4.1 Flash è compatibile con OpenAI?
Sì. Accetta i formati Chat Completions e Responses, quindi l'SDK OpenAI funziona cambiando solo l'URL di base e il modello. Accetta anche il formato Anthropic Messages.
Perché l'ID modello è diverso da quello di DeepSeek?
DeepSeek chiama il modello deepseek-flash nella propria API. SeedRouter usa deepseek-v4.1-flash perché la versione faccia parte del nome. Per il resto il corpo della richiesta è identico.
Quanto costa una richiesta a DeepSeek V4.1 Flash?
Viene fatturata per token, con tariffe in fascia di punta o fascia fuori punta a seconda dell'ora. La guida ai prezzi di DeepSeek V4.1 Flash riporta le tariffe aggiornate ed esempi di calcolo.
Dove trovo l'elenco completo dei parametri?
Il riferimento API di DeepSeek V4.1 Flash elenca ogni campo, e la pagina di DeepSeek V4.1 Flash offre un playground e i prezzi aggiornati.



