Claude Opus 5.5 è disponibile su SeedRouter
DeepSeekGenerazione di testo

DeepSeek V4.1 Flash — ragionamento veloce ed economico con immagini

DeepSeek V4.1 Flash è il modello veloce ed economico di DeepSeek, con contesto da 1M di token e input di immagini. $0.24 / 1M di input, $0.96 / 1M di output per 1M di token in fascia di punta; la metà in fascia fuori punta.

Disponibile$0.24 / 1M input · $0.96 / 1M output$0.30 / 1M input · $1.20 / 1M output-20%
  • Ragionamento attivabile o disattivabile
  • Finestra di contesto da 1M di token
  • Input di immagini
  • Prezzi in fascia fuori punta
  • Streaming
Finestra di contesto
1M di token
Output massimo
384K di token
Livelli di ragionamento
none, low, high, max
Rilascio
10 set 2026

Prova DeepSeek V4.1 Flash

Chatta con DeepSeek V4.1 Flash, allega immagini e visualizza i token e il costo di ogni risposta.

Parametri

deepseek-v4.1-flash$0.24 input · $0.96 output per milione di token (fascia di punta ora)

Ragionamento
Reasoning effort

Con il ragionamento attivo, temperature non ha effetto e un top_p sotto 0.95 viene eseguito come 0.95.

Probabilità logaritmiche

Accettato, ma non vengono restituite probabilità logaritmiche.

Totale della conversazione$0.000000
Pronto

Prova uno di questi prompt

I messaggi si addebitano dal tuo credito alle tariffe sottostanti, come una chiamata API. Le richieste non riuscite sono gratuite.

Output reale di DeepSeek V4.1 Flash

Un prompt, inviato a DeepSeek V4.1 Flash con il ragionamento disattivato. Non modificato.

Explain the difference between a mutex and a semaphore in two short paragraphs, and say when to use each.

A mutex is a locking mechanism designed for mutual exclusion: only the thread that locked it may unlock it, and it has a notion of ownership. It's binary (locked/unlocked) and is used to protect a shared resource so that only one thread accesses it at a time. A semaphore is a signaling mechanism built around a counter: it tracks how many permits are available, any thread can wait (decrement) or post (increment) it, and it doesn't care which thread does what. A binary semaphore looks similar to a mutex, but lacks ownership, so it can be released by a different thread—useful for signaling between threads rather than guarding a critical section. Use a mutex when you need to protect a shared resource (a data structure, file, or device) from concurrent access, which is the common case for locking critical sections. Use a semaphore when you need to control access to a pool of N identical resources (e.g., limiting concurrent database connections) or to signal between threads, such as a producer notifying a consumer that data is ready or a task-completion event. As a rule of thumb: mutex for mutual exclusion, semaphore for counting or signaling.

Generato 2026-09-28. Le risposte variano da un'esecuzione all'altra.

Prezzi di DeepSeek V4.1 Flash

DeepSeek V4.1 Flash si addebita per token dal tuo credito, alle tariffe della fascia di punta o fuori punta in base all'ora. Le tariffe sottostanti sono in tempo reale, le stesse applicate al tuo account.

Una richiesta tipica2.000 token di input, 1.000 token di output, fascia di punta
$0.0014per richiesta
In fascia fuori punta, la stessa richiesta costa la metà.
Cosa compri con $20.00Token di output alla tariffa della fascia di punta
20,833,333token di output
Il doppio in fascia fuori punta. L'input in cache costa una frazione dell'input.

Le dimensioni degli esempi sono indicative e usano le tariffe della fascia di punta. Il tuo addebito si basa sui token dichiarati da ogni richiesta e sull'ora in cui viene eseguita.

VoceContato comeTariffaFatturazione
Input, fascia di puntaToken di prompt non trovati in cache, 01:00–04:00 e 06:00–10:00 UTC, lun–ven$0.24 / 1MPer 1M di token
Output, fascia di puntaToken di risposta e ragionamento, fascia di punta$0.96 / 1MPer 1M di token
Input in cache, fascia di puntaToken di prompt trovati in cache, fascia di punta$0.0048 / 1MPer 1M di token
Input, fascia fuori puntaToken di prompt non trovati in cache, tutte le altre ore, weekend compresi$0.12 / 1MPer 1M di token
Output, fascia fuori puntaToken di risposta e ragionamento, fascia fuori punta$0.48 / 1MPer 1M di token
Input in cache, fascia fuori puntaToken di prompt trovati in cache, fascia fuori punta$0.0024 / 1MPer 1M di token
Richiesta non riuscitaQualsiasi richiesta che restituisce un erroreGratisNon viene addebitato

Cos'è DeepSeek V4.1 Flash?

DeepSeek V4.1 Flash è il modello veloce ed economico di DeepSeek, rilasciato il 10 settembre 2026. È un modello mixture-of-experts da 552B parametri che attiva 8B parametri in lettura e 16B in scrittura, legge nativamente le immagini e accetta fino a 1M di token di contesto.

Per impostazione predefinita DeepSeek V4.1 Flash ragiona prima di rispondere, con sforzo high. Disattiva il ragionamento per passaggi rapidi e semplici, oppure alza lo sforzo a max per i problemi difficili. L'API di DeepSeek chiama il modello deepseek-flash.

ID del modello: deepseek-v4.1-flash · Input: testo, immagini · Output: testo · Formati: Chat Completions, Responses, Anthropic Messages.

ID del modello
deepseek-v4.1-flash
Finestra di contesto
1M di token
Output massimo
384K di token
Livelli di ragionamento
none, low, high, max
Input
Testo, immagini

Due modi per usare DeepSeek V4.1 Flash

Chiamala dal tuo codice, oppure lascia che il tuo agente di coding lo faccia per te.

API

Chiamala dal tuo backend

Ideale per app e servizi

Punta l'SDK OpenAI a SeedRouter e mantieni il tuo codice. DeepSeek V4.1 Flash risponde a Chat Completions, Responses e Anthropic Messages.

  1. 1Crea una chiave API
  2. 2Imposta l'URL di base a https://api.seedrouter.ai/v1
  3. 3Invia deepseek-v4.1-flash come modello
Agente

Affidala al tuo agente di coding

Ideale per Codex, Claude Code e altri agenti

Copia un prompt pronto. Il tuo agente mostra la richiesta e il costo prima di spendere nulla.

  1. 1Copia il prompt
  2. 2Incollalo nel tuo agente
  3. 3Approva la richiesta

In cosa eccelle DeepSeek V4.1 Flash

DeepSeek V4.1 Flash è fatto per il lavoro ad alto volume, dove velocità e costo contano.

Cicli di agenti

DeepSeek V4.1 Flash esegue molti passaggi economici, e il contesto in cache mantiene basso il costo delle letture ripetute.

Coding quotidiano

Scrivi, revisiona e correggi codice con DeepSeek V4.1 Flash in Codex, Claude Code o nei tuoi strumenti.

Immagini nel prompt

DeepSeek V4.1 Flash legge screenshot, grafici e foto per URL o in base64.

Output strutturato

Chiedi a DeepSeek V4.1 Flash un output json_object e analizza direttamente la risposta.

Ragionamento attivabile o disattivabile

Salta il ragionamento di DeepSeek V4.1 Flash per le risposte rapide, oppure alzalo per quelle difficili.

Tariffe fuori punta

I job batch fuori dalla fascia di punta pagano la metà del prezzo di punta.

Cosa costruiscono i team con DeepSeek V4.1 Flash

Classificazione su larga scala

Etichetta ticket, recensioni e log con DeepSeek V4.1 Flash, ragionamento disattivato, al costo più basso.

Agenti di coding

Esegui DeepSeek V4.1 Flash in Codex per cicli di modifica ed esecuzione rapidi ed economici.

Lettura di screenshot

Trasforma screenshot e grafici in testo o JSON.

Inizia a usare DeepSeek V4.1 Flash in quattro passaggi

  1. 01

    Crea una chiave

    Accedi e crea una chiave API. Aggiungi credito quando ti serve; non c'è abbonamento.

  2. 02

    Cambia l'URL di base

    Punta l'SDK OpenAI a https://api.seedrouter.ai/v1. Il tuo codice rimane uguale.

  3. 03

    Scegli DeepSeek V4.1 Flash

    Invia deepseek-v4.1-flash come modello. Disattiva il ragionamento o impostane lo sforzo a ogni richiesta.

  4. 04

    Controlla il conto

    Ogni richiesta mostra token e addebito nel tuo storico di utilizzo.

Ottieni una chiave API

DeepSeek V4.1 Flash su SeedRouter a colpo d'occhio

Quello che puoi usare oggi.

CaratteristicaDeepSeek V4.1 Flash
Chat CompletionsSì, formato ufficiale
ResponsesSì, funziona con Codex
Anthropic MessagesSì, funziona con Claude Code
Input di immaginiSì, per URL o base64
StreamingSì
Caching del contestoSì, automatico, cache hit fatturati a una tariffa più bassa
Output JSONSì, json_object
Richieste non riusciteNon viene addebitato

FIM e completamento con prefisso della chat (beta), la Files API e le probabilità logaritmiche non sono offerti.

Limiti di DeepSeek V4.1 Flash

Finestra di contesto da 1M di token

Su DeepSeek V4.1 Flash, prompt, immagini e cronologia condividono un'unica finestra da 1M di token.

384K token in output

Una richiesta a DeepSeek V4.1 Flash scrive fino a 393.216 token, ragionamento incluso.

Campionamento con il ragionamento attivo

Con il ragionamento attivo, temperature non ha effetto e top_p resta a 0.95 o più.

Dimensione delle immagini

Un URL di immagine per DeepSeek V4.1 Flash può puntare a un file fino a 32 MiB.

Perché chiamare DeepSeek V4.1 Flash tramite SeedRouter

Una chiave, tre formati

Chiama DeepSeek V4.1 Flash con Chat Completions, Responses oppure Anthropic Messages, tutto con la stessa chiave.

Paghi per token

Ricarica una volta e spendilo su qualsiasi modello. Niente piano, niente canone mensile.

I fallimenti sono gratis

Una richiesta che restituisce un errore non viene addebitata.

Prezzi in tempo reale

Le tariffe su questa pagina sono quelle che il tuo account paga, in fascia di punta e fuori punta.

Caching del contesto

I prefissi di prompt ripetuti vengono letti dalla cache a una tariffa più bassa di DeepSeek V4.1 Flash.

Ragionamento nella risposta

Con il ragionamento attivo, il ragionamento torna in reasoning_content accanto alla risposta.

Streaming

Ricevi i token di DeepSeek V4.1 Flash in streaming man mano che arrivano con stream: true.

Modelli correlati

Altri modelli che puoi chiamare con la stessa chiave.

Kimi K3
kimi-k3

Usa Kimi K3 con l'SDK OpenAI o Anthropic: contesto da 1M di token, ragionamento sempre attivo con sforzo low, high o max, prezzi per token in tempo reale e un Playground.

Visualizza i prezzi
claude-fable-5
claude-fable-5

Anthropic

Visualizza i prezzi
claude-fable-5-1
claude-fable-5-1

Anthropic

Visualizza i prezzi
claude-opus-5-5
claude-opus-5-5

Anthropic

Visualizza i prezzi
dreamina-seedance-2-0
dreamina-seedance-2-0

ByteDance

Visualizza i prezzi
dreamina-seedance-2-0-fast
dreamina-seedance-2-0-fast

ByteDance

Visualizza i prezzi

FAQ su DeepSeek V4.1 Flash

Cos'è DeepSeek V4.1 Flash?+

DeepSeek V4.1 Flash è il modello veloce ed economico di DeepSeek, rilasciato il 10 settembre 2026. È un modello mixture-of-experts da 552B parametri con input di immagini nativo, una finestra di contesto da 1M di token e un ragionamento che puoi attivare o disattivare.

Quanto costa DeepSeek V4.1 Flash?+

DeepSeek V4.1 Flash costa $0.24 / 1M di input e $0.96 / 1M di output per 1M di token in fascia di punta (01:00–04:00 e 06:00–10:00 UTC, dal lunedì al venerdì). Tutte le altre ore sono fascia fuori punta, a metà di queste tariffe, e i cache hit costano una frazione dell'input.

Posso usare DeepSeek V4.1 Flash gratis?+

Ogni nuovo account SeedRouter parte con $0.10 di credito gratuito, abbastanza per provare DeepSeek V4.1 Flash con molte richieste brevi. Dopo paghi per token, senza abbonamento, e una richiesta non riuscita non viene addebitata.

DeepSeek V4.1 Flash supporta le immagini?+

Sì. DeepSeek V4.1 Flash legge le immagini in modo nativo. Inviale nella richiesta tramite URL pubblico o in base64; restituisce testo.

Come disattivo il ragionamento in DeepSeek V4.1 Flash?+

Imposta thinking su disabled, oppure reasoning_effort su none. La risposta arriva subito e usa meno token di output.

DeepSeek V4.1 Flash è lo stesso modello di DeepSeek V4 Flash?+

No. DeepSeek V4.1 Flash ha sostituito V4 Flash il 10 settembre 2026, con una nuova architettura e input di immagini nativo. DeepSeek ha ritirato V4 Flash e reindirizza i vecchi nomi del modello a DeepSeek V4.1 Flash.

Posso eseguire DeepSeek V4.1 Flash in locale?+

I suoi pesi sono su Hugging Face. Con 552B parametri richiede hardware multi-GPU, quindi la maggior parte dei team chiama DeepSeek V4.1 Flash tramite un'API.

Qual è l'ID del modello DeepSeek V4.1 Flash e come lo chiamo?+

Su SeedRouter l'ID del modello è deepseek-v4.1-flash. Crea una chiave API SeedRouter, punta l'SDK OpenAI a https://api.seedrouter.ai/v1 e invia deepseek-v4.1-flash come modello.

Mi viene addebitato se una richiesta a DeepSeek V4.1 Flash non riesce?+

No. Una richiesta a DeepSeek V4.1 Flash che restituisce un errore non viene addebitata. Paghi solo i token che una richiesta completata dichiara.

Prova DeepSeek V4.1 Flash adesso

Invia la tua prima richiesta a DeepSeek V4.1 Flash dal Playground o dal tuo codice in pochi minuti.