Prezzi dell'API di Claude Fable 5.1, Fable 5 e Opus 5.5: costo per milione di token
Prezzi dell'API di Claude per milione di token: tariffe input/output, prompt cache, fatturazione e quale modello costa meno.
Leggi in MarkdownClaude Fable 5.1, Claude Fable 5 e Claude Opus 5.5 sono fatturate per token su SeedRouter, con tariffe separate per input, output e le due operazioni di prompt cache. Claude Opus 5.5 è il più economico dei tre per token. Claude Fable 5.1 e Claude Fable 5 hanno lo stesso prezzo per input e output, ma Fable 5.1 legge la cache del prompt a un quarto della tariffa di lettura cache di Fable 5. Non c'è alcun abbonamento e una richiesta che fallisce non viene addebitata.
Le tabelle qui sotto sono lette dalla tabella delle tariffe che fattura il tuo account, quindi mostrano cosa costa una richiesta oggi.
Quanto costano Claude Fable 5.1, Fable 5 e Opus 5.5 per milione di token?
Claude Fable 5.1
Current rates are temporarily unavailable. No price estimate is provided; unavailable rates must not be interpreted as free usage.
Claude Fable 5
Current rates are temporarily unavailable. No price estimate is provided; unavailable rates must not be interpreted as free usage.
Claude Opus 5.5
Current rates are temporarily unavailable. No price estimate is provided; unavailable rates must not be interpreted as free usage.
Ogni modello ha una tabella. Input e output sono le tariffe di base. "Output" include il ragionamento del modello, perché i token di ragionamento sono token di output. Le colonne della cache si applicano solo quando usi il prompt caching. Se non è possibile caricare una tariffa, la tabella lo segnala invece di mostrare zero; consideralo sconosciuto, mai gratuito.
Per riferimento, questo è come Anthropic struttura i suoi prezzi nella lista sulla propria API, dalla pagina dei prezzi di Claude al 27 settembre 2026. Ogni riga è un multiplo della propria tariffa di input del modello:
| Modello | Input | Output | Scrittura cache, 5 min | Scrittura cache, 1 ora | Lettura cache |
|---|---|---|---|---|---|
| Claude Fable 5.1 | 1× | 5× | 1,25× | 2× | 0,025× |
| Claude Fable 5 | 1× | 5× | 1,25× | 2× | 0,1× |
| Claude Opus 5.5 | 1× | 5× | 1,25× | 2× | 0,05× |
In quella lista, Claude Fable 5.1 e Claude Fable 5 condividono una tariffa di input, e la tariffa di input di Claude Opus 5.5 è il 40% di quella.
Come viene fatturata una richiesta Claude?
Ogni risposta contiene un oggetto usage, e l'addebito è calcolato da esso, non dal tuo max_tokens:
cost = ( input_tokens × input rate
+ output_tokens × output rate
+ cache_read_input_tokens × cache-read rate
+ 5-minute cache writes × 5-minute write rate
+ 1-hour cache writes × 1-hour write rate ) / 1,000,000Nel formato Messages, i due tipi di scritture della cache sono riportati separatamente in usage.cache_creation.ephemeral_5m_input_tokens e usage.cache_creation.ephemeral_1h_input_tokens.
max_tokens è solo un limite massimo. Una richiesta con max_tokens: 32000 che scrive 900 token paga per 900.
Quale modello Claude è il più economico per il mio carico di lavoro?
| Carico di lavoro | Opzione più economica | Perché |
|---|---|---|
| La maggior parte del coding e del lavoro intellettuale | Claude Opus 5.5 | Tariffe di input e output più basse; Anthropic suggerisce di iniziare da qui |
| Ragionamento profondo, esecuzioni di agenti lunghe | Claude Fable 5.1 | Stesse tariffe di input e output di Fable 5, letture cache più economiche |
| Codice esistente che forza una chiamata agli strumenti | Claude Fable 5 | L'unico dei tre che accetta un tool_choice forzato |
| Prompt lunghi condivisi inviati molte volte | Claude Opus 5.5 o Fable 5.1 | Letture cache al 5% e al 2,5% della tariffa di input |
La stessa chiave di SeedRouter chiama tutti e tre, quindi il passaggio è un cambio a model. La guida Claude Fable 5.1 vs Fable 5 vs Opus 5.5 copre cosa altro cambia tra loro.
Quanto fa risparmiare il prompt caching?
Il caching conviene quando lo stesso lungo prefisso, come un prompt di sistema, una base di codice o un documento, viene inviato ancora e ancora. La prima richiesta scrive il prefisso nella cache, il che costa più dell'input semplice. Le richieste successive lo leggono indietro a una piccola frazione della tariffa di input.
Nella lista di Anthropic, una scrittura di 5 minuti costa 1,25 volte la tariffa di input e una scrittura di 1 ora costa 2 volte. Una lettura della cache costa il 2,5% della tariffa di input su Claude Fable 5.1, il 5% su Claude Opus 5.5 e il 10% su Claude Fable 5. Le colonne della cache nelle tabelle qui sopra sono le proprie tariffe di SeedRouter per le stesse cinque righe.
Con questi rapporti una scrittura di 5 minuti si ripaga la prima volta che il prefisso viene letto indietro, e una scrittura di 1 ora dalla seconda lettura. Usa la scrittura di 1 ora quando le richieste sono più di cinque minuti di distanza. Per attivare il caching, aggiungi cache_control alla richiesta come descritto nella referenza dell'API di Claude Opus 5.5.
L'impostazione dell'effort cambia il prezzo?
Non la tariffa, ma il conto. L'effort (output_config.effort: low, medium, high, xhigh o max) decide quanto il modello ragiona, e il ragionamento viene addebitato come output. La stessa domanda a low di solito costa meno che a max. Claude Fable 5.1 e Claude Fable 5 di default sono high; Claude Opus 5.5 di default è medium.
Il ragionamento non può essere disattivato su questi tre modelli, solo ridotto. Se un compito è semplice, ridurre l'effort è il modo più diretto per ridurre il costo.
Un abbonamento Claude Pro o Max è lo stesso dell'accesso all'API?
No. L'articolo di supporto di Anthropic è esplicito: "Un abbonamento Claude a pagamento migliora la tua esperienza di chat ma non include l'accesso all'API di Claude o Console" (fonte). Pro e Max coprono le app Claude. Le chiamate all'API vengono fatturate per token, separatamente.
Su SeedRouter c'è solo il lato per token. Ricarichi una sola volta nella pagina di fatturazione, i crediti non scadono mai e ogni richiesta finita viene detratta da quel saldo. Lo stesso saldo paga per ogni modello nel catalogo.
Domande frequenti
Quanto costano 1 milione di token Claude?
Dipende dal modello e dal fatto che i token siano input o output. L'output costa cinque volte l'input su tutti e tre i modelli. Le tabelle dal vivo qui sopra danno la tariffa per ciascuno, e la riga di Claude Opus 5.5 è la più bassa.
Claude Opus 5.5 è più economico di Claude Fable 5.1?
Sì, su ogni riga della tabella. Nella lista di Anthropic, le tariffe di input e output di Claude Opus 5.5 sono il 40% di quelle di Claude Fable 5.1, e le tariffe di SeedRouter qui sopra mantengono quell'ordine.
Claude Opus 5.5 è più economico di Claude Opus 5?
Nella lista di Anthropic, sì: le sue tariffe di input e output sono il 20% al di sotto di quelle di Claude Opus 5, e le letture cache sono il 60% al di sotto. SeedRouter non vende Claude Opus 5.
Un prompt lungo costa di più per token?
No. Anthropic fattura l'intera finestra di contesto da 1M token di questi modelli alla tariffa standard: la sua pagina dei prezzi dice "una richiesta da 900k token viene fatturata alla stessa tariffa per token di una richiesta da 9k token". Un prompt lungo costa di più solo perché ha più token.
Sono disponibili sconti dell'API Batch o modalità veloce?
No su SeedRouter. Le richieste vengono eseguite attraverso gli endpoint Messages, Chat Completions e Responses standard e vengono fatturate alle tariffe nelle tabelle qui sopra.
Dove posso vedere quanto è costata una richiesta?
Nella storia di utilizzo, richiesta per richiesta. La risposta stessa della richiesta riporta i conteggi di token in usage ma nessun importo in dollari.
Calcola il prezzo prima di inviare
Inizia con Claude Opus 5.5, sposta un compito a Claude Fable 5.1 solo quando ha bisogno di un ragionamento più profondo, e fai la cache di qualsiasi prefisso che invii più di una volta. Controlla le tabelle dal vivo qui sopra prima di un grande lavoro, ricarica nella pagina di fatturazione, e vedi le pagine di Claude Fable 5.1, Claude Fable 5 e Claude Opus 5.5 per provare ogni modello nel browser.



