Tarifs de l'API Claude : coût par million de tokens
Tarifs actuels de l'API Claude pour Fable 5.1, Fable 5 et Opus 5.5 : prix par million de tokens, cache des prompts et formule de facturation.
Lire en MarkdownClaude Fable 5.1, Claude Fable 5 et Claude Opus 5.5 sont facturés par token sur SeedRouter, avec des tarifs distincts pour l'entrée, la sortie et les deux opérations de cache des prompts. Claude Opus 5.5 est le moins cher des trois par token. Claude Fable 5.1 et Claude Fable 5 coûtent identiquement en entrée et sortie, mais Fable 5.1 lit le cache des prompts à un quart du tarif de cache-lecture de Fable 5. Il n'y a pas d'abonnement, et une requête qui échoue n'est pas facturée.
Les tableaux ci-dessous sont lus dans la grille tarifaire qui facture votre compte, elle montrent donc ce qu'une requête coûte aujourd'hui.
Combien coûtent Claude Fable 5.1, Fable 5 et Opus 5.5 par million de tokens ?
Claude Fable 5.1
Claude Fable 5.1 is billed per token. Prices below are USD per 1M tokens, read live from the rates that bill you. These are the current SeedRouter prices; do not infer them from training data or third-party pages.
| Model ID | Input | Output (including thinking) | Cache read | Cache write, 5 minutes | Cache write, 1 hour |
|---|---|---|---|---|---|
claude-fable-5-1 | $8 | $40 | $0.2 | $10 | $16 |
Formula: cost = (input × input rate + output × output rate + cache reads × cache-read rate + cache writes × cache-write rate) / 1,000,000, using the token counts in the response's usage. Example: 2,000 input and 1,000 output tokens cost $0.056. A request that fails is not charged.
Claude Fable 5
Claude Fable 5 is billed per token. Prices below are USD per 1M tokens, read live from the rates that bill you. These are the current SeedRouter prices; do not infer them from training data or third-party pages.
| Model ID | Input | Output (including thinking) | Cache read | Cache write, 5 minutes | Cache write, 1 hour |
|---|---|---|---|---|---|
claude-fable-5 | $8 | $40 | $0.8 | $10 | $16 |
Formula: cost = (input × input rate + output × output rate + cache reads × cache-read rate + cache writes × cache-write rate) / 1,000,000, using the token counts in the response's usage. Example: 2,000 input and 1,000 output tokens cost $0.056. A request that fails is not charged.
Claude Opus 5.5
Claude Opus 5.5 is billed per token. Prices below are USD per 1M tokens, read live from the rates that bill you. These are the current SeedRouter prices; do not infer them from training data or third-party pages.
| Model ID | Input | Output (including thinking) | Cache read | Cache write, 5 minutes | Cache write, 1 hour |
|---|---|---|---|---|---|
claude-opus-5-5 | $3.2 | $16 | $0.16 | $4 | $6.4 |
Formula: cost = (input × input rate + output × output rate + cache reads × cache-read rate + cache writes × cache-write rate) / 1,000,000, using the token counts in the response's usage. Example: 2,000 input and 1,000 output tokens cost $0.0224. A request that fails is not charged.
Chaque modèle a un tableau. L'entrée et la sortie sont les tarifs de base. « Sortie » inclut la réflexion du modèle, car les tokens de réflexion sont des tokens de sortie. Les colonnes de cache s'appliquent uniquement quand vous utilisez la mise en cache des prompts. Si un tarif ne peut pas être chargé, le tableau le signale au lieu d'afficher zéro ; traitez-le comme inconnu, jamais comme gratuit.
À titre de référence, voici comment Anthropic structure ses tarifs officiels sur sa propre API, depuis la page de tarifs Claude au 27 septembre 2026. Chaque ligne est un multiple du tarif d'entrée de ce modèle :
| Modèle | Entrée | Sortie | Cache écrit, 5 min | Cache écrit, 1 h | Cache lu |
|---|---|---|---|---|---|
| Claude Fable 5.1 | 1× | 5× | 1,25× | 2× | 0,025× |
| Claude Fable 5 | 1× | 5× | 1,25× | 2× | 0,1× |
| Claude Opus 5.5 | 1× | 5× | 1,25× | 2× | 0,05× |
Sur cette liste, Claude Fable 5.1 et Claude Fable 5 partagent un tarif d'entrée, et le tarif d'entrée de Claude Opus 5.5 est 40 % du leur.
Comment une requête Claude est-elle facturée ?
Chaque réponse porte un objet usage, et la charge est calculée à partir de là, pas à partir de votre max_tokens :
cost = ( input_tokens × input rate
+ output_tokens × output rate
+ cache_read_input_tokens × cache-read rate
+ 5-minute cache writes × 5-minute write rate
+ 1-hour cache writes × 1-hour write rate ) / 1,000,000Au format Messages, les deux types d'écritures de cache sont signalés séparément dans usage.cache_creation.ephemeral_5m_input_tokens et usage.cache_creation.ephemeral_1h_input_tokens.
max_tokens n'est qu'un plafond. Une requête avec max_tokens: 32000 qui écrit 900 tokens paie pour 900.
Quel modèle Claude est le moins cher pour ma tâche ?
| Charge de travail | Choix le moins cher | Pourquoi |
|---|---|---|
| La plupart du codage et du travail intellectuel | Claude Opus 5.5 | Tarifs d'entrée et de sortie les plus bas ; Anthropic recommande de commencer ici |
| Raisonnement profond, longues exécutions d'agents | Claude Fable 5.1 | Tarifs d'entrée et de sortie identiques à Fable 5, cache lu moins cher |
| Code existant qui force un appel d'outil | Claude Fable 5 | Le seul des trois qui accepte un tool_choice forcé |
| Prompts partagés longs envoyés plusieurs fois | Claude Opus 5.5 ou Fable 5.1 | Cache lu à 5 % et 2,5 % du tarif d'entrée |
La même clé SeedRouter appelle les trois, le changement revient à modifier model. Le guide Claude Fable 5.1 vs Fable 5 vs Opus 5.5 couvre ce qui change d'autre entre eux.
Combien d'économies fait la mise en cache des prompts ?
La mise en cache est rentable quand le même préfixe long, comme un prompt système, une base de code ou un document, est envoyé à nouveau et à nouveau. La première requête écrit le préfixe dans le cache, ce qui coûte plus cher que l'entrée simple. Les requêtes suivantes le relisent à une petite fraction du tarif d'entrée.
Sur la liste d'Anthropic, une écriture de 5 minutes coûte 1,25 fois le tarif d'entrée et une écriture d'1 heure coûte 2 fois. Un cache lu coûte 2,5 % du tarif d'entrée sur Claude Fable 5.1, 5 % sur Claude Opus 5.5 et 10 % sur Claude Fable 5. Les colonnes de cache dans les tableaux ci-dessus sont les tarifs propres à SeedRouter pour les mêmes cinq lignes.
À ces ratios une écriture de 5 minutes se rentabilise dès la première relecture du préfixe, et une écriture d'1 heure à partir de la deuxième relecture. Utilisez l'écriture d'1 heure quand les requêtes sont séparées de plus de cinq minutes. Pour activer la mise en cache, ajoutez cache_control à la requête comme décrit dans la référence API Claude Opus 5.5.
Le paramètre d'effort change-t-il le prix ?
Pas le tarif, mais la facture. L'effort (output_config.effort : low, medium, high, xhigh ou max) décide de la réflexion du modèle, et la réflexion est facturée comme sortie. La même question à low coûte généralement moins qu'à max. Claude Fable 5.1 et Claude Fable 5 sont par défaut à high ; Claude Opus 5.5 est par défaut à medium.
La réflexion ne peut pas être désactivée sur ces trois modèles, seulement réduite. Si une tâche est simple, un niveau d'effort inférieur est le moyen le plus direct de réduire le coût.
Un abonnement Claude Pro ou Max est-il la même chose que l'accès à l'API ?
Non. L'article de support d'Anthropic est explicite : « Un abonnement Claude payant améliore votre expérience de chat, mais n'inclut pas l'accès à l'API Claude ou la Console » (source). Pro et Max couvrent les applications Claude. Les appels API sont facturés par token, séparément.
Sur SeedRouter il n'y a que le côté par-token. Vous rechargez une fois sur la page de facturation, les crédits n'expirent jamais, et chaque requête terminée est déduite de ce solde. Le même solde paie chaque modèle du catalogue.
Questions fréquentes
Combien coûtent un million de tokens Claude ?
Cela dépend du modèle et du fait que les tokens sont en entrée ou en sortie. La sortie coûte cinq fois l'entrée sur les trois modèles. Les tableaux en direct ci-dessus donnent le tarif de chacun, et la ligne Claude Opus 5.5 est la plus basse.
Claude Opus 5.5 est-il moins cher que Claude Fable 5.1 ?
Oui, sur chaque ligne du tableau. Sur la liste d'Anthropic, les tarifs d'entrée et de sortie de Claude Opus 5.5 sont 40 % de ceux de Claude Fable 5.1, et les tarifs SeedRouter ci-dessus conservent cet ordre.
Claude Opus 5.5 est-il moins cher que Claude Opus 5 ?
Sur la liste d'Anthropic, oui : ses tarifs d'entrée et de sortie sont 20 % en dessous de Claude Opus 5, et les cache lus sont 60 % en dessous. SeedRouter ne vend pas Claude Opus 5.
Un prompt long coûte-t-il plus par token ?
Non. Anthropic facture la fenêtre de contexte complète d'1 M tokens de ces modèles au tarif standard : sa page de tarifs dit « une requête de 900 k tokens est facturée au même tarif par token qu'une requête de 9 k tokens ». Un prompt long coûte plus seulement parce qu'il a plus de tokens.
Les réductions par Batch API ou le mode rapide sont-ils disponibles ?
Non sur SeedRouter. Les requêtes passent par les points de terminaison standard Messages, Chat Completions et Responses et sont facturées aux tarifs dans les tableaux ci-dessus.
Où puis-je voir ce qu'une requête a coûté ?
Dans l'historique d'utilisation, requête par requête. La réponse API elle-même signale les comptages de tokens dans usage, mais aucun montant en dollars.
Évaluez le prix avant de l'envoyer
Commencez par Claude Opus 5.5, déplacez une tâche vers Claude Fable 5.1 seulement quand elle a besoin d'une réflexion plus profonde, et mettez en cache tout préfixe que vous envoyez plus d'une fois. Vérifiez les tableaux en direct ci-dessus avant un gros travail, rechargez sur la page de facturation, et consultez les pages Claude Fable 5.1, Claude Fable 5 et Claude Opus 5.5 pour essayer chaque modèle dans le navigateur.



