Claude Opus 5.5 est disponible sur SeedRouter

Tarifs de l'API GPT-6 : prix d'Astra, Sol et Luna par million de tokens

Tarifs API GPT-6 pour Astra, Sol et Luna par million de tokens : entrée, sortie, cache, écritures de cache et tarif contexte long au-delà de 272K, exemples.

Lire en Markdown

GPT-6 Astra, GPT-6 Sol et GPT-6 Luna sont facturés au token sur SeedRouter, avec des tarifs distincts pour l'entrée, la sortie, l'entrée en cache et les écritures de cache. GPT-6 Luna est le moins cher, GPT-6 Astra le plus cher, et GPT-6 Sol se situe entre les deux. Un prompt de plus de 272K tokens d'entrée est facturé à un tarif contexte long plus élevé pour toute la requête. Il n'y a pas d'abonnement, et une requête qui échoue n'est pas facturée.

Les tableaux ci-dessous sont lus dans la grille tarifaire qui facture votre compte : ils montrent donc ce que coûte une requête aujourd'hui.

Quel est le prix de GPT-6 Astra, Sol et Luna par million de tokens ?

GPT-6 Astra

Current rates are temporarily unavailable. No price estimate is provided; unavailable rates must not be interpreted as free usage.

GPT-6 Sol

Current rates are temporarily unavailable. No price estimate is provided; unavailable rates must not be interpreted as free usage.

GPT-6 Luna

Current rates are temporarily unavailable. No price estimate is provided; unavailable rates must not be interpreted as free usage.

Chaque tableau comporte deux lignes : les prompts jusqu'à 272K tokens d'entrée, et ceux qui dépassent ce seuil. La sortie inclut les tokens de raisonnement que le modèle consomme avant de répondre.

Quels sont les prix catalogue d'OpenAI ?

À titre de référence, voici la structure des prix Standard d'OpenAI, tirée de sa page de tarifs. Chaque ligne est un multiple du tarif d'entrée du modèle concerné, et les trois modèles partagent la même structure :

LigneGPT-6 AstraGPT-6 SolGPT-6 Luna
Entrée1×1×1×
Entrée en cache0,1×0,1×0,1×
Écritures de cache1,25×1,25×1,25×
Sortie5×5×5×

D'un modèle à l'autre, le tarif d'entrée de GPT-6 Astra vaut cinq fois celui de GPT-6 Sol, et celui de GPT-6 Sol vingt fois celui de GPT-6 Luna. Au-delà de 272K tokens d'entrée, OpenAI facture 2x les tarifs d'entrée et de cache et 1,5x le tarif de sortie « pour la requête entière ». Les tableaux en direct ci-dessus montrent les tarifs de SeedRouter pour chaque ligne.

Comment une requête GPT-6 est-elle facturée ?

Chaque réponse indique ses nombres de tokens dans usage, et la facturation les suit :

  • input_tokens : le prompt entier, y compris la partie en cache ou écrite en cache.
  • input_tokens_details.cached_tokens : les tokens du prompt lus depuis le cache, facturés au tarif d'entrée en cache.
  • input_tokens_details.cache_write_tokens : les tokens du prompt écrits dans le cache, facturés au tarif d'écriture de cache.
  • output_tokens : la réponse plus le raisonnement, facturés au tarif de sortie.

Le coût d'une requête est donc :

cost = ((input − cached − cache writes) × input rate
      + cached × cached-input rate
      + cache writes × cache-write rate
      + output × output rate) / 1,000,000

Si le prompt dépasse 272K tokens d'entrée, chaque ligne utilise les tarifs contexte long.

Combien coûte une requête typique ?

Prenons une requête avec 2 000 tokens d'entrée et 1 000 tokens de sortie. Son coût vaut 2 000 fois le tarif d'entrée plus 1 000 fois le tarif de sortie, divisé par 1 000 000. Comme la sortie coûte cinq fois l'entrée sur les trois modèles, la partie sortie de cette requête coûte deux fois et demie la partie entrée, quel que soit le modèle choisi. La même requête sur GPT-6 Sol coûte un cinquième de GPT-6 Astra et vingt fois GPT-6 Luna.

C'est le raisonnement qui fait le plus varier la partie sortie. Un effort plus élevé consomme généralement plus de tokens de raisonnement pour la même question : pour GPT-6 Sol et GPT-6 Luna, essayez d'abord none ou low et n'augmentez l'effort que là où les réponses l'exigent.

Comment payer GPT-6 moins cher ?

  • Choisissez le plus petit modèle qui passe vos tests. GPT-6 Luna coûte un vingtième de GPT-6 Sol, et GPT-6 Sol un cinquième de GPT-6 Astra.
  • Baissez l'effort. Les tokens de raisonnement sont des tokens de sortie. GPT-6 Sol et GPT-6 Luna acceptent none, qui supprime le raisonnement.
  • Réutilisez le préfixe de votre prompt. L'entrée en cache coûte 10 % du tarif d'entrée. Placez les instructions, les outils et les documents de référence au début, sans les modifier d'une requête à l'autre.
  • Restez sous 272K tokens d'entrée. Au-delà, c'est toute la requête, et pas seulement la partie excédentaire, qui passe au tarif supérieur.
  • Plafonnez la sortie. max_output_tokens limite ensemble la réponse et le raisonnement ; la plus petite valeur acceptée est 16.

GPT-6 est-il gratuit ?

Pas dans l'API. Sur SeedRouter, chaque nouveau compte démarre avec un petit solde gratuit, de quoi faire quelques requêtes de test sur GPT-6 Sol ou beaucoup sur GPT-6 Luna, et une requête qui échoue n'est jamais facturée. Dans ChatGPT, OpenAI indique que les utilisateurs Free et Go peuvent utiliser GPT-6 Luna dans l'application de bureau ; les forfaits ChatGPT sont facturés séparément de l'API.

Questions fréquentes

Combien coûte GPT-6 Astra ?

GPT-6 Astra est le modèle GPT-6 le plus cher : d'après les prix catalogue d'OpenAI, ses tarifs valent cinq fois ceux de GPT-6 Sol sur chaque ligne, avec une sortie à cinq fois l'entrée. Le tableau en haut de cette page indique le tarif que paie votre compte SeedRouter.

Combien coûte GPT-6 Sol ?

D'après les prix catalogue d'OpenAI, GPT-6 Sol coûte un cinquième de GPT-6 Astra et la moitié du prix promotionnel de GPT-5.6 Sol ; le tableau en haut de page indique le tarif que vous payez. Le guide GPT-6 vs GPT-5.6 compare les deux générations ligne par ligne.

Les tokens de raisonnement sont-ils facturés ?

Oui, comme tokens de sortie. usage.output_tokens_details.reasoning_tokens indique combien de tokens de sortie correspondent au raisonnement.

Y a-t-il un abonnement mensuel ?

Non. Vous rechargez votre solde une fois et le dépensez à la requête sur n'importe quel modèle. Le solde n'expire pas.

Vérifiez le coût sur votre propre prompt

Envoyez un prompt dans le playground GPT-6 Sol, le playground GPT-6 Luna ou le playground GPT-6 Astra. Chaque réponse affiche ses nombres de tokens et son coût, facturés exactement comme un appel API.

Guides associés