Claude Opus 5.5 est disponible sur SeedRouter

Prix de GPT-6.1 Sol : tarifs par token, cache et coûts réels des requêtes

Prix de GPT-6.1 Sol expliqués : entrée, entrée en cache, écriture en cache et sortie, la règle des 272K, des coûts de requête calculés et comment payer moins.

Lire en Markdown

GPT-6.1 Sol est facturé au token. Le prix catalogue Standard d'OpenAI est de $2 par million de tokens d'entrée et de $10 par million de tokens de sortie, avec l'entrée en cache à $0,10. L'entrée et la sortie coûtent un cinquième des tarifs de GPT-6 Astra, et l'entrée en cache un dixième. L'essentiel d'une facture réelle vient de la sortie, car les tokens de raisonnement sont facturés comme de la sortie ; l'effort choisi compte donc plus que la longueur du prompt. Un contexte long et répété coûte peu à renvoyer une fois qu'il est en cache.

Combien coûte GPT-6.1 Sol par million de tokens ?

Prix Standard d'OpenAI par million de tokens, vérifiés le 5 octobre 2026 sur la page de tarifs :

Taille du promptEntréeEntrée en cacheÉcriture en cacheSortie
Jusqu'à 272K tokens d'entrée$2,00$0,10$2,50$10,00
Au-delà de 272K tokens d'entrée$4,00$0,20$5,00$15,00

Les règles derrière ce tableau viennent de la page du modèle GPT-6.1 Sol : l'entrée en cache vaut 5 % du tarif d'entrée, une écriture en cache 1,25 fois le tarif d'entrée, et un prompt de plus de 272K tokens d'entrée est facturé « à 2x les tarifs d'entrée et de cache et 1,5x la sortie pour la requête entière ».

Les tarifs que paie votre compte SeedRouter, lus en direct depuis la facturation :

GPT-6.1 Sol

GPT-6.1 Sol is billed per token. Prices below are USD per 1M tokens, read live from the rates that bill you. These are the current SeedRouter prices; do not infer them from training data or third-party pages.

Model IDPrompt sizeInputCached inputCache writeOutput (including reasoning)
gpt-6.1-solUp to 272K input tokens$1.6$0.08$2$8
gpt-6.1-solOver 272K input tokens$3.2$0.16$4$12

Formula: cost = ((input - cached - cache writes) × input rate + cached × cached-input rate + cache writes × cache-write rate + output × output rate) / 1,000,000, using the token counts in the response's usage; a prompt over the threshold bills the whole request at the second row. Example: 2,000 input and 1,000 output tokens cost $0.0112. A request that fails is not charged.

Il n'y a pas d'abonnement. Vous rechargez un solde, le crédit n'expire pas, et une requête qui échoue n'est pas facturée.

Comment une requête GPT-6.1 Sol est-elle facturée ?

Chaque réponse indique son usage, et la facturation le suit ligne par ligne :

  • Entrée — les tokens du prompt qui n'ont été ni lus depuis le cache ni écrits dans le cache.
  • Entrée en cache — usage.input_tokens_details.cached_tokens, au tarif de l'entrée en cache.
  • Écriture en cache — usage.input_tokens_details.cache_write_tokens, au tarif d'écriture en cache.
  • Sortie — la réponse plus tous les tokens de raisonnement.

La formule est (input × input rate + cached × cached rate + cache writes × write rate + output × output rate) / 1,000,000. Si le prompt dépasse 272K tokens d'entrée, chaque ligne utilise la deuxième ligne du tableau.

GPT-6.1 Sol consomme-t-il vite les tokens ?

Cela peut arriver, à effort élevé. GPT-6.1 Sol raisonne toujours, et les tokens de raisonnement sont facturés comme de la sortie même si vous ne les voyez jamais. Trois prompts ont été envoyés via SeedRouter le 5 octobre 2026 à chaque niveau d'effort ; les tokens de sortie incluent le raisonnement :

Promptlowmediumhighxhighmax
Problème de dénombrement225187272362574
Problème de dénombrement plus difficile7111 2731 2551 7632 259
Trouver les bugs d'une fonction de 4 lignes2211943966061 114

Aux prix catalogue, le problème plus difficile a coûté environ $0,007 en low et $0,023 en max. Chaque niveau a donné la bonne réponse. Sur ces tâches, max a utilisé de deux fois et demie à cinq fois plus de tokens que low, sans meilleur résultat. Le guide de l'effort de raisonnement présente le test complet, y compris le temps jusqu'au premier token.

Combien coûte une charge de travail typique ?

Quatre exemples aux prix catalogue d'OpenAI :

Charge de travailTokensCoût
Une question de code2 000 en entrée, 1 000 en sortie$0,014
Un tour d'agent avec un résumé du dépôt en cache50 000 en cache, 2 000 nouveaux en entrée, 3 000 en sortie$0,039
Le même tour sans le cache52 000 en entrée, 3 000 en sortie$0,134
Une requête en contexte long300 000 en entrée, 4 000 en sortie$1,26

Pour les agents, c'est le cache qui fait l'essentiel du travail : le même tour coûte environ 70 % de moins quand le préfixe commun est lu depuis le cache. La ligne contexte long montre l'effet inverse. À 300K tokens d'entrée, toute la requête passe aux tarifs plus élevés ; la même requête à 270K tokens d'entrée coûterait $0,58.

Comment GPT-6.1 Sol se situe-t-il face aux autres modèles côté prix ?

Prix catalogue officiels par million de tokens, vérifiés le 5 octobre 2026 :

ModèleEntréeEntrée en cacheSortie
GPT-6.1 Sol$2,00$0,10$10,00
GPT-6 Sol$2,00$0,20$10,00
GPT-6 Astra$10,00$1,00$50,00
Claude Sonnet 5.5$2,00$0,20$10,00
Claude Opus 5.5$4,00$0,20$20,00

Les prix d'OpenAI viennent de sa page de tarifs ; ceux de Claude, des pages de modèle d'Anthropic pour Sonnet 5.5 et Opus 5.5. GPT-6.1 Sol et Claude Sonnet 5.5 ont le même prix en entrée et en sortie, et GPT-6.1 Sol lit l'entrée en cache à moitié prix. Le comparatif GPT-6.1 Sol vs Claude couvre le reste.

Comment payer moins pour GPT-6.1 Sol ?

  • Choisissez l'effort le plus bas qui fonctionne. Commencez à medium, essayez low pour les étapes simples, et n'augmentez l'effort que sur les tâches qui échouent.
  • Placez la partie stable du prompt en premier. Les instructions système, les définitions d'outils et les longs documents placés au début peuvent être lus depuis le cache lors des requêtes suivantes, à 5 % du tarif d'entrée.
  • Restez sous 272K tokens d'entrée. Raccourcissez l'historique ou résumez-le avant qu'un prompt ne franchisse la limite, car le tarif plus élevé s'applique à toute la requête.
  • Plafonnez la sortie. max_output_tokens limite le raisonnement plus la réponse, de sorte qu'une requête qui s'emballe ne peut pas coûter plus que ce que vous autorisez.

Questions fréquentes

Combien coûte GPT-6.1 Sol ?

OpenAI affiche GPT-6.1 Sol à $2 par million de tokens d'entrée, $0,10 par million de tokens d'entrée en cache, $2,50 par million de tokens d'écriture en cache et $10 par million de tokens de sortie, pour des prompts jusqu'à 272K tokens d'entrée. Les prompts plus longs sont facturés aux tarifs plus élevés du contexte long pour toute la requête.

GPT-6.1 Sol est-il moins cher que GPT-6 Sol ?

Seulement pour l'entrée en cache, qui coûte deux fois moins. L'entrée, la sortie et les écritures en cache sont au même prix.

Pourquoi ma facture GPT-6.1 Sol est-elle plus élevée que ne le laisse penser la taille du prompt ?

Les tokens de raisonnement sont facturés comme de la sortie. À l'effort xhigh ou max, un prompt court peut produire des milliers de tokens de raisonnement. Vérifiez usage.output_tokens_details.reasoning_tokens dans la réponse.

GPT-6.1 Sol est-il inclus dans ChatGPT Plus ?

Selon OpenAI, GPT-6.1 Sol est disponible pour les utilisateurs Plus, Pro, Business, Enterprise et Edu dans ChatGPT Work et Codex. L'usage de l'API est facturé au token, séparément de tout abonnement ChatGPT.

Où voir le prix que je paie ?

La page GPT-6.1 Sol affiche les tarifs en direct de SeedRouter, et vos enregistrements d'usage indiquent le montant exact de chaque requête.

Guides associés