Claude Opus 5.5 já está disponível no SeedRouter

Preço do GPT-6.1 Sol: tarifas por token, cache e custo real por requisição

Preço do GPT-6.1 Sol explicado: tarifas de entrada, entrada em cache, escrita no cache e saída, a regra de 272K, custos reais por requisição e como economizar.

Ler em Markdown

O GPT-6.1 Sol é cobrado por token. O preço Standard de tabela da OpenAI é $2 por milhão de tokens de entrada e $10 por milhão de tokens de saída, com a entrada em cache a $0,10. Entrada e saída custam um quinto das tarifas do GPT-6 Astra, e a entrada em cache, um décimo. A maior parte de uma conta real vem da saída, porque tokens de raciocínio são cobrados como saída, então o esforço que você escolhe pesa mais que o tamanho do prompt. Um contexto longo e repetido sai barato para reenviar depois que está em cache.

Quanto custa o GPT-6.1 Sol por milhão de tokens?

Preços Standard da OpenAI por milhão de tokens, conferidos em 5 de outubro de 2026 na página de preços:

Tamanho do promptEntradaEntrada em cacheEscrita no cacheSaída
Até 272K tokens de entrada$2,00$0,10$2,50$10,00
Acima de 272K tokens de entrada$4,00$0,20$5,00$15,00

As regras por trás da tabela vêm da página de modelo do GPT-6.1 Sol: a entrada em cache custa 5% da tarifa de entrada, uma escrita no cache custa 1,25 vez a tarifa de entrada, e um prompt com mais de 272K tokens de entrada é cobrado "com 2x as tarifas de entrada e de cache e 1,5x a de saída na requisição inteira".

As tarifas que a sua conta na SeedRouter paga, lidas ao vivo da cobrança:

GPT-6.1 Sol

Current rates are temporarily unavailable. No price estimate is provided; unavailable rates must not be interpreted as free usage.

Não há assinatura. Você recarrega um saldo, o crédito não expira, e uma requisição que falha não é cobrada.

Como uma requisição ao GPT-6.1 Sol é cobrada?

Toda resposta informa o seu usage, e a cobrança segue esses números linha por linha:

  • Entrada: tokens do prompt que não foram lidos do cache nem escritos nele.
  • Entrada em cache: usage.input_tokens_details.cached_tokens, pela tarifa de entrada em cache.
  • Escrita no cache: usage.input_tokens_details.cache_write_tokens, pela tarifa de escrita no cache.
  • Saída: a resposta mais todos os tokens de raciocínio.

A fórmula é (input × input rate + cached × cached rate + cache writes × write rate + output × output rate) / 1,000,000. Se o prompt tiver mais de 272K tokens de entrada, todas as linhas usam a segunda linha da tabela.

O GPT-6.1 Sol gasta tokens rápido?

Pode gastar, com esforço alto. O GPT-6.1 Sol sempre raciocina, e tokens de raciocínio são cobrados como saída mesmo que você nunca os veja. Três prompts foram enviados pela SeedRouter em 5 de outubro de 2026 em cada nível de esforço; os tokens de saída incluem o raciocínio:

Promptlowmediumhighxhighmax
Problema de contagem225187272362574
Problema de contagem mais difícil7111.2731.2551.7632.259
Achar os bugs em uma função de 4 linhas2211943966061.114

Pelos preços de tabela, o problema mais difícil custou cerca de $0,007 em low e $0,023 em max. Todos os níveis deram a resposta certa. Nessas tarefas, max usou de duas vezes e meia a cinco vezes os tokens de low sem um resultado melhor. O guia de esforço de raciocínio traz o teste completo, incluindo o tempo até o primeiro token.

Quanto custa uma carga de trabalho típica?

Quatro exemplos pelos preços de tabela da OpenAI:

Carga de trabalhoTokensCusto
Uma pergunta de programação2.000 de entrada, 1.000 de saída$0,014
Um turno de agente com resumo do repositório em cache50.000 em cache, 2.000 de entrada nova, 3.000 de saída$0,039
O mesmo turno sem o cache52.000 de entrada, 3.000 de saída$0,134
Uma requisição de contexto longo300.000 de entrada, 4.000 de saída$1,26

Para agentes, o cache faz a maior parte do trabalho: o mesmo turno custa cerca de 70% menos quando o prefixo compartilhado é lido do cache. A linha de contexto longo mostra o efeito oposto. Com 300K tokens de entrada, a requisição inteira passa para as tarifas mais altas; a mesma requisição com 270K de entrada custaria $0,58.

Como o preço do GPT-6.1 Sol se compara ao de outros modelos?

Preços oficiais de tabela por milhão de tokens, conferidos em 5 de outubro de 2026:

ModeloEntradaEntrada em cacheSaída
GPT-6.1 Sol$2,00$0,10$10,00
GPT-6 Sol$2,00$0,20$10,00
GPT-6 Astra$10,00$1,00$50,00
Claude Sonnet 5.5$2,00$0,20$10,00
Claude Opus 5.5$4,00$0,20$20,00

Os preços da OpenAI são da sua página de preços; os do Claude, das páginas de modelo da Anthropic para o Sonnet 5.5 e o Opus 5.5. O GPT-6.1 Sol e o Claude Sonnet 5.5 têm o mesmo preço de entrada e de saída, e o GPT-6.1 Sol lê a entrada em cache pela metade da tarifa. A comparação GPT-6.1 Sol vs Claude cobre o resto.

Como pagar menos pelo GPT-6.1 Sol?

  • Escolha o menor esforço que funciona. Comece em medium, teste low para etapas simples e aumente o esforço só nas tarefas que falham.
  • Coloque a parte estável do prompt primeiro. Instruções de sistema, definições de ferramentas e documentos longos no início podem ser lidos do cache nas requisições seguintes por 5% da tarifa de entrada.
  • Fique abaixo de 272K tokens de entrada. Corte ou resuma o histórico antes que um prompt passe do limite, porque a tarifa mais alta vale para a requisição inteira.
  • Limite a saída. max_output_tokens limita o raciocínio mais a resposta, então uma requisição descontrolada não pode custar mais do que você permite.

Perguntas frequentes

Quanto custa o GPT-6.1 Sol?

A OpenAI lista o GPT-6.1 Sol a $2 por milhão de tokens de entrada, $0,10 por milhão de tokens de entrada em cache, $2,50 por milhão de tokens de escrita no cache e $10 por milhão de tokens de saída, para prompts de até 272K tokens de entrada. Prompts maiores são cobrados pelas tarifas mais altas de contexto longo na requisição inteira.

GPT-6.1 Sol é mais barato que GPT-6 Sol?

Só na entrada em cache, que custa metade. Entrada, saída e escrita no cache têm o mesmo preço.

Por que minha conta do GPT-6.1 Sol veio mais alta que o tamanho do prompt?

Tokens de raciocínio são cobrados como saída. Com esforço xhigh ou max, um prompt curto pode gerar milhares de tokens de raciocínio. Confira usage.output_tokens_details.reasoning_tokens na resposta.

O GPT-6.1 Sol está incluído no ChatGPT Plus?

A OpenAI diz que o GPT-6.1 Sol está disponível para usuários Plus, Pro, Business, Enterprise e Edu no ChatGPT Work e no Codex. O uso pela API é cobrado por token, separado de qualquer plano do ChatGPT.

Onde vejo o preço que eu pago?

A página do GPT-6.1 Sol mostra as tarifas ao vivo da SeedRouter, e os seus registros de uso mostram a cobrança exata de cada requisição.

Guias relacionados