Preço do GPT-6.1 Sol: tarifas por token, cache e custo real por requisição
Preço do GPT-6.1 Sol explicado: tarifas de entrada, entrada em cache, escrita no cache e saída, a regra de 272K, custos reais por requisição e como economizar.
Ler em MarkdownO GPT-6.1 Sol é cobrado por token. O preço Standard de tabela da OpenAI é $2 por milhão de tokens de entrada e $10 por milhão de tokens de saída, com a entrada em cache a $0,10. Entrada e saída custam um quinto das tarifas do GPT-6 Astra, e a entrada em cache, um décimo. A maior parte de uma conta real vem da saída, porque tokens de raciocínio são cobrados como saída, então o esforço que você escolhe pesa mais que o tamanho do prompt. Um contexto longo e repetido sai barato para reenviar depois que está em cache.
Quanto custa o GPT-6.1 Sol por milhão de tokens?
Preços Standard da OpenAI por milhão de tokens, conferidos em 5 de outubro de 2026 na página de preços:
| Tamanho do prompt | Entrada | Entrada em cache | Escrita no cache | Saída |
|---|---|---|---|---|
| Até 272K tokens de entrada | $2,00 | $0,10 | $2,50 | $10,00 |
| Acima de 272K tokens de entrada | $4,00 | $0,20 | $5,00 | $15,00 |
As regras por trás da tabela vêm da página de modelo do GPT-6.1 Sol: a entrada em cache custa 5% da tarifa de entrada, uma escrita no cache custa 1,25 vez a tarifa de entrada, e um prompt com mais de 272K tokens de entrada é cobrado "com 2x as tarifas de entrada e de cache e 1,5x a de saída na requisição inteira".
As tarifas que a sua conta na SeedRouter paga, lidas ao vivo da cobrança:
GPT-6.1 Sol
Current rates are temporarily unavailable. No price estimate is provided; unavailable rates must not be interpreted as free usage.
Não há assinatura. Você recarrega um saldo, o crédito não expira, e uma requisição que falha não é cobrada.
Como uma requisição ao GPT-6.1 Sol é cobrada?
Toda resposta informa o seu usage, e a cobrança segue esses números linha por linha:
- Entrada: tokens do prompt que não foram lidos do cache nem escritos nele.
- Entrada em cache:
usage.input_tokens_details.cached_tokens, pela tarifa de entrada em cache. - Escrita no cache:
usage.input_tokens_details.cache_write_tokens, pela tarifa de escrita no cache. - Saída: a resposta mais todos os tokens de raciocínio.
A fórmula é (input × input rate + cached × cached rate + cache writes × write rate + output × output rate) / 1,000,000. Se o prompt tiver mais de 272K tokens de entrada, todas as linhas usam a segunda linha da tabela.
O GPT-6.1 Sol gasta tokens rápido?
Pode gastar, com esforço alto. O GPT-6.1 Sol sempre raciocina, e tokens de raciocínio são cobrados como saída mesmo que você nunca os veja. Três prompts foram enviados pela SeedRouter em 5 de outubro de 2026 em cada nível de esforço; os tokens de saída incluem o raciocínio:
| Prompt | low | medium | high | xhigh | max |
|---|---|---|---|---|---|
| Problema de contagem | 225 | 187 | 272 | 362 | 574 |
| Problema de contagem mais difícil | 711 | 1.273 | 1.255 | 1.763 | 2.259 |
| Achar os bugs em uma função de 4 linhas | 221 | 194 | 396 | 606 | 1.114 |
Pelos preços de tabela, o problema mais difícil custou cerca de $0,007 em low e $0,023 em max. Todos os níveis deram a resposta certa. Nessas tarefas, max usou de duas vezes e meia a cinco vezes os tokens de low sem um resultado melhor. O guia de esforço de raciocínio traz o teste completo, incluindo o tempo até o primeiro token.
Quanto custa uma carga de trabalho típica?
Quatro exemplos pelos preços de tabela da OpenAI:
| Carga de trabalho | Tokens | Custo |
|---|---|---|
| Uma pergunta de programação | 2.000 de entrada, 1.000 de saída | $0,014 |
| Um turno de agente com resumo do repositório em cache | 50.000 em cache, 2.000 de entrada nova, 3.000 de saída | $0,039 |
| O mesmo turno sem o cache | 52.000 de entrada, 3.000 de saída | $0,134 |
| Uma requisição de contexto longo | 300.000 de entrada, 4.000 de saída | $1,26 |
Para agentes, o cache faz a maior parte do trabalho: o mesmo turno custa cerca de 70% menos quando o prefixo compartilhado é lido do cache. A linha de contexto longo mostra o efeito oposto. Com 300K tokens de entrada, a requisição inteira passa para as tarifas mais altas; a mesma requisição com 270K de entrada custaria $0,58.
Como o preço do GPT-6.1 Sol se compara ao de outros modelos?
Preços oficiais de tabela por milhão de tokens, conferidos em 5 de outubro de 2026:
| Modelo | Entrada | Entrada em cache | Saída |
|---|---|---|---|
| GPT-6.1 Sol | $2,00 | $0,10 | $10,00 |
| GPT-6 Sol | $2,00 | $0,20 | $10,00 |
| GPT-6 Astra | $10,00 | $1,00 | $50,00 |
| Claude Sonnet 5.5 | $2,00 | $0,20 | $10,00 |
| Claude Opus 5.5 | $4,00 | $0,20 | $20,00 |
Os preços da OpenAI são da sua página de preços; os do Claude, das páginas de modelo da Anthropic para o Sonnet 5.5 e o Opus 5.5. O GPT-6.1 Sol e o Claude Sonnet 5.5 têm o mesmo preço de entrada e de saída, e o GPT-6.1 Sol lê a entrada em cache pela metade da tarifa. A comparação GPT-6.1 Sol vs Claude cobre o resto.
Como pagar menos pelo GPT-6.1 Sol?
- Escolha o menor esforço que funciona. Comece em
medium, testelowpara etapas simples e aumente o esforço só nas tarefas que falham. - Coloque a parte estável do prompt primeiro. Instruções de sistema, definições de ferramentas e documentos longos no início podem ser lidos do cache nas requisições seguintes por 5% da tarifa de entrada.
- Fique abaixo de 272K tokens de entrada. Corte ou resuma o histórico antes que um prompt passe do limite, porque a tarifa mais alta vale para a requisição inteira.
- Limite a saída.
max_output_tokenslimita o raciocínio mais a resposta, então uma requisição descontrolada não pode custar mais do que você permite.
Perguntas frequentes
Quanto custa o GPT-6.1 Sol?
A OpenAI lista o GPT-6.1 Sol a $2 por milhão de tokens de entrada, $0,10 por milhão de tokens de entrada em cache, $2,50 por milhão de tokens de escrita no cache e $10 por milhão de tokens de saída, para prompts de até 272K tokens de entrada. Prompts maiores são cobrados pelas tarifas mais altas de contexto longo na requisição inteira.
GPT-6.1 Sol é mais barato que GPT-6 Sol?
Só na entrada em cache, que custa metade. Entrada, saída e escrita no cache têm o mesmo preço.
Por que minha conta do GPT-6.1 Sol veio mais alta que o tamanho do prompt?
Tokens de raciocínio são cobrados como saída. Com esforço xhigh ou max, um prompt curto pode gerar milhares de tokens de raciocínio. Confira usage.output_tokens_details.reasoning_tokens na resposta.
O GPT-6.1 Sol está incluído no ChatGPT Plus?
A OpenAI diz que o GPT-6.1 Sol está disponível para usuários Plus, Pro, Business, Enterprise e Edu no ChatGPT Work e no Codex. O uso pela API é cobrado por token, separado de qualquer plano do ChatGPT.
Onde vejo o preço que eu pago?
A página do GPT-6.1 Sol mostra as tarifas ao vivo da SeedRouter, e os seus registros de uso mostram a cobrança exata de cada requisição.



