Claude Opus 5.5 já está disponível no SeedRouter

Preço da API do GPT-6: quanto custam Astra, Sol e Luna por milhão de tokens

Preço da API do GPT-6 Astra, Sol e Luna por milhão de tokens: entrada, saída, leitura e escrita em cache e a tarifa acima de 272K tokens, com exemplos.

Ler em Markdown

O GPT-6 Astra, o GPT-6 Sol e o GPT-6 Luna são cobrados por token na SeedRouter, com tarifas separadas para entrada, saída, entrada em cache e escrita em cache. O GPT-6 Luna é o mais barato, o GPT-6 Astra o mais caro, e o GPT-6 Sol fica entre os dois. Um prompt com mais de 272K tokens de entrada é cobrado por uma tarifa de contexto longo mais alta na solicitação inteira. Não há assinatura, e uma solicitação que falha não é cobrada.

As tabelas abaixo são lidas da tabela de tarifas que cobra a sua conta, então mostram quanto uma solicitação custa hoje.

Quanto custam GPT-6 Astra, Sol e Luna por milhão de tokens?

GPT-6 Astra

Current rates are temporarily unavailable. No price estimate is provided; unavailable rates must not be interpreted as free usage.

GPT-6 Sol

Current rates are temporarily unavailable. No price estimate is provided; unavailable rates must not be interpreted as free usage.

GPT-6 Luna

Current rates are temporarily unavailable. No price estimate is provided; unavailable rates must not be interpreted as free usage.

Cada tabela tem duas linhas: prompts de até 272K tokens de entrada e prompts acima disso. A saída inclui os tokens de raciocínio que o modelo gasta antes de responder.

Quais são os preços de tabela da OpenAI?

Para referência, é assim que os preços Standard da OpenAI são estruturados, segundo a sua página de preços. Cada linha é um múltiplo da tarifa de entrada do próprio modelo, e os três modelos têm a mesma estrutura:

LinhaGPT-6 AstraGPT-6 SolGPT-6 Luna
Entrada1×1×1×
Entrada em cache0,1×0,1×0,1×
Escrita em cache1,25×1,25×1,25×
Saída5×5×5×

Entre modelos, a tarifa de entrada do GPT-6 Astra é cinco vezes a do GPT-6 Sol, e a do GPT-6 Sol é vinte vezes a do GPT-6 Luna. Acima de 272K tokens de entrada, a OpenAI cobra 2x as tarifas de entrada e de cache e 1,5x a tarifa de saída "na solicitação inteira". As tabelas ao vivo acima mostram as tarifas da SeedRouter para cada linha.

Como uma solicitação ao GPT-6 é cobrada?

Toda resposta informa a contagem de tokens em usage, e a cobrança segue esses números:

  • input_tokens: o prompt inteiro, incluindo qualquer parte lida do cache ou escrita nele.
  • input_tokens_details.cached_tokens: tokens do prompt lidos do cache, cobrados pela tarifa de entrada em cache.
  • input_tokens_details.cache_write_tokens: tokens do prompt escritos no cache, cobrados pela tarifa de escrita em cache.
  • output_tokens: a resposta mais o raciocínio, cobrados pela tarifa de saída.

Então o custo de uma solicitação é:

cost = ((input − cached − cache writes) × input rate
      + cached × cached-input rate
      + cache writes × cache-write rate
      + output × output rate) / 1,000,000

Se o prompt tiver mais de 272K tokens de entrada, todas as linhas usam as tarifas de contexto longo.

Quanto custa uma solicitação típica?

Pegue uma solicitação com 2.000 tokens de entrada e 1.000 tokens de saída. O custo é 2.000 vezes a tarifa de entrada mais 1.000 vezes a tarifa de saída, dividido por 1.000.000. Como a saída custa cinco vezes a entrada nos três modelos, o lado da saída dessa solicitação custa duas vezes e meia o lado da entrada, qualquer que seja o modelo. A mesma solicitação no GPT-6 Sol custa um quinto do GPT-6 Astra e vinte vezes o GPT-6 Luna.

O raciocínio é o que mais muda o lado da saída. Um esforço mais alto costuma gastar mais tokens de raciocínio na mesma pergunta, então no GPT-6 Sol e no GPT-6 Luna experimente none ou low primeiro e aumente o esforço só onde as respostas precisarem.

Como pagar menos pelo GPT-6?

  • Escolha o menor modelo que passa nos seus testes. O GPT-6 Luna custa um vigésimo do GPT-6 Sol, e o GPT-6 Sol um quinto do GPT-6 Astra.
  • Reduza o esforço. Tokens de raciocínio são tokens de saída. O GPT-6 Sol e o GPT-6 Luna aceitam none, que pula o raciocínio.
  • Reaproveite o prefixo do prompt. A entrada em cache custa 10% da tarifa de entrada. Mantenha instruções, ferramentas e material de referência no início e sem mudanças entre as solicitações.
  • Fique abaixo de 272K tokens de entrada. Acima disso, a solicitação inteira, e não só a parte excedente, passa para a tarifa mais alta.
  • Limite a saída. max_output_tokens limita a resposta e o raciocínio juntos; o menor valor aceito é 16.

O GPT-6 é grátis?

Não na API. Na SeedRouter, toda conta nova começa com um pequeno saldo grátis, suficiente para algumas solicitações de teste no GPT-6 Sol ou muitas no GPT-6 Luna, e uma solicitação que falha nunca é cobrada. No ChatGPT, a OpenAI diz que usuários Free e Go podem usar o GPT-6 Luna no app para desktop; os planos do ChatGPT são cobrados separadamente da API.

Perguntas frequentes

Quanto custa o GPT-6 Astra?

O GPT-6 Astra é o modelo GPT-6 mais caro: na tabela da OpenAI, as tarifas dele são cinco vezes as do GPT-6 Sol em todas as linhas, com a saída a cinco vezes a entrada. A tabela no topo desta página mostra a tarifa que a sua conta na SeedRouter paga.

Quanto custa o GPT-6 Sol?

Na tabela da OpenAI, o GPT-6 Sol custa um quinto do GPT-6 Astra e metade do preço promocional do GPT-5.6 Sol; a tabela no topo mostra a tarifa que você paga. O guia GPT-6 vs GPT-5.6 compara as duas gerações linha por linha.

Os tokens de raciocínio são cobrados?

Sim, como tokens de saída. usage.output_tokens_details.reasoning_tokens mostra quantos dos tokens de saída foram de raciocínio.

Existe mensalidade?

Não. Você recarrega o saldo uma vez e gasta por solicitação em qualquer modelo. O saldo não expira.

Confira o custo com o seu próprio prompt

Envie um prompt no playground do GPT-6 Sol, no playground do GPT-6 Luna ou no playground do GPT-6 Astra. Cada resposta mostra a contagem de tokens e o custo, cobrados exatamente como uma chamada de API.

Guias relacionados