Preço da API do GPT-6: quanto custam Astra, Sol e Luna por milhão de tokens
Preço da API do GPT-6 Astra, Sol e Luna por milhão de tokens: entrada, saída, leitura e escrita em cache e a tarifa acima de 272K tokens, com exemplos.
Ler em MarkdownO GPT-6 Astra, o GPT-6 Sol e o GPT-6 Luna são cobrados por token na SeedRouter, com tarifas separadas para entrada, saída, entrada em cache e escrita em cache. O GPT-6 Luna é o mais barato, o GPT-6 Astra o mais caro, e o GPT-6 Sol fica entre os dois. Um prompt com mais de 272K tokens de entrada é cobrado por uma tarifa de contexto longo mais alta na solicitação inteira. Não há assinatura, e uma solicitação que falha não é cobrada.
As tabelas abaixo são lidas da tabela de tarifas que cobra a sua conta, então mostram quanto uma solicitação custa hoje.
Quanto custam GPT-6 Astra, Sol e Luna por milhão de tokens?
GPT-6 Astra
Current rates are temporarily unavailable. No price estimate is provided; unavailable rates must not be interpreted as free usage.
GPT-6 Sol
Current rates are temporarily unavailable. No price estimate is provided; unavailable rates must not be interpreted as free usage.
GPT-6 Luna
Current rates are temporarily unavailable. No price estimate is provided; unavailable rates must not be interpreted as free usage.
Cada tabela tem duas linhas: prompts de até 272K tokens de entrada e prompts acima disso. A saída inclui os tokens de raciocínio que o modelo gasta antes de responder.
Quais são os preços de tabela da OpenAI?
Para referência, é assim que os preços Standard da OpenAI são estruturados, segundo a sua página de preços. Cada linha é um múltiplo da tarifa de entrada do próprio modelo, e os três modelos têm a mesma estrutura:
| Linha | GPT-6 Astra | GPT-6 Sol | GPT-6 Luna |
|---|---|---|---|
| Entrada | 1× | 1× | 1× |
| Entrada em cache | 0,1× | 0,1× | 0,1× |
| Escrita em cache | 1,25× | 1,25× | 1,25× |
| Saída | 5× | 5× | 5× |
Entre modelos, a tarifa de entrada do GPT-6 Astra é cinco vezes a do GPT-6 Sol, e a do GPT-6 Sol é vinte vezes a do GPT-6 Luna. Acima de 272K tokens de entrada, a OpenAI cobra 2x as tarifas de entrada e de cache e 1,5x a tarifa de saída "na solicitação inteira". As tabelas ao vivo acima mostram as tarifas da SeedRouter para cada linha.
Como uma solicitação ao GPT-6 é cobrada?
Toda resposta informa a contagem de tokens em usage, e a cobrança segue esses números:
input_tokens: o prompt inteiro, incluindo qualquer parte lida do cache ou escrita nele.input_tokens_details.cached_tokens: tokens do prompt lidos do cache, cobrados pela tarifa de entrada em cache.input_tokens_details.cache_write_tokens: tokens do prompt escritos no cache, cobrados pela tarifa de escrita em cache.output_tokens: a resposta mais o raciocínio, cobrados pela tarifa de saída.
Então o custo de uma solicitação é:
cost = ((input − cached − cache writes) × input rate
+ cached × cached-input rate
+ cache writes × cache-write rate
+ output × output rate) / 1,000,000Se o prompt tiver mais de 272K tokens de entrada, todas as linhas usam as tarifas de contexto longo.
Quanto custa uma solicitação típica?
Pegue uma solicitação com 2.000 tokens de entrada e 1.000 tokens de saída. O custo é 2.000 vezes a tarifa de entrada mais 1.000 vezes a tarifa de saída, dividido por 1.000.000. Como a saída custa cinco vezes a entrada nos três modelos, o lado da saída dessa solicitação custa duas vezes e meia o lado da entrada, qualquer que seja o modelo. A mesma solicitação no GPT-6 Sol custa um quinto do GPT-6 Astra e vinte vezes o GPT-6 Luna.
O raciocínio é o que mais muda o lado da saída. Um esforço mais alto costuma gastar mais tokens de raciocínio na mesma pergunta, então no GPT-6 Sol e no GPT-6 Luna experimente none ou low primeiro e aumente o esforço só onde as respostas precisarem.
Como pagar menos pelo GPT-6?
- Escolha o menor modelo que passa nos seus testes. O GPT-6 Luna custa um vigésimo do GPT-6 Sol, e o GPT-6 Sol um quinto do GPT-6 Astra.
- Reduza o esforço. Tokens de raciocínio são tokens de saída. O GPT-6 Sol e o GPT-6 Luna aceitam
none, que pula o raciocínio. - Reaproveite o prefixo do prompt. A entrada em cache custa 10% da tarifa de entrada. Mantenha instruções, ferramentas e material de referência no início e sem mudanças entre as solicitações.
- Fique abaixo de 272K tokens de entrada. Acima disso, a solicitação inteira, e não só a parte excedente, passa para a tarifa mais alta.
- Limite a saída.
max_output_tokenslimita a resposta e o raciocínio juntos; o menor valor aceito é 16.
O GPT-6 é grátis?
Não na API. Na SeedRouter, toda conta nova começa com um pequeno saldo grátis, suficiente para algumas solicitações de teste no GPT-6 Sol ou muitas no GPT-6 Luna, e uma solicitação que falha nunca é cobrada. No ChatGPT, a OpenAI diz que usuários Free e Go podem usar o GPT-6 Luna no app para desktop; os planos do ChatGPT são cobrados separadamente da API.
Perguntas frequentes
Quanto custa o GPT-6 Astra?
O GPT-6 Astra é o modelo GPT-6 mais caro: na tabela da OpenAI, as tarifas dele são cinco vezes as do GPT-6 Sol em todas as linhas, com a saída a cinco vezes a entrada. A tabela no topo desta página mostra a tarifa que a sua conta na SeedRouter paga.
Quanto custa o GPT-6 Sol?
Na tabela da OpenAI, o GPT-6 Sol custa um quinto do GPT-6 Astra e metade do preço promocional do GPT-5.6 Sol; a tabela no topo mostra a tarifa que você paga. O guia GPT-6 vs GPT-5.6 compara as duas gerações linha por linha.
Os tokens de raciocínio são cobrados?
Sim, como tokens de saída. usage.output_tokens_details.reasoning_tokens mostra quantos dos tokens de saída foram de raciocínio.
Existe mensalidade?
Não. Você recarrega o saldo uma vez e gasta por solicitação em qualquer modelo. O saldo não expira.
Confira o custo com o seu próprio prompt
Envie um prompt no playground do GPT-6 Sol, no playground do GPT-6 Luna ou no playground do GPT-6 Astra. Cada resposta mostra a contagem de tokens e o custo, cobrados exatamente como uma chamada de API.



