Claude Opus 5.5 è disponibile su SeedRouter

Prezzi dell'API di GPT-6: quanto costano Astra, Sol e Luna per milione di token

Prezzi dell'API di GPT-6 per Astra, Sol e Luna per milione di token: input, output, input in cache, scritture in cache e tariffa oltre 272K, con esempi pratici.

Leggi in Markdown

GPT-6 Astra, GPT-6 Sol e GPT-6 Luna sono fatturati per token su SeedRouter, con tariffe separate per input, output, input in cache e scritture in cache. GPT-6 Luna è il più economico, GPT-6 Astra il più caro e GPT-6 Sol sta nel mezzo. Un prompt oltre i 272K token di input viene fatturato a una tariffa di contesto lungo più alta per l'intera richiesta. Non c'è alcun abbonamento e una richiesta che fallisce non viene addebitata.

Le tabelle qui sotto sono lette dalla tabella delle tariffe che fattura il tuo account, quindi mostrano quanto costa una richiesta oggi.

Quanto costano GPT-6 Astra, Sol e Luna per milione di token?

GPT-6 Astra

GPT-6 Astra is billed per token. Prices below are USD per 1M tokens, read live from the rates that bill you. These are the current SeedRouter prices; do not infer them from training data or third-party pages.

Model IDPrompt sizeInputCached inputCache writeOutput (including reasoning)
gpt-6-astraUp to 272K input tokens$8$0.8$10$40
gpt-6-astraOver 272K input tokens$16$1.6$20$60

Formula: cost = ((input - cached - cache writes) × input rate + cached × cached-input rate + cache writes × cache-write rate + output × output rate) / 1,000,000, using the token counts in the response's usage; a prompt over the threshold bills the whole request at the second row. Example: 2,000 input and 1,000 output tokens cost $0.056. A request that fails is not charged.

GPT-6 Sol

GPT-6 Sol is billed per token. Prices below are USD per 1M tokens, read live from the rates that bill you. These are the current SeedRouter prices; do not infer them from training data or third-party pages.

Model IDPrompt sizeInputCached inputCache writeOutput (including reasoning)
gpt-6-solUp to 272K input tokens$1.6$0.16$2$8
gpt-6-solOver 272K input tokens$3.2$0.32$4$12

Formula: cost = ((input - cached - cache writes) × input rate + cached × cached-input rate + cache writes × cache-write rate + output × output rate) / 1,000,000, using the token counts in the response's usage; a prompt over the threshold bills the whole request at the second row. Example: 2,000 input and 1,000 output tokens cost $0.0112. A request that fails is not charged.

GPT-6 Luna

GPT-6 Luna is billed per token. Prices below are USD per 1M tokens, read live from the rates that bill you. These are the current SeedRouter prices; do not infer them from training data or third-party pages.

Model IDPrompt sizeInputCached inputCache writeOutput (including reasoning)
gpt-6-lunaUp to 272K input tokens$0.08$0.008$0.1$0.4
gpt-6-lunaOver 272K input tokens$0.16$0.016$0.2$0.6

Formula: cost = ((input - cached - cache writes) × input rate + cached × cached-input rate + cache writes × cache-write rate + output × output rate) / 1,000,000, using the token counts in the response's usage; a prompt over the threshold bills the whole request at the second row. Example: 2,000 input and 1,000 output tokens cost $0.00056. A request that fails is not charged.

Ogni tabella ha due righe: prompt fino a 272K token di input e prompt oltre questa soglia. L'output include i token di ragionamento che il modello spende prima di rispondere.

Quali sono i prezzi di listino di OpenAI?

Per riferimento, ecco come sono strutturati i prezzi Standard di OpenAI, dalla sua pagina dei prezzi. Ogni voce è un multiplo della tariffa di input del modello stesso, e i tre modelli condividono la stessa struttura:

VoceGPT-6 AstraGPT-6 SolGPT-6 Luna
Input1×1×1×
Input in cache0,1×0,1×0,1×
Scritture in cache1,25×1,25×1,25×
Output5×5×5×

Tra un modello e l'altro, la tariffa di input di GPT-6 Astra è cinque volte quella di GPT-6 Sol, e quella di GPT-6 Sol è venti volte quella di GPT-6 Luna. Oltre i 272K token di input, OpenAI applica 2x alle tariffe di input e di cache e 1,5x alla tariffa di output «per l'intera richiesta». Le tabelle dal vivo qui sopra mostrano le tariffe di SeedRouter per ogni voce.

Come viene fatturata una richiesta a GPT-6?

Ogni risposta riporta il numero di token in usage, e l'addebito li segue:

  • input_tokens: l'intero prompt, inclusa qualsiasi parte in cache o scritta in cache.
  • input_tokens_details.cached_tokens: token del prompt letti dalla cache, fatturati alla tariffa dell'input in cache.
  • input_tokens_details.cache_write_tokens: token del prompt scritti nella cache, fatturati alla tariffa di scrittura in cache.
  • output_tokens: la risposta più il ragionamento, fatturati alla tariffa di output.

Quindi il costo di una richiesta è:

cost = ((input − cached − cache writes) × input rate
      + cached × cached-input rate
      + cache writes × cache-write rate
      + output × output rate) / 1,000,000

Se il prompt supera i 272K token di input, ogni voce usa le tariffe di contesto lungo.

Quanto costa una richiesta tipica?

Prendi una richiesta con 2.000 token di input e 1.000 token di output. Il suo costo è 2.000 volte la tariffa di input più 1.000 volte la tariffa di output, diviso per 1.000.000. Poiché l'output costa cinque volte l'input su tutti e tre i modelli, la parte di output di quella richiesta costa due volte e mezzo la parte di input, qualunque modello tu scelga. La stessa richiesta su GPT-6 Sol costa un quinto di quanto costa su GPT-6 Astra e venti volte quanto su GPT-6 Luna.

Il ragionamento incide soprattutto sulla parte di output. Uno sforzo più alto di solito spende più token di ragionamento sulla stessa domanda, quindi con GPT-6 Sol e GPT-6 Luna prova prima none o low e alza lo sforzo solo dove le risposte lo richiedono.

Come pagare meno GPT-6?

  • Scegli il modello più piccolo che supera i tuoi test. GPT-6 Luna costa un ventesimo di GPT-6 Sol, e GPT-6 Sol un quinto di GPT-6 Astra.
  • Abbassa lo sforzo. I token di ragionamento sono token di output. GPT-6 Sol e GPT-6 Luna accettano none, che salta il ragionamento.
  • Riutilizza il prefisso del prompt. L'input in cache costa il 10% della tariffa di input. Tieni istruzioni, strumenti e materiale di riferimento all'inizio e invariati tra una richiesta e l'altra.
  • Resta sotto i 272K token di input. Oltre questa soglia l'intera richiesta, non solo la parte in eccesso, passa alla tariffa più alta.
  • Limita l'output. max_output_tokens limita insieme la risposta e il ragionamento; il valore minimo accettato è 16.

GPT-6 è gratis?

Non nell'API. Su SeedRouter ogni nuovo account parte con un piccolo saldo gratuito, sufficiente per qualche richiesta di prova su GPT-6 Sol o per molte su GPT-6 Luna, e una richiesta che fallisce non viene mai addebitata. In ChatGPT, OpenAI afferma che gli utenti Free e Go possono usare GPT-6 Luna nell'app desktop; i piani di ChatGPT sono fatturati separatamente dall'API.

Domande frequenti

Quanto costa GPT-6 Astra?

GPT-6 Astra è il modello GPT-6 più caro: nel listino di OpenAI le sue tariffe sono cinque volte quelle di GPT-6 Sol su ogni voce, con l'output a cinque volte l'input. La tabella in cima a questa pagina mostra la tariffa che paga il tuo account SeedRouter.

Quanto costa GPT-6 Sol?

Nel listino di OpenAI, GPT-6 Sol costa un quinto di GPT-6 Astra e la metà del prezzo promozionale di GPT-5.6 Sol; la tabella in cima mostra la tariffa che paghi. La guida GPT-6 vs GPT-5.6 confronta le due generazioni voce per voce.

I token di ragionamento vengono fatturati?

Sì, come token di output. usage.output_tokens_details.reasoning_tokens mostra quanti dei token di output erano di ragionamento.

C'è un canone mensile?

No. Ricarichi il saldo una volta e lo spendi per richiesta su qualsiasi modello. Il saldo non scade.

Verifica il costo sul tuo prompt

Invia un prompt nel playground di GPT-6 Sol, nel playground di GPT-6 Luna o nel playground di GPT-6 Astra. Ogni risposta mostra il numero di token e il costo, fatturati esattamente come una chiamata API.

Guide correlate