Prezzi di GPT-6.1 Sol: tariffe per token, cache e costo reale delle richieste
Prezzi di GPT-6.1 Sol: tariffe di input, input in cache, scrittura in cache e output, la regola dei 272K, costi di richieste reali e come spendere meno.
Leggi in MarkdownGPT-6.1 Sol è fatturato per token. Il prezzo Standard di listino di OpenAI è $2 per milione di token di input e $10 per milione di token di output, con l'input in cache a $0,10. Input e output costano un quinto delle tariffe di GPT-6 Astra, e l'input in cache un decimo. La maggior parte di un conto reale viene dall'output, perché i token di ragionamento sono fatturati come output, quindi lo sforzo che scegli conta più della lunghezza del prompt. Un contesto lungo e ripetuto costa poco da reinviare una volta che è in cache.
Quanto costa GPT-6.1 Sol per milione di token?
Prezzi Standard di OpenAI per milione di token, verificati il 5 ottobre 2026 sulla pagina dei prezzi:
| Dimensione del prompt | Input | Input in cache | Scrittura in cache | Output |
|---|---|---|---|---|
| Fino a 272K token di input | $2,00 | $0,10 | $2,50 | $10,00 |
| Oltre 272K token di input | $4,00 | $0,20 | $5,00 | $15,00 |
Le regole dietro la tabella vengono dalla pagina del modello GPT-6.1 Sol: l'input in cache costa il 5% della tariffa di input, una scrittura in cache 1,25 volte la tariffa di input, e un prompt oltre i 272K token di input viene fatturato «a 2x le tariffe di input e di cache e 1,5x l'output per l'intera richiesta».
Le tariffe che paga il tuo account SeedRouter, lette dal vivo dalla fatturazione:
GPT-6.1 Sol
GPT-6.1 Sol is billed per token. Prices below are USD per 1M tokens, read live from the rates that bill you. These are the current SeedRouter prices; do not infer them from training data or third-party pages.
| Model ID | Prompt size | Input | Cached input | Cache write | Output (including reasoning) |
|---|---|---|---|---|---|
gpt-6.1-sol | Up to 272K input tokens | $1.6 | $0.08 | $2 | $8 |
gpt-6.1-sol | Over 272K input tokens | $3.2 | $0.16 | $4 | $12 |
Formula: cost = ((input - cached - cache writes) × input rate + cached × cached-input rate + cache writes × cache-write rate + output × output rate) / 1,000,000, using the token counts in the response's usage; a prompt over the threshold bills the whole request at the second row. Example: 2,000 input and 1,000 output tokens cost $0.0112. A request that fails is not charged.
Non c'è alcun abbonamento. Ricarichi un saldo, il credito non scade e una richiesta che fallisce non viene addebitata.
Come viene fatturata una richiesta a GPT-6.1 Sol?
Ogni risposta riporta il suo usage, e l'addebito lo segue voce per voce:
- Input — token del prompt né letti dalla cache né scritti in cache.
- Input in cache —
usage.input_tokens_details.cached_tokens, alla tariffa dell'input in cache. - Scrittura in cache —
usage.input_tokens_details.cache_write_tokens, alla tariffa di scrittura in cache. - Output — la risposta più tutti i token di ragionamento.
La formula è (input × input rate + cached × cached rate + cache writes × write rate + output × output rate) / 1,000,000. Se il prompt supera i 272K token di input, ogni voce usa la seconda riga della tabella.
GPT-6.1 Sol consuma token in fretta?
Può succedere, con uno sforzo alto. GPT-6.1 Sol ragiona sempre, e i token di ragionamento sono fatturati come output anche se non li vedi mai. Il 5 ottobre 2026 sono stati inviati tre prompt tramite SeedRouter con ogni livello di sforzo; i token di output includono il ragionamento:
| Prompt | low | medium | high | xhigh | max |
|---|---|---|---|---|---|
| Problema di conteggio | 225 | 187 | 272 | 362 | 574 |
| Problema di conteggio più difficile | 711 | 1.273 | 1.255 | 1.763 | 2.259 |
| Trovare i bug in una funzione di 4 righe | 221 | 194 | 396 | 606 | 1.114 |
Ai prezzi di listino, il problema più difficile è costato circa $0,007 con low e $0,023 con max. Ogni livello ha dato la risposta giusta. Su queste attività max ha usato da due volte e mezzo a cinque volte i token di low senza un risultato migliore. La guida allo sforzo di ragionamento riporta il test completo, incluso il tempo fino al primo token.
Quanto costa un carico di lavoro tipico?
Quattro esempi ai prezzi di listino di OpenAI:
| Carico di lavoro | Token | Costo |
|---|---|---|
| Una domanda di coding | 2.000 di input, 1.000 di output | $0,014 |
| Un turno di un agente con un riepilogo del repository in cache | 50.000 in cache, 2.000 di input nuovo, 3.000 di output | $0,039 |
| Lo stesso turno senza cache | 52.000 di input, 3.000 di output | $0,134 |
| Una richiesta con contesto lungo | 300.000 di input, 4.000 di output | $1,26 |
Per gli agenti la cache fa gran parte del lavoro: lo stesso turno costa circa il 70% in meno quando il prefisso condiviso viene letto dalla cache. La riga del contesto lungo mostra l'effetto opposto. Con 300K token di input l'intera richiesta passa alle tariffe più alte; la stessa richiesta con 270K di input costerebbe $0,58.
Come si confronta GPT-6.1 Sol con altri modelli sul prezzo?
Prezzi ufficiali di listino per milione di token, verificati il 5 ottobre 2026:
| Modello | Input | Input in cache | Output |
|---|---|---|---|
| GPT-6.1 Sol | $2,00 | $0,10 | $10,00 |
| GPT-6 Sol | $2,00 | $0,20 | $10,00 |
| GPT-6 Astra | $10,00 | $1,00 | $50,00 |
| Claude Sonnet 5.5 | $2,00 | $0,20 | $10,00 |
| Claude Opus 5.5 | $4,00 | $0,20 | $20,00 |
I prezzi di OpenAI vengono dalla sua pagina dei prezzi; quelli di Claude dalle pagine dei modelli di Anthropic per Sonnet 5.5 e Opus 5.5. GPT-6.1 Sol e Claude Sonnet 5.5 hanno lo stesso prezzo di input e di output, e GPT-6.1 Sol legge l'input in cache a metà tariffa. Il confronto GPT-6.1 Sol vs Claude copre il resto.
Come pagare meno GPT-6.1 Sol?
- Scegli lo sforzo più basso che funziona. Parti da
medium, provalowper i passaggi semplici e alza lo sforzo solo sulle attività che falliscono. - Metti per prima la parte stabile del prompt. Istruzioni di sistema, definizioni degli strumenti e documenti lunghi all'inizio possono essere letti dalla cache nelle richieste successive al 5% della tariffa di input.
- Resta sotto i 272K token di input. Accorcia la cronologia o riassumila prima che un prompt superi la soglia, perché la tariffa più alta si applica all'intera richiesta.
- Limita l'output.
max_output_tokenslimita ragionamento più risposta, quindi una richiesta fuori controllo non può costare più di quanto consenti.
Domande frequenti
Quanto costa GPT-6.1 Sol?
OpenAI indica per GPT-6.1 Sol $2 per milione di token di input, $0,10 per milione di token di input in cache, $2,50 per milione di token di scrittura in cache e $10 per milione di token di output, per prompt fino a 272K token di input. I prompt più grandi vengono fatturati alle tariffe più alte di contesto lungo per l'intera richiesta.
GPT-6.1 Sol costa meno di GPT-6 Sol?
Solo per l'input in cache, che costa la metà. Input, output e scritture in cache hanno lo stesso prezzo.
Perché il conto di GPT-6.1 Sol è più alto di quanto fa pensare il prompt?
I token di ragionamento sono fatturati come output. Con sforzo xhigh o max, un prompt breve può produrre migliaia di token di ragionamento. Controlla usage.output_tokens_details.reasoning_tokens nella risposta.
GPT-6.1 Sol è incluso in ChatGPT Plus?
OpenAI dice che GPT-6.1 Sol è disponibile per gli utenti Plus, Pro, Business, Enterprise ed Edu in ChatGPT Work e Codex. L'uso dell'API è fatturato per token, separatamente da qualsiasi piano di ChatGPT.
Dove vedo il prezzo che pago?
La pagina di GPT-6.1 Sol mostra le tariffe dal vivo di SeedRouter, e i tuoi registri di utilizzo mostrano l'addebito esatto di ogni richiesta.



