GPT-6 Sol
Chiama GPT-6 Sol con l'API ufficiale OpenAI Responses o Chat Completions: finestra di contesto di 1.05M token, fino a 128K token di output e il livello di ragionamento che preferisci.
GPT-6 Sol è il modello GPT-6 di OpenAI per il coding complesso e i flussi di lavoro agentici, a metà tra GPT-6 Astra e GPT-6 Luna per capacità e prezzo. Invia la richiesta ufficiale OpenAI Responses o Chat Completions a SeedRouter: cambia l'URL di base e la chiave API, mantieni il corpo.
ID modello
| ID modello | Finestra di contesto | Output massimo | Livello di ragionamento | Livello di ragionamento predefinito |
|---|---|---|---|---|
gpt-6-sol | 1.05M token (922K di input) | 128K token | none, low, medium, high, xhigh, max | medium |
Input: testo e immagini. Output: testo. Data limite delle conoscenze: 20 aprile 2026. Consulta la pagina del modello per i prezzi attuali.
Esempio rapido
curl https://api.seedrouter.ai/v1/responses \
-H "Authorization: Bearer $SEEDROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-6-sol",
"input": "Summarize the trade-offs of event sourcing in three bullet points."
}'Endpoint
| Formato | Metodo e percorso | Autenticazione |
|---|---|---|
| OpenAI Responses | POST https://api.seedrouter.ai/v1/responses | Authorization: Bearer <key> |
| OpenAI Chat Completions | POST https://api.seedrouter.ai/v1/chat/completions | Authorization: Bearer <key> |
| Anthropic Messages | POST https://api.seedrouter.ai/v1/messages | x-api-key: <key> oppure Authorization: Bearer <key>, più anthropic-version |
Gli endpoint OpenAI inoltrano il corpo della richiesta così come inviato e restituiscono la risposta ufficiale. Mantieni la chiave API nel codice lato server.
Parametri
Campi della Responses API:
| Nome | Tipo | Obbligatorio | Predefinito | Note |
|---|---|---|---|---|
model | string | Sì | — | gpt-6-sol. |
input | string o object[] | Sì | — | Un prompt, oppure elementi di input: messaggi il cui content contiene parti input_text e input_image. |
instructions | string | No | — | Istruzioni di sistema (developer). |
max_output_tokens | integer | No | Massimo del modello | 16–128000. Include i token di ragionamento. |
reasoning.effort | enum | No | medium | none, low, medium, high, xhigh, max. |
reasoning.summary | enum | No | — | auto, concise o detailed: restituisce un riepilogo del ragionamento. |
reasoning.mode | enum | No | standard | standard o pro. |
reasoning.context | enum | No | auto | auto, current_turn o all_turns: quale ragionamento precedente viene mostrato al modello. |
text.verbosity | enum | No | medium | low, medium o high. |
text.format | object | No | — | Output strutturato, ad esempio {"type": "json_schema", "name": "...", "schema": {...}}. |
temperature | number | No | — | 0–2. Accettato solo con reasoning.effort impostato su none. |
top_p | number | No | — | 0–1. Accettato solo con reasoning.effort impostato su none. |
top_logprobs | integer | No | — | 0–20. Accettato solo con reasoning.effort impostato su none. |
stream | boolean | No | false | Trasmette la risposta come server-sent events. |
tools, tool_choice, parallel_tool_calls, max_tool_calls, include, metadata, store, truncation, prompt_cache_key, prompt_cache_options, prompt_cache_retention, context_management, moderation, prompt, previous_response_id, conversation, user | — | No | — | Inoltrati così come inviati. |
Non disponibili: background, service_tier (inclusi Batch, Flex e la modalità veloce) e safety_identifier.
Ragionamento e livello di ragionamento
GPT-6 Sol usa medium come impostazione predefinita. Con none il modello risponde senza ragionare, e solo in quel caso sono accettati temperature, top_p e top_logprobs. Un livello di ragionamento più alto comporta di solito più token di output, un'attesa più lunga e un costo maggiore. I token di ragionamento vengono fatturati come token di output e rientrano in max_output_tokens.
Input di immagini
Le immagini vanno nel content di un messaggio utente come parti input_image con un image_url:
{"role": "user", "content": [
{"type": "input_image", "image_url": "https://example.com/chart.png"},
{"type": "input_text", "text": "What does this chart show?"}
]}Sostituisci l'URL di esempio con una tua immagine raggiungibile pubblicamente.
Dimensioni di fatturazione
Vedi i prezzi attuali nella pagina del modello. Una richiesta viene fatturata in base ai token che utilizza:
- token di input,
- token di output, incluso il ragionamento,
- token di input in cache (
usage.input_tokens_details.cached_tokens) e - token di scrittura in cache (
usage.input_tokens_details.cache_write_tokens).
Quando un prompt supera i 272K token di input, l'intera richiesta viene fatturata alle tariffe per contesto lungo. L'addebito si basa sull'usage riportato con la risposta completata. Una richiesta fallita non viene addebitata. I registri di utilizzo del tuo account mostrano l'addebito esatto di ogni richiesta.
Output
Una richiesta senza streaming restituisce l'oggetto di risposta ufficiale:
{
"id": "resp_...",
"object": "response",
"status": "completed",
"model": "gpt-6-sol",
"output": [{"type": "message", "role": "assistant", "content": [{"type": "output_text", "text": "..."}]}],
"usage": {"input_tokens": 27, "input_tokens_details": {"cached_tokens": 0, "cache_write_tokens": 0}, "output_tokens": 102, "output_tokens_details": {"reasoning_tokens": 0}, "total_tokens": 129}
}Con "stream": true la risposta è un flusso degli eventi ufficiali, tra cui response.created, response.output_text.delta e response.completed; l'evento finale response.completed riporta l'utilizzo.
Chat Completions
Al codice Chat Completions esistente servono solo un nuovo URL di base e un nuovo ID modello:
from openai import OpenAI
client = OpenAI(api_key="YOUR_SEEDROUTER_KEY", base_url="https://api.seedrouter.ai/v1")
chat = client.chat.completions.create(
model="gpt-6-sol",
messages=[{"role": "user", "content": "Hello"}],
max_completion_tokens=1024,
)
print(chat.choices[0].message.content)Imposta il limite di output con max_completion_tokens e il livello di ragionamento con reasoning_effort. Su Chat Completions, GPT-6 Sol supporta il function calling solo con reasoning_effort impostato su none; usa la Responses API per il ragionamento con gli strumenti.
Formato Anthropic Messages
Anche il codice scritto per l'API Anthropic Messages può chiamare GPT-6 Sol: invia il corpo Messages a /v1/messages con "model": "gpt-6-sol". La richiesta viene convertita in Chat Completions, quindi un campo senza equivalente in Chat Completions non ha effetto. La risposta contiene i campi ufficiali di Messages e può includere alcuni campi di utilizzo aggiuntivi; leggi usage.input_tokens, usage.output_tokens e i campi ufficiali.
Errori
Gli errori usano {"error": {"code": ..., "message": "..."}}. Il code è un codice dal catalogo errori comune. Le richieste fallite non vengono addebitate.
Suggerimenti
- Parti dal livello di ragionamento predefinito
medium, usanoneper passaggi rapidi e semplici e alza il livello solo per i compiti difficili. - Imposta
max_output_tokensabbastanza alto sia per il ragionamento sia per la risposta: è un unico budget per entrambi. - Metti il contesto lungo e riutilizzato all'inizio del prompt, così le richieste successive lo leggono dalla cache alla tariffa più bassa.
