Claude Opus 5.5 è disponibile su SeedRouter
SeedRouter Docs

GPT-6 Sol

Chiama GPT-6 Sol con l'API ufficiale OpenAI Responses o Chat Completions: finestra di contesto di 1.05M token, fino a 128K token di output e il livello di ragionamento che preferisci.

View Markdown

GPT-6 Sol è il modello GPT-6 di OpenAI per il coding complesso e i flussi di lavoro agentici, a metà tra GPT-6 Astra e GPT-6 Luna per capacità e prezzo. Invia la richiesta ufficiale OpenAI Responses o Chat Completions a SeedRouter: cambia l'URL di base e la chiave API, mantieni il corpo.

ID modello

ID modelloFinestra di contestoOutput massimoLivello di ragionamentoLivello di ragionamento predefinito
gpt-6-sol1.05M token (922K di input)128K tokennone, low, medium, high, xhigh, maxmedium

Input: testo e immagini. Output: testo. Data limite delle conoscenze: 20 aprile 2026. Consulta la pagina del modello per i prezzi attuali.

Esempio rapido

curl https://api.seedrouter.ai/v1/responses \
  -H "Authorization: Bearer $SEEDROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-6-sol",
    "input": "Summarize the trade-offs of event sourcing in three bullet points."
  }'

Endpoint

FormatoMetodo e percorsoAutenticazione
OpenAI ResponsesPOST https://api.seedrouter.ai/v1/responsesAuthorization: Bearer <key>
OpenAI Chat CompletionsPOST https://api.seedrouter.ai/v1/chat/completionsAuthorization: Bearer <key>
Anthropic MessagesPOST https://api.seedrouter.ai/v1/messagesx-api-key: <key> oppure Authorization: Bearer <key>, più anthropic-version

Gli endpoint OpenAI inoltrano il corpo della richiesta così come inviato e restituiscono la risposta ufficiale. Mantieni la chiave API nel codice lato server.

Parametri

Campi della Responses API:

NomeTipoObbligatorioPredefinitoNote
modelstringSì—gpt-6-sol.
inputstring o object[]Sì—Un prompt, oppure elementi di input: messaggi il cui content contiene parti input_text e input_image.
instructionsstringNo—Istruzioni di sistema (developer).
max_output_tokensintegerNoMassimo del modello16–128000. Include i token di ragionamento.
reasoning.effortenumNomediumnone, low, medium, high, xhigh, max.
reasoning.summaryenumNo—auto, concise o detailed: restituisce un riepilogo del ragionamento.
reasoning.modeenumNostandardstandard o pro.
reasoning.contextenumNoautoauto, current_turn o all_turns: quale ragionamento precedente viene mostrato al modello.
text.verbosityenumNomediumlow, medium o high.
text.formatobjectNo—Output strutturato, ad esempio {"type": "json_schema", "name": "...", "schema": {...}}.
temperaturenumberNo—0–2. Accettato solo con reasoning.effort impostato su none.
top_pnumberNo—0–1. Accettato solo con reasoning.effort impostato su none.
top_logprobsintegerNo—0–20. Accettato solo con reasoning.effort impostato su none.
streambooleanNofalseTrasmette la risposta come server-sent events.
tools, tool_choice, parallel_tool_calls, max_tool_calls, include, metadata, store, truncation, prompt_cache_key, prompt_cache_options, prompt_cache_retention, context_management, moderation, prompt, previous_response_id, conversation, user—No—Inoltrati così come inviati.

Non disponibili: background, service_tier (inclusi Batch, Flex e la modalità veloce) e safety_identifier.

Ragionamento e livello di ragionamento

GPT-6 Sol usa medium come impostazione predefinita. Con none il modello risponde senza ragionare, e solo in quel caso sono accettati temperature, top_p e top_logprobs. Un livello di ragionamento più alto comporta di solito più token di output, un'attesa più lunga e un costo maggiore. I token di ragionamento vengono fatturati come token di output e rientrano in max_output_tokens.

Input di immagini

Le immagini vanno nel content di un messaggio utente come parti input_image con un image_url:

{"role": "user", "content": [
  {"type": "input_image", "image_url": "https://example.com/chart.png"},
  {"type": "input_text", "text": "What does this chart show?"}
]}

Sostituisci l'URL di esempio con una tua immagine raggiungibile pubblicamente.

Dimensioni di fatturazione

Vedi i prezzi attuali nella pagina del modello. Una richiesta viene fatturata in base ai token che utilizza:

  • token di input,
  • token di output, incluso il ragionamento,
  • token di input in cache (usage.input_tokens_details.cached_tokens) e
  • token di scrittura in cache (usage.input_tokens_details.cache_write_tokens).

Quando un prompt supera i 272K token di input, l'intera richiesta viene fatturata alle tariffe per contesto lungo. L'addebito si basa sull'usage riportato con la risposta completata. Una richiesta fallita non viene addebitata. I registri di utilizzo del tuo account mostrano l'addebito esatto di ogni richiesta.

Output

Una richiesta senza streaming restituisce l'oggetto di risposta ufficiale:

{
  "id": "resp_...",
  "object": "response",
  "status": "completed",
  "model": "gpt-6-sol",
  "output": [{"type": "message", "role": "assistant", "content": [{"type": "output_text", "text": "..."}]}],
  "usage": {"input_tokens": 27, "input_tokens_details": {"cached_tokens": 0, "cache_write_tokens": 0}, "output_tokens": 102, "output_tokens_details": {"reasoning_tokens": 0}, "total_tokens": 129}
}

Con "stream": true la risposta è un flusso degli eventi ufficiali, tra cui response.created, response.output_text.delta e response.completed; l'evento finale response.completed riporta l'utilizzo.

Chat Completions

Al codice Chat Completions esistente servono solo un nuovo URL di base e un nuovo ID modello:

from openai import OpenAI

client = OpenAI(api_key="YOUR_SEEDROUTER_KEY", base_url="https://api.seedrouter.ai/v1")

chat = client.chat.completions.create(
    model="gpt-6-sol",
    messages=[{"role": "user", "content": "Hello"}],
    max_completion_tokens=1024,
)
print(chat.choices[0].message.content)

Imposta il limite di output con max_completion_tokens e il livello di ragionamento con reasoning_effort. Su Chat Completions, GPT-6 Sol supporta il function calling solo con reasoning_effort impostato su none; usa la Responses API per il ragionamento con gli strumenti.

Formato Anthropic Messages

Anche il codice scritto per l'API Anthropic Messages può chiamare GPT-6 Sol: invia il corpo Messages a /v1/messages con "model": "gpt-6-sol". La richiesta viene convertita in Chat Completions, quindi un campo senza equivalente in Chat Completions non ha effetto. La risposta contiene i campi ufficiali di Messages e può includere alcuni campi di utilizzo aggiuntivi; leggi usage.input_tokens, usage.output_tokens e i campi ufficiali.

Errori

Gli errori usano {"error": {"code": ..., "message": "..."}}. Il code è un codice dal catalogo errori comune. Le richieste fallite non vengono addebitate.

Suggerimenti

  • Parti dal livello di ragionamento predefinito medium, usa none per passaggi rapidi e semplici e alza il livello solo per i compiti difficili.
  • Imposta max_output_tokens abbastanza alto sia per il ragionamento sia per la risposta: è un unico budget per entrambi.
  • Metti il contesto lungo e riutilizzato all'inizio del prompt, così le richieste successive lo leggono dalla cache alla tariffa più bassa.

Correlati