Claude Opus 5.5 è disponibile su SeedRouter
SeedRouter Docs

GPT-6 Astra

Chiama GPT-6 Astra con l'API ufficiale OpenAI Responses o Chat Completions: finestra di contesto di 1.05M token, fino a 128K token di output e il livello di ragionamento che preferisci.

View Markdown

GPT-6 Astra è il modello più potente di OpenAI, pensato per il lavoro end-to-end più impegnativo: ragionamento complesso, coding, ricerca e creazione di documenti. Invia la richiesta ufficiale OpenAI Responses o Chat Completions a SeedRouter: cambia l'URL di base e la chiave API, mantieni il corpo.

ID modello

ID modelloFinestra di contestoOutput massimoLivello di ragionamentoLivello di ragionamento predefinito
gpt-6-astra1.05M token (922K di input)128K tokenlow, medium, high, xhigh, maxNon documentato

Input: testo e immagini. Output: testo. Data limite delle conoscenze: 30 aprile 2026. Consulta la pagina del modello per i prezzi attuali.

Esempio rapido

curl https://api.seedrouter.ai/v1/responses \
  -H "Authorization: Bearer $SEEDROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-6-astra",
    "input": "Summarize the trade-offs of event sourcing in three bullet points."
  }'

Endpoint

FormatoMetodo e percorsoAutenticazione
OpenAI ResponsesPOST https://api.seedrouter.ai/v1/responsesAuthorization: Bearer <key>
OpenAI Chat CompletionsPOST https://api.seedrouter.ai/v1/chat/completionsAuthorization: Bearer <key>
Anthropic MessagesPOST https://api.seedrouter.ai/v1/messagesx-api-key: <key> oppure Authorization: Bearer <key>, più anthropic-version

Gli endpoint OpenAI inoltrano il corpo della richiesta così come inviato e restituiscono la risposta ufficiale. Mantieni la chiave API nel codice lato server.

Parametri

Campi della Responses API:

NomeTipoObbligatorioPredefinitoNote
modelstringSì—gpt-6-astra.
inputstring o object[]Sì—Un prompt, oppure elementi di input: messaggi il cui content contiene parti input_text e input_image.
instructionsstringNo—Istruzioni di sistema (developer).
max_output_tokensintegerNoMassimo del modello16–128000. Include i token di ragionamento.
reasoning.effortenumNoNon documentatolow, medium, high, xhigh, max.
reasoning.summaryenumNo—auto, concise o detailed: restituisce un riepilogo del ragionamento.
reasoning.modeenumNostandardstandard o pro.
reasoning.contextenumNoautoauto, current_turn o all_turns: quale ragionamento precedente viene mostrato al modello.
text.verbosityenumNomediumlow, medium o high.
text.formatobjectNo—Output strutturato, ad esempio {"type": "json_schema", "name": "...", "schema": {...}}.
temperaturenumberNo—0–2. Non accettato: GPT-6 Astra ragiona sempre. Omettilo.
top_pnumberNo—0–1. Non accettato: GPT-6 Astra ragiona sempre. Omettilo.
top_logprobsintegerNo—0–20. Non accettato: GPT-6 Astra ragiona sempre. Omettilo.
streambooleanNofalseTrasmette la risposta come server-sent events.
tools, tool_choice, parallel_tool_calls, max_tool_calls, include, metadata, store, truncation, prompt_cache_key, prompt_cache_options, prompt_cache_retention, context_management, moderation, prompt, previous_response_id, conversation, user—No—Inoltrati così come inviati.

Non disponibili: background, service_tier (inclusi Batch, Flex e la modalità veloce) e safety_identifier.

Ragionamento e livello di ragionamento

GPT-6 Astra ragiona sempre: none non è supportato e restituisce un errore 400. OpenAI non documenta un livello di ragionamento predefinito per GPT-6 Astra; ometti reasoning.effort per usare il valore predefinito del modello. Un livello di ragionamento più alto comporta di solito più token di output, un'attesa più lunga e un costo maggiore. I token di ragionamento vengono fatturati come token di output e rientrano in max_output_tokens.

Input di immagini

Le immagini vanno nel content di un messaggio utente come parti input_image con un image_url:

{"role": "user", "content": [
  {"type": "input_image", "image_url": "https://example.com/chart.png"},
  {"type": "input_text", "text": "What does this chart show?"}
]}

Sostituisci l'URL di esempio con una tua immagine raggiungibile pubblicamente.

Dimensioni di fatturazione

Vedi i prezzi attuali nella pagina del modello. Una richiesta viene fatturata in base ai token che utilizza:

  • token di input,
  • token di output, incluso il ragionamento,
  • token di input in cache (usage.input_tokens_details.cached_tokens) e
  • token di scrittura in cache (usage.input_tokens_details.cache_write_tokens).

Quando un prompt supera i 272K token di input, l'intera richiesta viene fatturata alle tariffe per contesto lungo. L'addebito si basa sull'usage riportato con la risposta completata. Una richiesta fallita non viene addebitata. I registri di utilizzo del tuo account mostrano l'addebito esatto di ogni richiesta.

Output

Una richiesta senza streaming restituisce l'oggetto di risposta ufficiale:

{
  "id": "resp_...",
  "object": "response",
  "status": "completed",
  "model": "gpt-6-astra",
  "output": [{"type": "message", "role": "assistant", "content": [{"type": "output_text", "text": "..."}]}],
  "usage": {"input_tokens": 27, "input_tokens_details": {"cached_tokens": 0, "cache_write_tokens": 0}, "output_tokens": 102, "output_tokens_details": {"reasoning_tokens": 0}, "total_tokens": 129}
}

Con "stream": true la risposta è un flusso degli eventi ufficiali, tra cui response.created, response.output_text.delta e response.completed; l'evento finale response.completed riporta l'utilizzo.

Chat Completions

Al codice Chat Completions esistente servono solo un nuovo URL di base e un nuovo ID modello:

from openai import OpenAI

client = OpenAI(api_key="YOUR_SEEDROUTER_KEY", base_url="https://api.seedrouter.ai/v1")

chat = client.chat.completions.create(
    model="gpt-6-astra",
    messages=[{"role": "user", "content": "Hello"}],
    max_completion_tokens=1024,
)
print(chat.choices[0].message.content)

Imposta il limite di output con max_completion_tokens e il livello di ragionamento con reasoning_effort. Chat Completions non supporta il function calling con GPT-6 Astra; usa la Responses API per gli strumenti.

Formato Anthropic Messages

Anche il codice scritto per l'API Anthropic Messages può chiamare GPT-6 Astra: invia il corpo Messages a /v1/messages con "model": "gpt-6-astra". La richiesta viene convertita in Chat Completions, quindi un campo senza equivalente in Chat Completions non ha effetto. La risposta contiene i campi ufficiali di Messages e può includere alcuni campi di utilizzo aggiuntivi; leggi usage.input_tokens, usage.output_tokens e i campi ufficiali.

Errori

Gli errori usano {"error": {"code": ..., "message": "..."}}. Il code è un codice dal catalogo errori comune. Le richieste fallite non vengono addebitate.

Suggerimenti

  • Parti da medium e alza il livello di ragionamento solo per i compiti che richiedono un ragionamento più profondo; il livello di ragionamento incide sia sulla qualità sia sul costo.
  • Imposta max_output_tokens abbastanza alto sia per il ragionamento sia per la risposta: è un unico budget per entrambi.
  • Metti il contesto lungo e riutilizzato all'inizio del prompt, così le richieste successive lo leggono dalla cache alla tariffa più bassa.

Correlati