Claude Opus 5.5 est disponible sur SeedRouter
SeedRouter Docs

GPT-6 Astra

Appelez GPT-6 Astra avec l'API officielle OpenAI Responses ou Chat Completions : une fenêtre de contexte de 1.05M tokens, jusqu'à 128K tokens en sortie et le niveau de raisonnement de votre choix.

View Markdown

GPT-6 Astra est le modèle le plus performant d'OpenAI, conçu pour le travail de bout en bout le plus exigeant : raisonnement complexe, codage, recherche et création de documents. Envoyez la requête officielle OpenAI Responses ou Chat Completions à SeedRouter : changez l'URL de base et la clé API, conservez le corps.

ID de modèle

ID de modèleFenêtre de contexteSortie maximaleNiveau de raisonnementNiveau de raisonnement par défaut
gpt-6-astra1.05M tokens (922K en entrée)128K tokenslow, medium, high, xhigh, maxNon documenté

Entrée : texte et images. Sortie : texte. Date limite des connaissances : 30 avril 2026. Consultez la page du modèle pour les tarifs actuels.

Exemple rapide

curl https://api.seedrouter.ai/v1/responses \
  -H "Authorization: Bearer $SEEDROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-6-astra",
    "input": "Summarize the trade-offs of event sourcing in three bullet points."
  }'

Points de terminaison

FormatMéthode et cheminAuthentification
OpenAI ResponsesPOST https://api.seedrouter.ai/v1/responsesAuthorization: Bearer <key>
OpenAI Chat CompletionsPOST https://api.seedrouter.ai/v1/chat/completionsAuthorization: Bearer <key>
Anthropic MessagesPOST https://api.seedrouter.ai/v1/messagesx-api-key: <key> ou Authorization: Bearer <key>, plus anthropic-version

Les points de terminaison OpenAI transfèrent votre corps de requête tel qu'envoyé et renvoient la réponse officielle. Conservez la clé API dans le code côté serveur.

Paramètres

Champs de l'API Responses :

NomTypeRequisPar défautRemarques
modelstringOui—gpt-6-astra.
inputstring ou object[]Oui—Un prompt, ou des éléments d'entrée : des messages dont le content contient des parties input_text et input_image.
instructionsstringNon—Instructions système (développeur).
max_output_tokensintegerNonMaximum du modèle16–128000. Inclut les tokens de raisonnement.
reasoning.effortenumNonNon documentélow, medium, high, xhigh, max.
reasoning.summaryenumNon—auto, concise ou detailed : renvoie un résumé du raisonnement.
reasoning.modeenumNonstandardstandard ou pro.
reasoning.contextenumNonautoauto, current_turn ou all_turns : quel raisonnement antérieur est montré au modèle.
text.verbosityenumNonmediumlow, medium ou high.
text.formatobjectNon—Sortie structurée, par exemple {"type": "json_schema", "name": "...", "schema": {...}}.
temperaturenumberNon—0–2. Non accepté : GPT-6 Astra raisonne toujours. Omettez-le.
top_pnumberNon—0–1. Non accepté : GPT-6 Astra raisonne toujours. Omettez-le.
top_logprobsintegerNon—0–20. Non accepté : GPT-6 Astra raisonne toujours. Omettez-le.
streambooleanNonfalseEnvoie la réponse en événements côté serveur (server-sent events).
tools, tool_choice, parallel_tool_calls, max_tool_calls, include, metadata, store, truncation, prompt_cache_key, prompt_cache_options, prompt_cache_retention, context_management, moderation, prompt, previous_response_id, conversation, user—Non—Transmis tel qu'envoyé.

Non disponibles : background, service_tier (y compris Batch, Flex et le mode rapide) et safety_identifier.

Raisonnement et niveau de raisonnement

GPT-6 Astra raisonne toujours : none n'est pas pris en charge et renvoie une erreur 400. OpenAI ne documente pas de niveau de raisonnement par défaut pour GPT-6 Astra ; omettez reasoning.effort pour utiliser la valeur par défaut du modèle. Un niveau de raisonnement plus élevé signifie généralement plus de tokens en sortie, une attente plus longue et un coût plus élevé. Les tokens de raisonnement sont facturés comme des tokens de sortie et comptent dans max_output_tokens.

Entrée image

Les images vont dans le content d'un message utilisateur, en tant que parties input_image avec une image_url :

{"role": "user", "content": [
  {"type": "input_image", "image_url": "https://example.com/chart.png"},
  {"type": "input_text", "text": "What does this chart show?"}
]}

Remplacez l'URL d'exemple par une image publiquement accessible de votre choix.

Dimensions de facturation

Consultez les tarifs actuels sur la page du modèle. Une requête est facturée en fonction des tokens qu'elle utilise :

  • tokens d'entrée,
  • tokens de sortie, y compris le raisonnement,
  • tokens d'entrée en cache (usage.input_tokens_details.cached_tokens), et
  • tokens d'écriture en cache (usage.input_tokens_details.cache_write_tokens).

Lorsqu'un prompt dépasse 272K tokens d'entrée, toute la requête est facturée aux tarifs contexte long. Le montant est calculé à partir de l'usage renvoyé avec la réponse terminée. Une requête qui échoue n'est pas facturée. Les enregistrements d'usage de votre compte indiquent le montant exact de chaque requête.

Sortie

Une requête non-streaming renvoie l'objet response officiel :

{
  "id": "resp_...",
  "object": "response",
  "status": "completed",
  "model": "gpt-6-astra",
  "output": [{"type": "message", "role": "assistant", "content": [{"type": "output_text", "text": "..."}]}],
  "usage": {"input_tokens": 27, "input_tokens_details": {"cached_tokens": 0, "cache_write_tokens": 0}, "output_tokens": 102, "output_tokens_details": {"reasoning_tokens": 0}, "total_tokens": 129}
}

Avec "stream": true, la réponse est un flux d'événements officiels, dont response.created, response.output_text.delta et response.completed ; l'événement response.completed final porte l'usage.

Chat Completions

Le code Chat Completions existant a seulement besoin d'une nouvelle URL de base et d'un ID de modèle :

from openai import OpenAI

client = OpenAI(api_key="YOUR_SEEDROUTER_KEY", base_url="https://api.seedrouter.ai/v1")

chat = client.chat.completions.create(
    model="gpt-6-astra",
    messages=[{"role": "user", "content": "Hello"}],
    max_completion_tokens=1024,
)
print(chat.choices[0].message.content)

Définissez la limite de sortie avec max_completion_tokens et le niveau de raisonnement avec reasoning_effort. Chat Completions ne prend pas en charge l'appel de fonctions avec GPT-6 Astra ; utilisez l'API Responses pour les outils.

Format Anthropic Messages

Le code écrit pour l'API Anthropic Messages peut aussi appeler GPT-6 Astra : envoyez le corps Messages à /v1/messages avec "model": "gpt-6-astra". La requête est convertie en Chat Completions, donc un champ sans équivalent Chat Completions n'a aucun effet. La réponse porte les champs Messages officiels et peut inclure quelques champs d'usage supplémentaires ; lisez usage.input_tokens, usage.output_tokens et les champs officiels.

Erreurs

Les erreurs utilisent {"error": {"code": ..., "message": "..."}}. Le code est un code du catalogue d'erreurs commun. Les requêtes échouées ne sont pas facturées.

Conseils

  • Commencez avec medium et n'augmentez le niveau de raisonnement que pour les tâches qui demandent un raisonnement plus poussé ; il influe à la fois sur la qualité et sur le coût.
  • Définissez max_output_tokens assez haut pour le raisonnement et la réponse : c'est un budget unique pour les deux.
  • Placez le contexte long et réutilisé au début du prompt afin que les requêtes ultérieures le lisent depuis le cache au tarif inférieur.

Ressources associées