Claude Opus 5.5 já está disponível no SeedRouter
SeedRouter Docs

GPT-6 Sol

Use o GPT-6 Sol com a API oficial OpenAI Responses ou Chat Completions: janela de contexto de 1.05M de tokens, até 128K tokens de saída e o nível de raciocínio que você escolher.

View Markdown

O GPT-6 Sol é o modelo GPT-6 da OpenAI para programação complexa e fluxos de trabalho agênticos, entre o GPT-6 Astra e o GPT-6 Luna em capacidade e preço. Envie a requisição oficial OpenAI Responses ou Chat Completions para o SeedRouter: altere a URL base e a chave de API, mantenha o corpo.

ID do modelo

ID do modeloJanela de contextoSaída máximaNível de raciocínioNível de raciocínio padrão
gpt-6-sol1.05M tokens (922K de entrada)128K tokensnone, low, medium, high, xhigh, maxmedium

Entrada: texto e imagens. Saída: texto. Data de corte do conhecimento: 20 de abril de 2026. Consulte a página do modelo para os preços atuais.

Exemplo rápido

curl https://api.seedrouter.ai/v1/responses \
  -H "Authorization: Bearer $SEEDROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-6-sol",
    "input": "Summarize the trade-offs of event sourcing in three bullet points."
  }'

Endpoints

FormatoMétodo e caminhoAutenticação
OpenAI ResponsesPOST https://api.seedrouter.ai/v1/responsesAuthorization: Bearer <key>
OpenAI Chat CompletionsPOST https://api.seedrouter.ai/v1/chat/completionsAuthorization: Bearer <key>
Anthropic MessagesPOST https://api.seedrouter.ai/v1/messagesx-api-key: <key> ou Authorization: Bearer <key>, mais anthropic-version

Os endpoints OpenAI encaminham o corpo da sua requisição como enviado e retornam a resposta oficial. Mantenha a chave de API em código do lado do servidor.

Parâmetros

Campos da API Responses:

NomeTipoObrigatórioPadrãoObservações
modelstringSim—gpt-6-sol.
inputstring or object[]Sim—Um prompt ou itens de entrada: mensagens cujo content contém partes input_text e input_image.
instructionsstringNão—Instruções de sistema (desenvolvedor).
max_output_tokensintegerNãoMáximo do modelo16–128000. Inclui os tokens de raciocínio.
reasoning.effortenumNãomediumnone, low, medium, high, xhigh, max.
reasoning.summaryenumNão—auto, concise ou detailed: retorna um resumo do raciocínio.
reasoning.modeenumNãostandardstandard ou pro.
reasoning.contextenumNãoautoauto, current_turn ou all_turns: qual raciocínio anterior é mostrado ao modelo.
text.verbosityenumNãomediumlow, medium ou high.
text.formatobjectNão—Saída estruturada, por exemplo {"type": "json_schema", "name": "...", "schema": {...}}.
temperaturenumberNão—0–2. Aceito apenas com reasoning.effort definido como none.
top_pnumberNão—0–1. Aceito apenas com reasoning.effort definido como none.
top_logprobsintegerNão—0–20. Aceito apenas com reasoning.effort definido como none.
streambooleanNãofalseTransmitir a resposta como eventos enviados pelo servidor.
tools, tool_choice, parallel_tool_calls, max_tool_calls, include, metadata, store, truncation, prompt_cache_key, prompt_cache_options, prompt_cache_retention, context_management, moderation, prompt, previous_response_id, conversation, user—Não—Encaminhados conforme enviados.

Não disponíveis: background, service_tier (incluindo Batch, Flex e o modo rápido) e safety_identifier.

Raciocínio e nível de raciocínio

O GPT-6 Sol usa medium por padrão. Com none o modelo responde sem raciocinar, e só então temperature, top_p e top_logprobs são aceitos. Um nível de raciocínio maior geralmente significa mais tokens de saída, uma espera mais longa e um custo mais alto. Os tokens de raciocínio são cobrados como tokens de saída e contam para max_output_tokens.

Entrada de imagem

As imagens vão no content de uma mensagem do usuário como partes input_image com uma image_url:

{"role": "user", "content": [
  {"type": "input_image", "image_url": "https://example.com/chart.png"},
  {"type": "input_text", "text": "What does this chart show?"}
]}

Substitua a URL de exemplo por uma imagem sua publicamente acessível.

Dimensões de cobrança

Consulte as taxas atuais na página do modelo. Uma requisição é cobrada pelos tokens que usa:

  • tokens de entrada,
  • tokens de saída, incluindo raciocínio,
  • tokens de entrada em cache (usage.input_tokens_details.cached_tokens), e
  • tokens de escrita em cache (usage.input_tokens_details.cache_write_tokens).

Quando um prompt tem mais de 272K tokens de entrada, a requisição inteira é cobrada pelas taxas de contexto longo. A cobrança é retirada do usage informado com a resposta concluída. Uma requisição que falha não é cobrada. Os registros de uso da sua conta mostram a cobrança exata para cada requisição.

Saída

Uma requisição sem streaming retorna o objeto de resposta oficial:

{
  "id": "resp_...",
  "object": "response",
  "status": "completed",
  "model": "gpt-6-sol",
  "output": [{"type": "message", "role": "assistant", "content": [{"type": "output_text", "text": "..."}]}],
  "usage": {"input_tokens": 27, "input_tokens_details": {"cached_tokens": 0, "cache_write_tokens": 0}, "output_tokens": 102, "output_tokens_details": {"reasoning_tokens": 0}, "total_tokens": 129}
}

Com "stream": true a resposta é um fluxo dos eventos oficiais, incluindo response.created, response.output_text.delta e response.completed; o evento response.completed final contém o uso.

Chat Completions

O código Chat Completions existente precisa apenas de uma nova URL base e ID de modelo:

from openai import OpenAI

client = OpenAI(api_key="YOUR_SEEDROUTER_KEY", base_url="https://api.seedrouter.ai/v1")

chat = client.chat.completions.create(
    model="gpt-6-sol",
    messages=[{"role": "user", "content": "Hello"}],
    max_completion_tokens=1024,
)
print(chat.choices[0].message.content)

Defina o limite de saída com max_completion_tokens e o nível de raciocínio com reasoning_effort. No Chat Completions, o GPT-6 Sol oferece suporte a chamada de função apenas com reasoning_effort definido como none; use a API Responses para raciocínio com ferramentas.

Formato Anthropic Messages

Código escrito para a API Anthropic Messages também pode chamar o GPT-6 Sol: envie o corpo de Mensagens para /v1/messages com "model": "gpt-6-sol". A requisição é convertida para Chat Completions, então um campo sem contrapartida em Chat Completions não tem efeito. A resposta carrega os campos oficiais de Mensagens e pode incluir alguns campos de uso extra; leia usage.input_tokens, usage.output_tokens e os campos oficiais.

Erros

Os erros usam {"error": {"code": ..., "message": "..."}}. O code é um código do catálogo de erros comum. Requisições falhadas não são cobradas.

Dicas

  • Comece com o nível de raciocínio padrão medium, use none para etapas rápidas e simples e aumente o nível de raciocínio apenas para tarefas difíceis.
  • Defina max_output_tokens alto o suficiente para o raciocínio e também para a resposta: é um orçamento para ambos.
  • Coloque o contexto longo e reutilizado no início do prompt para que requisições posteriores o leiam do cache com a taxa mais baixa.

Relacionados