GPT-6 Sol
Use o GPT-6 Sol com a API oficial OpenAI Responses ou Chat Completions: janela de contexto de 1.05M de tokens, até 128K tokens de saída e o nível de raciocínio que você escolher.
O GPT-6 Sol é o modelo GPT-6 da OpenAI para programação complexa e fluxos de trabalho agênticos, entre o GPT-6 Astra e o GPT-6 Luna em capacidade e preço. Envie a requisição oficial OpenAI Responses ou Chat Completions para o SeedRouter: altere a URL base e a chave de API, mantenha o corpo.
ID do modelo
| ID do modelo | Janela de contexto | Saída máxima | Nível de raciocínio | Nível de raciocínio padrão |
|---|---|---|---|---|
gpt-6-sol | 1.05M tokens (922K de entrada) | 128K tokens | none, low, medium, high, xhigh, max | medium |
Entrada: texto e imagens. Saída: texto. Data de corte do conhecimento: 20 de abril de 2026. Consulte a página do modelo para os preços atuais.
Exemplo rápido
curl https://api.seedrouter.ai/v1/responses \
-H "Authorization: Bearer $SEEDROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-6-sol",
"input": "Summarize the trade-offs of event sourcing in three bullet points."
}'Endpoints
| Formato | Método e caminho | Autenticação |
|---|---|---|
| OpenAI Responses | POST https://api.seedrouter.ai/v1/responses | Authorization: Bearer <key> |
| OpenAI Chat Completions | POST https://api.seedrouter.ai/v1/chat/completions | Authorization: Bearer <key> |
| Anthropic Messages | POST https://api.seedrouter.ai/v1/messages | x-api-key: <key> ou Authorization: Bearer <key>, mais anthropic-version |
Os endpoints OpenAI encaminham o corpo da sua requisição como enviado e retornam a resposta oficial. Mantenha a chave de API em código do lado do servidor.
Parâmetros
Campos da API Responses:
| Nome | Tipo | Obrigatório | Padrão | Observações |
|---|---|---|---|---|
model | string | Sim | — | gpt-6-sol. |
input | string or object[] | Sim | — | Um prompt ou itens de entrada: mensagens cujo content contém partes input_text e input_image. |
instructions | string | Não | — | Instruções de sistema (desenvolvedor). |
max_output_tokens | integer | Não | Máximo do modelo | 16–128000. Inclui os tokens de raciocínio. |
reasoning.effort | enum | Não | medium | none, low, medium, high, xhigh, max. |
reasoning.summary | enum | Não | — | auto, concise ou detailed: retorna um resumo do raciocínio. |
reasoning.mode | enum | Não | standard | standard ou pro. |
reasoning.context | enum | Não | auto | auto, current_turn ou all_turns: qual raciocínio anterior é mostrado ao modelo. |
text.verbosity | enum | Não | medium | low, medium ou high. |
text.format | object | Não | — | Saída estruturada, por exemplo {"type": "json_schema", "name": "...", "schema": {...}}. |
temperature | number | Não | — | 0–2. Aceito apenas com reasoning.effort definido como none. |
top_p | number | Não | — | 0–1. Aceito apenas com reasoning.effort definido como none. |
top_logprobs | integer | Não | — | 0–20. Aceito apenas com reasoning.effort definido como none. |
stream | boolean | Não | false | Transmitir a resposta como eventos enviados pelo servidor. |
tools, tool_choice, parallel_tool_calls, max_tool_calls, include, metadata, store, truncation, prompt_cache_key, prompt_cache_options, prompt_cache_retention, context_management, moderation, prompt, previous_response_id, conversation, user | — | Não | — | Encaminhados conforme enviados. |
Não disponíveis: background, service_tier (incluindo Batch, Flex e o modo rápido) e safety_identifier.
Raciocínio e nível de raciocínio
O GPT-6 Sol usa medium por padrão. Com none o modelo responde sem raciocinar, e só então temperature, top_p e top_logprobs são aceitos. Um nível de raciocínio maior geralmente significa mais tokens de saída, uma espera mais longa e um custo mais alto. Os tokens de raciocínio são cobrados como tokens de saída e contam para max_output_tokens.
Entrada de imagem
As imagens vão no content de uma mensagem do usuário como partes input_image com uma image_url:
{"role": "user", "content": [
{"type": "input_image", "image_url": "https://example.com/chart.png"},
{"type": "input_text", "text": "What does this chart show?"}
]}Substitua a URL de exemplo por uma imagem sua publicamente acessível.
Dimensões de cobrança
Consulte as taxas atuais na página do modelo. Uma requisição é cobrada pelos tokens que usa:
- tokens de entrada,
- tokens de saída, incluindo raciocínio,
- tokens de entrada em cache (
usage.input_tokens_details.cached_tokens), e - tokens de escrita em cache (
usage.input_tokens_details.cache_write_tokens).
Quando um prompt tem mais de 272K tokens de entrada, a requisição inteira é cobrada pelas taxas de contexto longo. A cobrança é retirada do usage informado com a resposta concluída. Uma requisição que falha não é cobrada. Os registros de uso da sua conta mostram a cobrança exata para cada requisição.
Saída
Uma requisição sem streaming retorna o objeto de resposta oficial:
{
"id": "resp_...",
"object": "response",
"status": "completed",
"model": "gpt-6-sol",
"output": [{"type": "message", "role": "assistant", "content": [{"type": "output_text", "text": "..."}]}],
"usage": {"input_tokens": 27, "input_tokens_details": {"cached_tokens": 0, "cache_write_tokens": 0}, "output_tokens": 102, "output_tokens_details": {"reasoning_tokens": 0}, "total_tokens": 129}
}Com "stream": true a resposta é um fluxo dos eventos oficiais, incluindo response.created, response.output_text.delta e response.completed; o evento response.completed final contém o uso.
Chat Completions
O código Chat Completions existente precisa apenas de uma nova URL base e ID de modelo:
from openai import OpenAI
client = OpenAI(api_key="YOUR_SEEDROUTER_KEY", base_url="https://api.seedrouter.ai/v1")
chat = client.chat.completions.create(
model="gpt-6-sol",
messages=[{"role": "user", "content": "Hello"}],
max_completion_tokens=1024,
)
print(chat.choices[0].message.content)Defina o limite de saída com max_completion_tokens e o nível de raciocínio com reasoning_effort. No Chat Completions, o GPT-6 Sol oferece suporte a chamada de função apenas com reasoning_effort definido como none; use a API Responses para raciocínio com ferramentas.
Formato Anthropic Messages
Código escrito para a API Anthropic Messages também pode chamar o GPT-6 Sol: envie o corpo de Mensagens para /v1/messages com "model": "gpt-6-sol". A requisição é convertida para Chat Completions, então um campo sem contrapartida em Chat Completions não tem efeito. A resposta carrega os campos oficiais de Mensagens e pode incluir alguns campos de uso extra; leia usage.input_tokens, usage.output_tokens e os campos oficiais.
Erros
Os erros usam {"error": {"code": ..., "message": "..."}}. O code é um código do catálogo de erros comum. Requisições falhadas não são cobradas.
Dicas
- Comece com o nível de raciocínio padrão
medium, usenonepara etapas rápidas e simples e aumente o nível de raciocínio apenas para tarefas difíceis. - Defina
max_output_tokensalto o suficiente para o raciocínio e também para a resposta: é um orçamento para ambos. - Coloque o contexto longo e reutilizado no início do prompt para que requisições posteriores o leiam do cache com a taxa mais baixa.
