GPT-6.1 Sol
Use o GPT-6.1 Sol com a API oficial OpenAI Responses ou Chat Completions: programação e agentes perto do Astra, contexto de 1.05M de tokens e até 128K tokens de saída.
O GPT-6.1 Sol é a atualização da OpenAI para o GPT-6 Sol, voltada a programação complexa, uso do computador e trabalho profissional, com desempenho perto do GPT-6 Astra a um custo menor. Envie a requisição oficial OpenAI Responses ou Chat Completions para o SeedRouter: altere a URL base e a chave de API, mantenha o corpo.
ID do modelo
| ID do modelo | Janela de contexto | Saída máxima | Esforço de raciocínio | Esforço padrão |
|---|---|---|---|---|
gpt-6.1-sol | 1.05M tokens (922K de entrada) | 128K tokens | low, medium, high, xhigh, max | medium |
Entrada: texto e imagens. Saída: texto. Corte de conhecimento: 30 de abril de 2026. Consulte a página do modelo para os preços atuais.
Exemplo rápido
curl https://api.seedrouter.ai/v1/responses \
-H "Authorization: Bearer $SEEDROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-6.1-sol",
"input": "Summarize the trade-offs of event sourcing in three bullet points."
}'Endpoints
| Formato | Método e caminho | Autenticação |
|---|---|---|
| OpenAI Responses | POST https://api.seedrouter.ai/v1/responses | Authorization: Bearer <key> |
| OpenAI Chat Completions | POST https://api.seedrouter.ai/v1/chat/completions | Authorization: Bearer <key> |
| Anthropic Messages | POST https://api.seedrouter.ai/v1/messages | x-api-key: <key> ou Authorization: Bearer <key>, mais anthropic-version |
Os endpoints OpenAI encaminham o corpo da sua requisição como enviado e retornam a resposta oficial. Mantenha a chave de API em código do lado do servidor.
Parâmetros
Campos da API Responses:
| Nome | Tipo | Obrigatório | Padrão | Observações |
|---|---|---|---|---|
model | string | Sim | — | gpt-6.1-sol. |
input | string or object[] | Sim | — | Um prompt ou itens de entrada: mensagens cujo content contém partes input_text e input_image. |
instructions | string | Não | — | Instruções de sistema (desenvolvedor). |
max_output_tokens | integer | Não | Máximo do modelo | 16–128000. Inclui os tokens de raciocínio. |
reasoning.effort | enum | Não | medium | low, medium, high, xhigh, max. none e minimal não são aceitos. |
reasoning.summary | enum | Não | — | auto, concise ou detailed: retorna um resumo do raciocínio. |
reasoning.mode | enum | Não | standard | standard ou pro. |
reasoning.context | enum | Não | auto | auto, current_turn ou all_turns: qual raciocínio anterior é mostrado ao modelo. |
text.verbosity | enum | Não | medium | low, medium ou high. |
text.format | object | Não | — | Saída estruturada, por exemplo {"type": "json_schema", "name": "...", "schema": {...}}. |
temperature, top_p, top_logprobs | — | Não | — | Não usados pelo GPT-6.1 Sol, que sempre raciocina. Ignorados se enviados. |
stream | boolean | Não | false | Transmitir a resposta como eventos enviados pelo servidor. |
tools, tool_choice, parallel_tool_calls, max_tool_calls, include, metadata, store, truncation, prompt_cache_key, prompt_cache_options, prompt_cache_retention, context_management, moderation, prompt, previous_response_id, conversation, user | — | Não | — | Encaminhados conforme enviados. |
Não disponíveis: background, service_tier (incluindo Batch, Flex e o modo rápido) e safety_identifier.
Raciocínio e esforço
O GPT-6.1 Sol usa medium por padrão e sempre raciocina: none e minimal não são aceitos, e temperature, top_p e top_logprobs não são usados. Um esforço de raciocínio maior geralmente significa mais tokens de saída, uma espera mais longa e um custo mais alto. Os tokens de raciocínio são cobrados como tokens de saída e contam para max_output_tokens.
Entrada de imagem
As imagens vão no content de uma mensagem do usuário como partes input_image com uma image_url:
{"role": "user", "content": [
{"type": "input_image", "image_url": "https://example.com/chart.png"},
{"type": "input_text", "text": "What does this chart show?"}
]}Substitua a URL de exemplo por uma imagem sua publicamente acessível.
Dimensões de cobrança
Consulte as tarifas atuais na página do modelo. Uma requisição é cobrada pelos tokens que usa:
- tokens de entrada,
- tokens de saída, incluindo raciocínio,
- tokens de entrada em cache (
usage.input_tokens_details.cached_tokens), e - tokens de escrita no cache (
usage.input_tokens_details.cache_write_tokens).
Quando um prompt tem mais de 272K tokens de entrada, a requisição inteira é cobrada pelas tarifas de contexto longo. A cobrança é calculada a partir do usage informado com a resposta concluída. Uma requisição que falha não é cobrada. Os registros de uso da sua conta mostram a cobrança exata de cada requisição.
Saída
Uma requisição sem streaming retorna o objeto de resposta oficial:
{
"id": "resp_...",
"object": "response",
"status": "completed",
"model": "gpt-6.1-sol",
"output": [{"type": "message", "role": "assistant", "content": [{"type": "output_text", "text": "..."}]}],
"usage": {"input_tokens": 27, "input_tokens_details": {"cached_tokens": 0, "cache_write_tokens": 0}, "output_tokens": 102, "output_tokens_details": {"reasoning_tokens": 0}, "total_tokens": 129}
}Com "stream": true a resposta é um fluxo dos eventos oficiais, incluindo response.created, response.output_text.delta e response.completed; o evento response.completed final contém o uso.
Chat Completions
O código Chat Completions existente precisa apenas de uma nova URL base e um novo ID de modelo:
from openai import OpenAI
client = OpenAI(api_key="YOUR_SEEDROUTER_KEY", base_url="https://api.seedrouter.ai/v1")
chat = client.chat.completions.create(
model="gpt-6.1-sol",
messages=[{"role": "user", "content": "Hello"}],
max_completion_tokens=1024,
)
print(chat.choices[0].message.content)Defina o limite de saída com max_completion_tokens e o esforço com reasoning_effort. Use a API Responses para chamada de ferramentas.
Formato Anthropic Messages
Código escrito para a API Anthropic Messages também pode chamar o GPT-6.1 Sol: envie o corpo de Messages para /v1/messages com "model": "gpt-6.1-sol". A requisição é convertida para Chat Completions, então um campo sem equivalente em Chat Completions não tem efeito. A resposta traz os campos oficiais de Messages e pode incluir alguns campos de uso extras; leia usage.input_tokens, usage.output_tokens e os campos oficiais.
Erros
Os erros usam {"error": {"code": ..., "message": "..."}}. O code é um código do catálogo de erros comum. Requisições com falha não são cobradas.
Dicas
- Comece com o esforço padrão
medium, uselowpara etapas rápidas e simples e aumente o esforço apenas para tarefas difíceis. - Defina
max_output_tokensalto o suficiente para o raciocínio e também para a resposta: é um único orçamento para os dois. - Coloque o contexto longo e reutilizado no início do prompt para que requisições posteriores o leiam do cache à tarifa mais baixa.
