Claude Opus 5.5을(를) SeedRouter에서 사용할 수 있습니다
SeedRouter Docs

GPT-6 Sol

GPT-6 Sol API를 공식 OpenAI Responses 또는 Chat Completions 형식으로 호출하세요: 105만 토큰 컨텍스트 윈도우, 최대 128K 출력 토큰, 직접 선택하는 추론 강도.

View Markdown

GPT-6 Sol은 복잡한 코딩과 에이전트 워크플로를 위한 OpenAI의 GPT-6 모델로, 성능과 가격 모두 GPT-6 Astra와 GPT-6 Luna 사이에 있습니다. 공식 OpenAI Responses 또는 Chat Completions 요청을 SeedRouter로 보냅니다: 기본 URL과 API 키만 바꾸고 본문은 그대로 유지합니다.

모델 ID

모델 ID컨텍스트 윈도우최대 출력추론 강도기본 추론 강도
gpt-6-sol105만 토큰(입력 92만 2,000)128,000 토큰none, low, medium, high, xhigh, maxmedium

입력: 텍스트와 이미지. 출력: 텍스트. 지식 컷오프: 2026년 4월 20일. 모델 페이지에서 현재 요금을 확인하세요.

빠른 예제

curl https://api.seedrouter.ai/v1/responses \
  -H "Authorization: Bearer $SEEDROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-6-sol",
    "input": "Summarize the trade-offs of event sourcing in three bullet points."
  }'

엔드포인트

형식메서드 및 경로인증
OpenAI ResponsesPOST https://api.seedrouter.ai/v1/responsesAuthorization: Bearer <key>
OpenAI Chat CompletionsPOST https://api.seedrouter.ai/v1/chat/completionsAuthorization: Bearer <key>
Anthropic MessagesPOST https://api.seedrouter.ai/v1/messagesx-api-key: <key> 또는 Authorization: Bearer <key>, 그리고 anthropic-version

OpenAI 엔드포인트는 요청 본문을 보낸 그대로 전달하고 공식 응답을 반환합니다. API 키는 서버 측 코드에 보관하세요.

파라미터

Responses API 필드:

이름타입필수기본값설명
modelstring예—gpt-6-sol.
inputstring or object[]예—프롬프트 또는 입력 항목: content에 input_text와 input_image 파트를 담은 메시지.
instructionsstring아니요—시스템(developer) 지침.
max_output_tokensinteger아니요모델 최대값16–128000. 추론 토큰을 포함합니다.
reasoning.effortenum아니요mediumnone, low, medium, high, xhigh, max.
reasoning.summaryenum아니요—auto, concise 또는 detailed: 추론 요약을 반환합니다.
reasoning.modeenum아니요standardstandard 또는 pro.
reasoning.contextenum아니요autoauto, current_turn 또는 all_turns: 이전 추론 중 어떤 부분을 모델에 보여줄지 정합니다.
text.verbosityenum아니요mediumlow, medium 또는 high.
text.formatobject아니요—구조화된 출력. 예: {"type": "json_schema", "name": "...", "schema": {...}}.
temperaturenumber아니요—0–2. reasoning.effort가 none으로 설정된 경우에만 허용됩니다.
top_pnumber아니요—0–1. reasoning.effort가 none으로 설정된 경우에만 허용됩니다.
top_logprobsinteger아니요—0–20. reasoning.effort가 none으로 설정된 경우에만 허용됩니다.
streamboolean아니요false응답을 서버 전송 이벤트로 스트리밍합니다.
tools, tool_choice, parallel_tool_calls, max_tool_calls, include, metadata, store, truncation, prompt_cache_key, prompt_cache_options, prompt_cache_retention, context_management, moderation, prompt, previous_response_id, conversation, user—아니요—그대로 전달됩니다.

사용할 수 없음: background, service_tier(Batch, Flex, fast 모드 포함), safety_identifier.

추론과 추론 강도

GPT-6 Sol의 기본값은 medium입니다. none에서는 모델이 추론 없이 답하며, 이때만 temperature, top_p, top_logprobs가 허용됩니다. 더 높은 추론 강도는 보통 더 많은 출력 토큰, 더 긴 대기 시간, 더 높은 비용을 의미합니다. 추론 토큰은 출력 토큰으로 청구되며 max_output_tokens에 포함됩니다.

이미지 입력

이미지는 사용자 메시지의 content에 image_url을 가진 input_image 파트로 들어갑니다:

{"role": "user", "content": [
  {"type": "input_image", "image_url": "https://example.com/chart.png"},
  {"type": "input_text", "text": "What does this chart show?"}
]}

예제 URL을 본인의 공개 액세스 가능 이미지로 바꾸세요.

청구 규모

모델 페이지의 현재 요금을 참조하세요. 요청은 사용한 토큰으로 청구됩니다:

  • 입력 토큰,
  • 추론을 포함한 출력 토큰,
  • 캐시된 입력 토큰(usage.input_tokens_details.cached_tokens), 그리고
  • 캐시 쓰기 토큰(usage.input_tokens_details.cache_write_tokens).

프롬프트의 입력 토큰이 27만 2,000개를 넘으면 요청 전체가 장문 컨텍스트 요금으로 청구됩니다. 청구는 완성된 응답과 함께 보고된 usage에서 가져옵니다. 실패한 요청은 청구되지 않습니다. 계정의 사용 기록에 모든 요청의 정확한 청구 금액이 표시됩니다.

출력

비스트리밍 요청은 공식 응답 객체를 반환합니다:

{
  "id": "resp_...",
  "object": "response",
  "status": "completed",
  "model": "gpt-6-sol",
  "output": [{"type": "message", "role": "assistant", "content": [{"type": "output_text", "text": "..."}]}],
  "usage": {"input_tokens": 27, "input_tokens_details": {"cached_tokens": 0, "cache_write_tokens": 0}, "output_tokens": 102, "output_tokens_details": {"reasoning_tokens": 0}, "total_tokens": 129}
}

"stream": true일 때 응답은 response.created, response.output_text.delta, response.completed를 포함한 공식 이벤트 스트림입니다. 마지막 response.completed 이벤트가 사용량을 포함합니다.

Chat Completions

기존 Chat Completions 코드는 새 기본 URL과 모델 ID만 필요합니다:

from openai import OpenAI

client = OpenAI(api_key="YOUR_SEEDROUTER_KEY", base_url="https://api.seedrouter.ai/v1")

chat = client.chat.completions.create(
    model="gpt-6-sol",
    messages=[{"role": "user", "content": "Hello"}],
    max_completion_tokens=1024,
)
print(chat.choices[0].message.content)

출력 한도는 max_completion_tokens로, 추론 강도는 reasoning_effort로 설정합니다. Chat Completions에서 GPT-6 Sol은 reasoning_effort가 none으로 설정된 경우에만 함수 호출을 지원합니다. 도구와 함께 추론하려면 Responses API를 사용하세요.

Anthropic Messages 형식

Anthropic Messages API용으로 작성한 코드도 GPT-6 Sol을 호출할 수 있습니다: Messages 본문을 "model": "gpt-6-sol"와 함께 /v1/messages로 보내세요. 이 요청은 Chat Completions로 변환되므로, Chat Completions 대응물이 없는 필드는 영향을 미치지 않습니다. 응답은 공식 Messages 필드를 포함하며 몇 가지 추가 사용 필드가 포함될 수 있습니다. usage.input_tokens, usage.output_tokens와 공식 필드를 읽으세요.

오류

오류는 {"error": {"code": ..., "message": "..."}}를 사용합니다. code는 공통 오류 카탈로그의 코드입니다. 실패한 요청은 청구되지 않습니다.

팁

  • 기본값인 medium 추론 강도부터 시작하고, 빠르고 간단한 단계에는 none을 쓰고, 어려운 작업에서만 추론 강도를 높이세요.
  • max_output_tokens를 답변뿐 아니라 추론까지 충분하게 설정하세요: 이는 둘 다의 단일 예산입니다.
  • 길고 재사용되는 컨텍스트를 프롬프트 앞부분에 두어 이후 요청이 더 낮은 요금으로 캐시에서 읽도록 하세요.

관련