Claude Opus 5.5 が SeedRouter で利用できます
SeedRouter Docs

GPT-6 Sol

GPT-6 Sol を公式の OpenAI Responses API または Chat Completions API で呼び出せます。105万トークンのコンテキストウィンドウ、最大128Kの出力トークン、推論強度は自由に選択できます。

View Markdown

GPT-6 Sol は複雑なコーディングとエージェント型ワークフロー向けの OpenAI の GPT-6 モデルで、性能と価格は GPT-6 Astra と GPT-6 Luna の中間です。公式の OpenAI Responses または Chat Completions リクエストを SeedRouter に送信します: ベース URL と API キーを変更し、ボディはそのままにします。

モデル ID

モデル IDコンテキストウィンドウ最大出力推論強度デフォルトの推論強度
gpt-6-sol105万トークン(うち入力は922K)128Kトークンnone、low、medium、high、xhigh、maxmedium

入力: テキストと画像。出力: テキスト。ナレッジカットオフ: 2026年4月20日。現在の料金はモデルページをご確認ください。

クイックサンプル

curl https://api.seedrouter.ai/v1/responses \
  -H "Authorization: Bearer $SEEDROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-6-sol",
    "input": "Summarize the trade-offs of event sourcing in three bullet points."
  }'

エンドポイント

フォーマットメソッドとパス認証
OpenAI ResponsesPOST https://api.seedrouter.ai/v1/responsesAuthorization: Bearer <key>
OpenAI Chat CompletionsPOST https://api.seedrouter.ai/v1/chat/completionsAuthorization: Bearer <key>
Anthropic MessagesPOST https://api.seedrouter.ai/v1/messagesx-api-key: <key> または Authorization: Bearer <key>、加えて anthropic-version

OpenAI エンドポイントはリクエストボディをそのまま転送し、公式レスポンスを返します。API キーはサーバー側のコードに保管してください。

パラメータ

Responses API のフィールド:

名前型必須デフォルト説明
modelstringはい—gpt-6-sol。
inputstring or object[]はい—プロンプト、または入力アイテム: content に input_text と input_image のパートを含むメッセージです。
instructionsstringいいえ—システム(デベロッパー)指示。
max_output_tokensintegerいいえモデルの上限16~128000。推論トークンを含みます。
reasoning.effortenumいいえmediumnone、low、medium、high、xhigh、max。
reasoning.summaryenumいいえ—auto、concise または detailed: 推論のサマリーを返します。
reasoning.modeenumいいえstandardstandard または pro。
reasoning.contextenumいいえautoauto、current_turn または all_turns: 以前のどの推論をモデルに見せるかを指定します。
text.verbosityenumいいえmediumlow、medium または high。
text.formatobjectいいえ—構造化出力。例: {"type": "json_schema", "name": "...", "schema": {...}}。
temperaturenumberいいえ—0~2。reasoning.effort が none のときのみ受け付けられます。
top_pnumberいいえ—0~1。reasoning.effort が none のときのみ受け付けられます。
top_logprobsintegerいいえ—0~20。reasoning.effort が none のときのみ受け付けられます。
streambooleanいいえfalseレスポンスをサーバー送信イベントとしてストリーミングします。
tools, tool_choice, parallel_tool_calls, max_tool_calls, include, metadata, store, truncation, prompt_cache_key, prompt_cache_options, prompt_cache_retention, context_management, moderation, prompt, previous_response_id, conversation, user—いいえ—そのまま転送されます。

利用できないもの: background、service_tier(Batch、Flex、fast モードを含む)、safety_identifier。

推論と推論強度

GPT-6 Sol のデフォルトは medium です。none ではモデルは推論せずに回答し、そのときに限り temperature、top_p、top_logprobs が受け付けられます。推論強度を上げると、通常は出力トークンが増え、待ち時間が長くなり、コストも高くなります。推論トークンは出力トークンとして請求され、max_output_tokens にカウントされます。

画像入力

画像は、ユーザーメッセージの content に image_url を持つ input_image パートとして入れます:

{"role": "user", "content": [
  {"type": "input_image", "image_url": "https://example.com/chart.png"},
  {"type": "input_text", "text": "What does this chart show?"}
]}

例の URL を、公開アクセス可能な独自の画像に置き換えてください。

請求ディメンション

モデルページの現在のレートをご覧ください。リクエストは使用するトークンで請求されます:

  • 入力トークン、
  • 出力トークン(推論を含む)、
  • キャッシュされた入力トークン(usage.input_tokens_details.cached_tokens)、および
  • キャッシュ書き込みトークン(usage.input_tokens_details.cache_write_tokens)。

プロンプトの入力トークンが 272K を超える場合、リクエスト全体がロングコンテキストのレートで請求されます。請求は完成したレスポンスで報告された usage から差し引かれます。失敗したリクエストは請求されません。アカウントの使用記録にすべてのリクエストの正確な請求額が表示されます。

出力

非ストリーミングリクエストは公式のレスポンスオブジェクトを返します:

{
  "id": "resp_...",
  "object": "response",
  "status": "completed",
  "model": "gpt-6-sol",
  "output": [{"type": "message", "role": "assistant", "content": [{"type": "output_text", "text": "..."}]}],
  "usage": {"input_tokens": 27, "input_tokens_details": {"cached_tokens": 0, "cache_write_tokens": 0}, "output_tokens": 102, "output_tokens_details": {"reasoning_tokens": 0}, "total_tokens": 129}
}

"stream": true の場合、レスポンスは response.created、response.output_text.delta、response.completed などの公式イベントのストリームになります。最後の response.completed イベントに使用量が含まれます。

Chat Completions

既存の Chat Completions コードは、新しいベース URL とモデル ID のみが必要です:

from openai import OpenAI

client = OpenAI(api_key="YOUR_SEEDROUTER_KEY", base_url="https://api.seedrouter.ai/v1")

chat = client.chat.completions.create(
    model="gpt-6-sol",
    messages=[{"role": "user", "content": "Hello"}],
    max_completion_tokens=1024,
)
print(chat.choices[0].message.content)

出力の上限は max_completion_tokens で、推論強度は reasoning_effort で設定します。Chat Completions では、GPT-6 Sol は reasoning_effort が none のときのみ関数呼び出しをサポートします。推論とツールを併用する場合は Responses API を使用してください。

Anthropic Messages フォーマット

Anthropic Messages API 向けに書かれたコードからも GPT-6 Sol を呼び出せます: "model": "gpt-6-sol" を指定して Messages ボディを /v1/messages に送信します。リクエストは Chat Completions に変換されるため、Chat Completions に対応するものがないフィールドは効果がありません。レスポンスには公式の Messages フィールドが含まれ、いくつかの追加の使用量フィールドが含まれることがあります。usage.input_tokens、usage.output_tokens と公式フィールドを読んでください。

エラー

エラーは {"error": {"code": ..., "message": "..."}} を使用します。code は共通エラーカタログのコードです。失敗したリクエストは請求されません。

ヒント

  • デフォルトの推論強度 medium から始め、高速でシンプルな処理には none を使い、難しいタスクの場合のみ推論強度を引き上げます。
  • max_output_tokens は回答だけでなく推論にも十分な高さに設定します: これは両者のための 1 つの予算です。
  • 長く再利用されるコンテキストはプロンプトの先頭に置いてください。そうすれば、後のリクエストはより低いレートでキャッシュから読み込めます。

関連リソース