GPT-6 Sol
GPT-6 Sol API 串接文件:透過官方 OpenAI Responses 或 Chat Completions API 呼叫 GPT-6 Sol,支援 105 萬 token 上下文視窗、最多 128K 輸出 token,推理強度由你決定。
GPT-6 Sol 是 OpenAI 針對複雜程式開發與代理工作流程推出的 GPT-6 模型,能力與價格介於 GPT-6 Astra 和 GPT-6 Luna 之間。傳送官方 OpenAI Responses 或 Chat Completions 請求到 SeedRouter:更改基礎 URL 和 API 金鑰,保留請求主體。
模型 ID
| 模型 ID | 上下文視窗 | 最大輸出 | 推理強度 | 預設推理強度 |
|---|---|---|---|---|
gpt-6-sol | 105 萬 token(輸入 922K) | 128K token | none、low、medium、high、xhigh、max | medium |
輸入:文字與圖片。輸出:文字。知識截止日期:2026 年 4 月 20 日。參見模型頁查看目前價格。
快速範例
curl https://api.seedrouter.ai/v1/responses \
-H "Authorization: Bearer $SEEDROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-6-sol",
"input": "Summarize the trade-offs of event sourcing in three bullet points."
}'端點
| 格式 | 方法和路徑 | 驗證方式 |
|---|---|---|
| OpenAI Responses | POST https://api.seedrouter.ai/v1/responses | Authorization: Bearer <key> |
| OpenAI Chat Completions | POST https://api.seedrouter.ai/v1/chat/completions | Authorization: Bearer <key> |
| Anthropic Messages | POST https://api.seedrouter.ai/v1/messages | x-api-key: <key> 或 Authorization: Bearer <key>,加上 anthropic-version |
OpenAI 端點會原樣轉發你的請求主體,並回傳官方回應。請把 API 金鑰保存在伺服器端程式碼中。
參數
Responses API 欄位:
| 名稱 | 型別 | 必填 | 預設值 | 說明 |
|---|---|---|---|---|
model | string | 是 | — | gpt-6-sol。 |
input | string or object[] | 是 | — | 一段提示,或多個輸入項目:content 內含 input_text 與 input_image 片段的訊息。 |
instructions | string | 否 | — | 系統(開發者)指令。 |
max_output_tokens | integer | 否 | 模型上限 | 16–128000。包括推理 token。 |
reasoning.effort | enum | 否 | medium | none、low、medium、high、xhigh、max。 |
reasoning.summary | enum | 否 | — | auto、concise 或 detailed:回傳推理過程的摘要。 |
reasoning.mode | enum | 否 | standard | standard 或 pro。 |
reasoning.context | enum | 否 | auto | auto、current_turn 或 all_turns:決定模型能看到哪些先前的推理內容。 |
text.verbosity | enum | 否 | medium | low、medium 或 high。 |
text.format | object | 否 | — | 結構化輸出,例如 {"type": "json_schema", "name": "...", "schema": {...}}。 |
temperature | number | 否 | — | 0–2。僅在 reasoning.effort 設為 none 時接受。 |
top_p | number | 否 | — | 0–1。僅在 reasoning.effort 設為 none 時接受。 |
top_logprobs | integer | 否 | — | 0–20。僅在 reasoning.effort 設為 none 時接受。 |
stream | boolean | 否 | false | 以伺服器傳送事件的形式串流回應。 |
tools, tool_choice, parallel_tool_calls, max_tool_calls, include, metadata, store, truncation, prompt_cache_key, prompt_cache_options, prompt_cache_retention, context_management, moderation, prompt, previous_response_id, conversation, user | — | 否 | — | 原樣轉發。 |
不提供:background、service_tier(包括 Batch、Flex 與 fast 模式)以及 safety_identifier。
推理與推理強度
GPT-6 Sol 預設為 medium。設為 none 時模型不經推理直接回答,也只有在這個設定下才接受 temperature、top_p 與 top_logprobs。推理強度越高,通常表示輸出 token 越多、等待時間越長、成本越高。推理 token 按輸出 token 計費,並計入 max_output_tokens。
圖片輸入
圖片放在使用者訊息的 content 中,以帶有 image_url 的 input_image 片段傳入:
{"role": "user", "content": [
{"type": "input_image", "image_url": "https://example.com/chart.png"},
{"type": "input_text", "text": "What does this chart show?"}
]}請將範例 URL 換成你自己、可公開存取的圖片。
計費維度
參見模型頁上的目前費率。請求按使用的 token 計費:
- 輸入 token、
- 輸出 token(包括推理)、
- 快取輸入 token(
usage.input_tokens_details.cached_tokens)、以及 - 快取寫入 token(
usage.input_tokens_details.cache_write_tokens)。
當提示的輸入 token 超過 272K 時,整個請求都按長上下文費率計費。費用依完成回應所回報的 usage 計算。失敗的請求不計費。你的帳戶使用記錄會顯示每個請求的確切費用。
輸出
非串流請求回傳官方回應物件:
{
"id": "resp_...",
"object": "response",
"status": "completed",
"model": "gpt-6-sol",
"output": [{"type": "message", "role": "assistant", "content": [{"type": "output_text", "text": "..."}]}],
"usage": {"input_tokens": 27, "input_tokens_details": {"cached_tokens": 0, "cache_write_tokens": 0}, "output_tokens": 102, "output_tokens_details": {"reasoning_tokens": 0}, "total_tokens": 129}
}當使用 "stream": true 時,回應是官方事件的串流,包括 response.created、response.output_text.delta 與 response.completed;最後的 response.completed 事件帶有用量資訊。
Chat Completions
現有的 Chat Completions 程式碼只需換上新的基礎 URL 和模型 ID:
from openai import OpenAI
client = OpenAI(api_key="YOUR_SEEDROUTER_KEY", base_url="https://api.seedrouter.ai/v1")
chat = client.chat.completions.create(
model="gpt-6-sol",
messages=[{"role": "user", "content": "Hello"}],
max_completion_tokens=1024,
)
print(chat.choices[0].message.content)用 max_completion_tokens 設定輸出上限,用 reasoning_effort 設定推理強度。在 Chat Completions 上,GPT-6 Sol 只有在 reasoning_effort 設為 none 時才支援函式呼叫;若要在推理的同時使用工具,請改用 Responses API。
Anthropic Messages 格式
為 Anthropic Messages API 撰寫的程式碼也能呼叫 GPT-6 Sol:把 Messages 請求主體以 "model": "gpt-6-sol" 傳送到 /v1/messages。請求會被轉換成 Chat Completions 格式,所以沒有 Chat Completions 對應的欄位沒有效果。回應帶有官方 Messages 欄位,可能包括一些額外的用量欄位;請讀取 usage.input_tokens、usage.output_tokens 與官方欄位。
錯誤
錯誤使用 {"error": {"code": ..., "message": "..."}} 格式。code 是來自共用錯誤目錄的代碼。失敗的請求不計費。
實用建議
- 從預設的
medium推理強度開始,快速、簡單的步驟用none,只有困難的任務才提高推理強度。 - 把
max_output_tokens設得足夠高,同時容納推理與答案:它是兩者共用的預算。 - 將長的、重複使用的上下文放在提示開頭,讓後續請求以較低費率從快取讀取。
