Claude Opus 5.5 已在 SeedRouter 上線
SeedRouter Docs

GPT-6 Astra

GPT-6 Astra API 串接文件:透過官方 OpenAI Responses 或 Chat Completions API 呼叫 GPT-6 Astra,支援 105 萬 token 上下文視窗、最多 128K 輸出 token,推理強度由你決定。

View Markdown

GPT-6 Astra 是 OpenAI 能力最強的模型,專為最困難的端到端工作打造:複雜推理、程式開發、研究與文件製作。傳送官方 OpenAI Responses 或 Chat Completions 請求到 SeedRouter:更改基礎 URL 和 API 金鑰,保留請求主體。

模型 ID

模型 ID上下文視窗最大輸出推理強度預設推理強度
gpt-6-astra105 萬 token(輸入 922K)128K tokenlow、medium、high、xhigh、max官方未說明

輸入:文字與圖片。輸出:文字。知識截止日期:2026 年 4 月 30 日。參見模型頁查看目前價格。

快速範例

curl https://api.seedrouter.ai/v1/responses \
  -H "Authorization: Bearer $SEEDROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-6-astra",
    "input": "Summarize the trade-offs of event sourcing in three bullet points."
  }'

端點

格式方法和路徑驗證方式
OpenAI ResponsesPOST https://api.seedrouter.ai/v1/responsesAuthorization: Bearer <key>
OpenAI Chat CompletionsPOST https://api.seedrouter.ai/v1/chat/completionsAuthorization: Bearer <key>
Anthropic MessagesPOST https://api.seedrouter.ai/v1/messagesx-api-key: <key> 或 Authorization: Bearer <key>,加上 anthropic-version

OpenAI 端點會原樣轉發你的請求主體,並回傳官方回應。請把 API 金鑰保存在伺服器端程式碼中。

參數

Responses API 欄位:

名稱型別必填預設值說明
modelstring是—gpt-6-astra。
inputstring or object[]是—一段提示,或多個輸入項目:content 內含 input_text 與 input_image 片段的訊息。
instructionsstring否—系統(開發者)指令。
max_output_tokensinteger否模型上限16–128000。包括推理 token。
reasoning.effortenum否官方未說明low、medium、high、xhigh、max。
reasoning.summaryenum否—auto、concise 或 detailed:回傳推理過程的摘要。
reasoning.modeenum否standardstandard 或 pro。
reasoning.contextenum否autoauto、current_turn 或 all_turns:決定模型能看到哪些先前的推理內容。
text.verbosityenum否mediumlow、medium 或 high。
text.formatobject否—結構化輸出,例如 {"type": "json_schema", "name": "...", "schema": {...}}。
temperaturenumber否—0–2。不接受:GPT-6 Astra 一律會推理。請省略此項。
top_pnumber否—0–1。不接受:GPT-6 Astra 一律會推理。請省略此項。
top_logprobsinteger否—0–20。不接受:GPT-6 Astra 一律會推理。請省略此項。
streamboolean否false以伺服器傳送事件的形式串流回應。
tools, tool_choice, parallel_tool_calls, max_tool_calls, include, metadata, store, truncation, prompt_cache_key, prompt_cache_options, prompt_cache_retention, context_management, moderation, prompt, previous_response_id, conversation, user—否—原樣轉發。

不提供:background、service_tier(包括 Batch、Flex 與 fast 模式)以及 safety_identifier。

推理與推理強度

GPT-6 Astra 一律會推理:不支援 none,傳入會回傳 400 錯誤。OpenAI 沒有說明 GPT-6 Astra 的預設推理強度;省略 reasoning.effort 即使用模型本身的預設值。推理強度越高,通常表示輸出 token 越多、等待時間越長、成本越高。推理 token 按輸出 token 計費,並計入 max_output_tokens。

圖片輸入

圖片放在使用者訊息的 content 中,以帶有 image_url 的 input_image 片段傳入:

{"role": "user", "content": [
  {"type": "input_image", "image_url": "https://example.com/chart.png"},
  {"type": "input_text", "text": "What does this chart show?"}
]}

請將範例 URL 換成你自己、可公開存取的圖片。

計費維度

參見模型頁上的目前費率。請求按使用的 token 計費:

  • 輸入 token、
  • 輸出 token(包括推理)、
  • 快取輸入 token(usage.input_tokens_details.cached_tokens)、以及
  • 快取寫入 token(usage.input_tokens_details.cache_write_tokens)。

當提示的輸入 token 超過 272K 時,整個請求都按長上下文費率計費。費用依完成回應所回報的 usage 計算。失敗的請求不計費。你的帳戶使用記錄會顯示每個請求的確切費用。

輸出

非串流請求回傳官方回應物件:

{
  "id": "resp_...",
  "object": "response",
  "status": "completed",
  "model": "gpt-6-astra",
  "output": [{"type": "message", "role": "assistant", "content": [{"type": "output_text", "text": "..."}]}],
  "usage": {"input_tokens": 27, "input_tokens_details": {"cached_tokens": 0, "cache_write_tokens": 0}, "output_tokens": 102, "output_tokens_details": {"reasoning_tokens": 0}, "total_tokens": 129}
}

當使用 "stream": true 時,回應是官方事件的串流,包括 response.created、response.output_text.delta 與 response.completed;最後的 response.completed 事件帶有用量資訊。

Chat Completions

現有的 Chat Completions 程式碼只需換上新的基礎 URL 和模型 ID:

from openai import OpenAI

client = OpenAI(api_key="YOUR_SEEDROUTER_KEY", base_url="https://api.seedrouter.ai/v1")

chat = client.chat.completions.create(
    model="gpt-6-astra",
    messages=[{"role": "user", "content": "Hello"}],
    max_completion_tokens=1024,
)
print(chat.choices[0].message.content)

用 max_completion_tokens 設定輸出上限,用 reasoning_effort 設定推理強度。GPT-6 Astra 在 Chat Completions 上不支援函式呼叫;需要工具時請改用 Responses API。

Anthropic Messages 格式

為 Anthropic Messages API 撰寫的程式碼也能呼叫 GPT-6 Astra:把 Messages 請求主體以 "model": "gpt-6-astra" 傳送到 /v1/messages。請求會被轉換成 Chat Completions 格式,所以沒有 Chat Completions 對應的欄位沒有效果。回應帶有官方 Messages 欄位,可能包括一些額外的用量欄位;請讀取 usage.input_tokens、usage.output_tokens 與官方欄位。

錯誤

錯誤使用 {"error": {"code": ..., "message": "..."}} 格式。code 是來自共用錯誤目錄的代碼。失敗的請求不計費。

實用建議

  • 從 medium 開始,只有需要更深入推理的任務才提高推理強度;推理強度會同時影響品質與成本。
  • 把 max_output_tokens 設得足夠高,同時容納推理與答案:它是兩者共用的預算。
  • 將長的、重複使用的上下文放在提示開頭,讓後續請求以較低費率從快取讀取。

相關