Text
Grok 4.7
以原生 Chat Completions、Responses 或 Messages 請求呼叫 Grok 4.7,查看參數、串流輸出、用量與目前能力限制。
以下三種格式皆可用於 grok-4.7,並以你的 SeedRouter API key 驗證身分。模型頁面提供 Playground 與目前的 Token 價格;價格指南則說明快取輸入與推理的計費方式。
快速開始
curl https://api.seedrouter.ai/v1/responses \
-H "Authorization: Bearer $SEEDROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"grok-4.7","input":"What is 2 + 2?","reasoning":{"effort":"low"},"max_output_tokens":64,"store":false}'JSON 回應包含 output 項目與 usage。建立對話歷史時,請保留所有輸出項目,包括推理與工具項目。
請求格式
| 格式 | 端點 | 必填欄位 |
|---|---|---|
| Responses | POST /v1/responses | model, input |
| Chat Completions | POST /v1/chat/completions | model, messages |
| Messages | POST /v1/messages | model, messages, max_tokens |
使用 Content-Type: application/json 與 Authorization: Bearer $SEEDROUTER_API_KEY。Messages 用戶端亦可傳送 anthropic-version: 2023-06-01。
參數與限制
OpenAPI 規格包含完整的巢狀請求與回應 schema。下表列出所有支援的頂層請求欄位。未知欄位,以及官方明確指出此模型會忽略的參數,都會被捨棄。支援的參數若帶入無效值,仍屬無效請求。
可選且允許空值的欄位接受明確指定的 null;省略欄位則採用其 API 預設值。Playground 隱藏 user,並將 model 固定為 grok-4.7。API 用戶端仍可傳送 user。
- 上下文:50 萬個 Token,包含對話與輸出。
- 推理強度:
low、medium、high、xhigh;預設為high。 max_completion_tokens與max_output_tokens預設限制為 128,000 個可見輸出 Token。推理與函式呼叫 Token 不計入此可見輸出限制。這是預設值,並非最大輸出能力的宣稱。- 輸出限制必須是正整數。API 也會套用既有的整數安全上限 1,073,741,823;上下文容量限制仍然適用。
temperature:0 至 2,預設 1。top_p:大於 0 且不超過 1,預設 1。Responses 的min_p:0 至 1;top_k:至少為 1 的整數。- 最多 350 個工具定義。
stream_options要求stream: true。 instructions不可與previous_response_id同時使用。推理摘要一律採詳細模式。
Responses 參數
| 欄位 | 型別 | 規則 |
|---|---|---|
include | 陣列或 null | 額外納入回應的欄位陣列。 |
input(必填) | 物件或其他支援的型別 | 文字字串或完整的輸入項目陣列。 |
instructions | 字串或 null | 系統指令;不可與 previous_response_id 同時使用。 |
max_output_tokens | 整數或 null | 可見輸出限制;預設 128,000。 |
max_turns | 整數或 null | 以整數指定代理的最大執行輪數。 |
min_p | 數值或 null | 0 至 1 的數值。 |
model(必填) | 字串 | 固定為 grok-4.7。 |
parallel_tool_calls | 布林值或 null | 布林值;預設 true。 |
previous_response_id | 字串或 null | 字串型別的回應 ID;目前無法依 ID 接續對話。 |
prompt_cache_key | 字串或 null | 字串型別的快取鍵。 |
reasoning | 物件 | 推理設定;推理強度預設為 high。 |
reasoning_effort | 字串或 null | low、medium、high、xhigh;預設 high。 |
safety_identifier | 字串或 null | 可選的安全識別碼,由呼叫端提供。 |
search_parameters | 物件 | 搜尋設定。 |
service_tier | 字串 | auto、default、priority、fast;priority 與 fast 的 Token 費率加倍。 |
store | 布林值或 null | 布林值;預設 true。目前無法對已儲存的回應執行相關操作。 |
stream | 布林值或 null | 布林值;預設 false。 |
temperature | 數值或 null | 0 至 2 的數值;預設 1。 |
text | 物件 | 文字回應設定,包含 format。 |
tool_choice | 物件或其他支援的型別 | 自動、停用、強制呼叫或指定工具;語法依格式而定。 |
tools | 陣列或 null | 工具定義;最多 350 個。 |
top_k | 整數或 null | 整數;Responses 要求至少為 1。 |
top_p | 數值或 null | 大於 0 且不超過 1 的數值;預設 1。 |
user | 字串或 null | 可選的呼叫端識別碼;在 Playground 中隱藏。 |
Chat Completions 參數
| 欄位 | 型別 | 規則 |
|---|---|---|
deferred | 布林值或 null | 布林值;預設 false。目前無法取得延後完成的回應。 |
max_completion_tokens | 整數或 null | 可見輸出限制;預設 128,000。 |
max_tokens | 整數或 null | 正整數的可見輸出限制。Messages 必填。 |
messages(必填) | 陣列 | 採用此格式的對話訊息。 |
model(必填) | 字串 | 固定為 grok-4.7。 |
n | 整數或 null | 至少為 1 的整數;預設 1。 |
parallel_tool_calls | 布林值或 null | 布林值;預設 true。 |
prompt_cache_key | 字串或 null | 字串型別的快取鍵。 |
reasoning_effort | 字串或 null | low、medium、high、xhigh;預設 high。 |
response_format | 物件或其他支援的型別 | 文字、JSON 物件或 JSON schema 輸出。 |
safety_identifier | 字串或 null | 可選的安全識別碼,由呼叫端提供。 |
search_parameters | 物件 | 搜尋設定。 |
seed | 整數或 null | 整數型別的取樣種子。 |
service_tier | 字串 | auto、default、priority、fast;priority 與 fast 的 Token 費率加倍。 |
stream | 布林值或 null | 布林值;預設 false。 |
stream_options | 物件 | 串流選項;要求 stream: true。 |
temperature | 數值或 null | 0 至 2 的數值;預設 1。 |
tool_choice | 物件或其他支援的型別 | 自動、停用、強制呼叫或指定工具;語法依格式而定。 |
tools | 陣列或 null | 工具定義;最多 350 個。 |
top_p | 數值或 null | 大於 0 且不超過 1 的數值;預設 1。 |
user | 字串或 null | 可選的呼叫端識別碼;在 Playground 中隱藏。 |
web_search_options | 物件 | 相容格式的搜尋選項。 |
Messages 參數
| 欄位 | 型別 | 規則 |
|---|---|---|
max_tokens(必填) | 整數 | 正整數的可見輸出限制。Messages 必填。 |
messages(必填) | 陣列 | 採用此格式的對話訊息。 |
metadata | 物件 | Messages 中繼資料物件。 |
model(必填) | 字串 | 固定為 grok-4.7。 |
stop_sequences | 陣列或 null | 停止字串陣列。 |
stream | 布林值或 null | 布林值;預設 false。 |
system | 物件或其他支援的型別 | 系統字串或內容區塊。 |
temperature | 數值或 null | 0 至 2 的數值;預設 1。 |
tool_choice | 物件或其他支援的型別 | 自動、停用、強制呼叫或指定工具;語法依格式而定。 |
tools | 陣列或 null | 工具定義;最多 350 個。 |
top_k | 整數或 null | 整數;Responses 要求至少為 1。 |
top_p | 數值或 null | 大於 0 且不超過 1 的數值;預設 1。 |
串流輸出
將 stream 設為 true。Chat 會傳送 completion 區塊;Responses 會傳送具名回應事件;Messages 會傳送訊息與內容區塊事件。除了文字增量,也要讀取最終用量事件。工具呼叫與推理可能是獨立的輸出項目;保存歷史時,不要只留下串流中的可見文字。
{
"model": "grok-4.7",
"input": "Explain a mutex in one sentence.",
"reasoning": { "effort": "low" },
"max_output_tokens": 128,
"store": false,
"stream": true
}工具與結構化輸出
使用所選格式對應的工具定義。Chat 使用 response_format;Responses 使用 text.format。函式、網頁搜尋、X 搜尋、程式碼解譯器與 MCP 呼叫都已透過此模型實測。Shell 會傳回由用戶端執行的呼叫,不會自動在你的電腦上執行指令。完整 schema 也描述了其他工具型別;僅有 schema 項目,不能證明某項外部服務已完成設定。
{
"model": "grok-4.7",
"input": "Use the code interpreter once to compute 13*17. Return the number.",
"tools": [{ "type": "code_interpreter" }],
"tool_choice": "required",
"max_turns": 1,
"reasoning": { "effort": "low" },
"max_output_tokens": 32,
"store": false
}工具用量與 Token 分開計費。網頁搜尋及程式碼解譯器按呼叫次數計費。X 搜尋按擷取的貼文與個人檔案數量計費,包含重複擷取的項目;X 搜尋的呼叫次數不是計費單位。請查看 usage.server_side_tool_usage_details 及帳號用量紀錄。
用量與價格
價格取決於輸入總長度。輸入少於 20 萬個 Token 時,採用標準級距;達到或超過 20 萬個 Token 時,整個請求採用長上下文級距;選擇級距時會計入快取輸入。service_tier: "priority" 與 "fast" 會讓兩個級距的 Token 費率都加倍。auto 與 default 選用標準服務。工具費另行計算,不隨此 Token 倍率加倍。
| 格式 | 輸入計量 | 輸出計量 |
|---|---|---|
| Responses | input_tokens 包含 input_tokens_details.cached_tokens | output_tokens 包含推理;不要再次加上推理明細 |
| Chat | prompt_tokens 包含 prompt_tokens_details.cached_tokens | xAI 另外回報可見的 completion_tokens;計費輸出總量為 total_tokens - prompt_tokens,包含推理 |
| Messages | input_tokens 不包含 cache_read_input_tokens;加上快取欄位即可取得輸入總量 | output_tokens 為輸出總量 |
公開回應包含用量計數,不包含金額欄位。用量紀錄會顯示最終費用。失敗的請求不收費。
對話歷史與目前限制
若要無狀態地接續對話,請將先前輸入、所有傳回的輸出項目及下一則使用者訊息,作為新的 input 傳送。使用 Chat 或 Messages 時,請傳送該格式的完整訊息歷史。若回應包含加密推理與工具項目,請原樣保留。
目前服務無法透過 previous_response_id 接續對話、擷取或刪除已儲存的回應、列出已儲存的輸入項目,或傳回延後完成的 Chat 回應。建立時可能接受 store: true,但這不代表支援回應的儲存或擷取。這些欄位仍保留在官方契約與 Playground 中;目前的限制不會取代其原本行為定義。
檔案附件在已測試的行內文字與 PDF URL 輸入中未能使用。圖像生成請求傳回文字而非圖片,工具搜尋也未完成伺服器端探索。這些能力尚未驗證為可用。Collections 搜尋另需有效的 collection 資源,目前也尚未驗證。
Chat 忽略 frequency_penalty、presence_penalty、logit_bias、stop、logprobs 與 top_logprobs。Responses 忽略 background、context_management、metadata、truncation、logprobs 與 top_logprobs。這些欄位不會被轉送,也不會以可用控制項提供。
錯誤
無效請求會傳回錯誤,而非已完成的回答。請檢查欄位值,並參閱公開錯誤說明。傳回錯誤的請求不收費。
