Claude Opus 5.5 已在 SeedRouter 上線
LogoSeedRouter

依名稱搜尋模型,例如 nano banana

依名稱搜尋模型,例如 nano banana

Grok 4.7 價格:快取輸入、推理與請求費用

了解 Grok 4.7 價格、快取輸入與推理用量,依目前的 Token 費率估算請求費用,避免重複計算快取 Token。

以 Markdown 閱讀

Grok 4.7 價格取決於輸入 Token、快取輸入與輸出用量。 官方起始費率為每百萬輸入 Token 2 美元、每百萬輸出 Token 6 美元。這些基礎費率是模型的牌價;估算 SeedRouter 請求費用時,請使用下方 SeedRouter 目前的價格表。[1]

回答中看得到的長度,只是計算的一部分。簡短回覆可能包含額外的推理 Token,而較長的提示詞可能含有快取輸入。Grok 4.7 模型頁面整合了 Playground 與目前價格。

Grok 4.7 費用怎麼算?

官方公告將上述輸入與輸出費率列為 Grok 4.7 的起始價格,同時介紹了另一個價格不同的 fast 變體。本指南討論的是 grok-4.7 模型;名稱相近的變體,不能當作相同報價使用。[2]

透過 SeedRouter 發出的請求,請依下列目前的 Token 費率計算:

定價暫時無法取得。請稍後再試。

依請求的輸入長度,查看對應級距的費率。在 SeedRouter 上,輸入少於 20 萬個 Token 時採用標準級距;輸入達到或超過 20 萬個 Token 時,整個請求採用長上下文級距。輸入、快取輸入與輸出都使用相應級距。此門檻是價格分界,並不表示預留了同等數量的 Token。

設定 service_tier: "priority" 或 "fast" 時,所選輸入長度級距的 Token 費率加倍。此倍率適用於 Token 費用;工具費另行計算。

官方 API 概覽列出的上下文視窗為 50 萬個 Token。這項能力上限不表示每次請求都會按完整視窗計費。[1]

費用計算需要哪些用量欄位?

使用 Responses API 時,請保留回傳 usage 中的三個值:

用量欄位使用方式
input_tokens輸入總量,包含快取部分
input_tokens_details.cached_tokens輸入中按快取輸入費率計費的部分
output_tokens用於 Token 費用計算的輸出總量

套用一般輸入費率前,先從輸入總量扣除快取 Token。否則,在估算中,同一批快取 Token 會先按一般輸入計算一次,又按快取輸入計算一次。

當費率以每百萬 Token 表示時:

uncached input = input_tokens - cached_tokens

token cost = (
  uncached input × input rate
  + cached_tokens × cached-input rate
  + output_tokens × output rate
) / 1,000,000

各項均套用目前價格表中的費率。選擇輸入長度級距時,使用扣除快取 Token 前的輸入總量。Token 估算不會自動包含額外工具費;若請求使用付費搜尋工具,還需計入該工具的用量。

為什麼簡短回答也會使用較多輸出 Token?

即使最終回答很短,推理仍會計入輸出用量。例如,2026 年 10 月 10 日驗證的一次已完成的 Grok 4.7 Responses 請求回傳:

{
  "input_tokens": 3340,
  "input_tokens_details": { "cached_tokens": 1152 },
  "output_tokens": 22,
  "output_tokens_details": { "reasoning_tokens": 21 },
  "total_tokens": 3362
}

此請求包含 2188 個未快取的輸入 Token、1152 個快取輸入 Token,以及 22 個輸出 Token。其中的 21 個推理 Token 是輸出總量的明細。再次加上這些 Token,會將 22 算成 43,因而高估輸出費用。

這些數字只描述一次已完成的請求,不是其他提示詞的平均值或預測。為自己的應用程式規劃預算時,請記錄有代表性的任務所回報的用量,並確認每個結果是否符合任務要求。

串流輸出會改變 Token 價格嗎?

串流改變的是回答的傳送方式。估算仍使用已完成請求的輸入、快取輸入與輸出用量。請保留最終用量資訊,不要把每段文字片段視為獨立計費的請求。

在 SeedRouter 的 Grok 4.7 驗證中,Chat 與 Responses 的串流和非串流請求均已完成,並納入快取輸入計量。這驗證的是用量計算,並不表示兩次分別產生的回答會消耗完全相同數量的 Token。

如何比較兩個提示詞的費用?

保持任務與驗收標準一致。記錄每次嘗試的輸入總量、快取輸入、輸出,以及回答是否可用。比較取得合格結果的總花費,其中也包含那些雖然生成成功,卻因回答不合要求而必須重新產生的費用。

對於長對話,請先確認縮短歷史後仍能正確回答,再刪除無關歷史。對於重複使用的上下文,請檢查快取 Token 計數;光是重複文字,不能證明快取命中。對於需要大量推理的任務,應比較實際輸出用量,而非只計算回答顯示的字數。

價格常見問題

官方基礎費率就是我在 SeedRouter 支付的價格嗎?

在 SeedRouter 上,請使用上方的即時價格表。官方起始價格可作為參考,但實際估算取決於服務目前的輸入長度級距與 Token 費率。

要把 reasoning_tokens 加到 output_tokens 嗎?

不需要。上方 Responses 用量範例的輸出總量已包含推理。推理明細可用來了解模型完成的工作,不應再算成另一筆輸出費用。

重複提示詞一定會有快取輸入折扣嗎?

不一定。請使用回應所回報的快取 Token 數量,只對該部分套用快取輸入費率,其餘部分按一般輸入費率計算。

哪裡可以查看最終費用?

用量紀錄會顯示已完成請求的費用。若要重新估算,請重新整理 Grok 4.7 價格區塊,並使用該請求所回報的用量。傳回錯誤的請求不收費。

來源

  1. SpaceXAI API:Grok 模型與價格,核對日期為 2026 年 10 月 10 日。
  2. Grok 4.7 發布介紹,2026 年 9 月 21 日。

相關指南