Claude Opus 5.5 已在 SeedRouter 上線
SeedRouter Docs

Claude Fable 5.1

透過官方 Anthropic Messages API,或相容於 OpenAI Chat Completions 與 Responses 的格式呼叫 Claude Fable 5.1:自適應思考、100 萬 token 上下文視窗以及最多 128K 的輸出 token。

View Markdown

Claude Fable 5.1 是 Anthropic 當前的 Fable 模型,適用於高度推理與長執行的自主式工作。傳送官方 Anthropic Messages 請求到 SeedRouter:更改基礎 URL 和 API 金鑰,保留請求主體。同一個模型也支援 OpenAI Chat Completions 與 Responses 的格式。

模型 ID

模型 ID上下文視窗最大輸出思考預設思考強度
claude-fable-5-1100 萬 token128K token自適應,永遠啟用high

參見模型頁查看目前價格。

快速範例

curl https://api.seedrouter.ai/v1/messages \
  -H "x-api-key: $SEEDROUTER_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "claude-fable-5-1",
    "max_tokens": 1024,
    "messages": [{"role": "user", "content": "Summarize the trade-offs of event sourcing in three bullet points."}]
  }'

端點

格式方法和路徑驗證方式
Anthropic MessagesPOST https://api.seedrouter.ai/v1/messagesx-api-key: <key> 或 Authorization: Bearer <key>,加上 anthropic-version
OpenAI Chat CompletionsPOST https://api.seedrouter.ai/v1/chat/completionsAuthorization: Bearer <key>
OpenAI ResponsesPOST https://api.seedrouter.ai/v1/responsesAuthorization: Bearer <key>

Messages 端點會逐字轉發你的請求主體(包括選用欄位),並回傳官方回應。anthropic-beta 標頭也會被轉發。請把 API 金鑰保存在伺服器端程式碼中。

參數

名稱型別必填預設值說明
modelstring是—claude-fable-5-1。
max_tokensinteger是—0–128000。包括花在思考上的 token。0 只預熱提示快取。
messagesobject[]是—交替的「使用者」與「助理」對話輪次;content 是字串或內容區塊陣列。最後一輪必須是「使用者」。例外:繼續 pause_turn 回應時,將其內容作為最後一則 assistant 訊息原樣送回。
systemstring or object[]否—系統提示。
thinkingobject否{"type": "adaptive"}思考是自適應的且永遠啟用。display:omitted(預設)或 summarized。
output_config.effortenum否highlow、medium、high、xhigh、max。控制模型思考程度。
output_config.formatobject否—結構化輸出的 JSON 綱要。
stop_sequencesstring[]否—當生成這些字串之一時停止。
streamboolean否false以伺服器傳送事件的形式串流回應。
temperaturenumber否—僅為向後相容接受 1(預設值),其他任何值都會回傳 400 錯誤。請省略此項。
top_pnumber否—僅為向後相容接受 0.99 到 1 之間的值,其他任何值都會回傳 400 錯誤。請省略此項。
top_kinteger否—不接受:任何值都會回傳 400 錯誤。請省略此項。
toolsobject[]否—工具定義。
tool_choiceobject否—auto 或 none;強制使用工具(any 或 tool)不受此模型支援。
metadata.user_idstring否—你的終端使用者的不透明 ID,最多 512 個字元。
cache_controlobject否—頂級提示快取中斷點。
container, context_management, mcp_servers, diagnostics, service_tier, inference_geo, speed—否—逐字轉發。

思考與思考強度

Claude Fable 5.1 永遠使用自適應思考:模型決定思考多少,output_config.effort 則控制思考強度。更高的強度通常表示更多輸出 token、更長的等待時間和更高的成本。當 thinking.display 設為 summarized 時,回應包含你可以展示的 thinking 區塊;當設為 omitted 時,它們會被省略。思考 token 按輸出 token 計費。

媒體輸入

圖片和 PDF 在使用者對話輪次的 content 中以 image 與 document 區塊呈現,具有 url 來源或(如官方 API)base64 來源:

{"role": "user", "content": [
  {"type": "image", "source": {"type": "url", "url": "https://example.com/chart.png"}},
  {"type": "text", "text": "What does this chart show?"}
]}

請將範例 URL 換成你自己、可存取的檔案。

計費維度

參見模型頁上的目前費率。請求按使用的 token 計費:

  • 輸入 token、
  • 輸出 token(包括思考)、
  • 提示快取讀取、以及
  • 提示快取寫入,有分別的 5 分鐘與 1 小時費率。

費用來自完成回應回報的 usage。失敗的請求不計費。你的帳戶使用記錄顯示每個請求的確切費用。

輸出

非串流請求回傳官方訊息物件:

{
  "id": "msg_...",
  "type": "message",
  "role": "assistant",
  "model": "claude-fable-5-1",
  "content": [{"type": "text", "text": "..."}],
  "stop_reason": "end_turn",
  "usage": {"input_tokens": 18, "output_tokens": 4, "cache_read_input_tokens": 0, "cache_creation_input_tokens": 0}
}

當使用 "stream": true 時,回應是官方事件的串流:message_start、content_block_start、content_block_delta、content_block_stop、message_delta 與 message_stop。最後的 message_delta 帶有輸出 token 計數。

OpenAI 相容格式

同一個模型支援 OpenAI 格式,所以現有的 OpenAI 程式碼只需一個新的基礎 URL 和模型 ID:

from openai import OpenAI

client = OpenAI(api_key="YOUR_SEEDROUTER_KEY", base_url="https://api.seedrouter.ai/v1")

chat = client.chat.completions.create(
    model="claude-fable-5-1",
    messages=[{"role": "user", "content": "Hello"}],
)
response = client.responses.create(model="claude-fable-5-1", input="Hello")

這些請求會被轉換成 Messages 格式,所以沒有 Messages 對應的欄位沒有效果。它們的回應攜帶官方 OpenAI 欄位,可能包括一些額外的使用欄位;請讀取 usage.total_tokens 與官方欄位。

錯誤

/v1/messages 上的錯誤使用 Anthropic 形式,{"type": "error", "error": {"type": "...", "message": "..."}};其他格式使用 {"error": {"code": ..., "message": "..."}}。code 是來自共用錯誤目錄的代碼。失敗的請求不計費。

實用建議

  • 從預設思考強度開始,只有在任務需要更多思考時才提高它;強度變化會同時影響品質與成本。
  • 設置 max_tokens 足夠高以容納思考與答案:它是兩者的共用預算。
  • 將長的、重複使用的上下文放在首位,並用 cache_control 標記它,以便後續請求以較低費率從快取讀取。

相關