Claude Fable 5.1
透過官方 Anthropic Messages API,或相容於 OpenAI Chat Completions 與 Responses 的格式呼叫 Claude Fable 5.1:自適應思考、100 萬 token 上下文視窗以及最多 128K 的輸出 token。
Claude Fable 5.1 是 Anthropic 當前的 Fable 模型,適用於高度推理與長執行的自主式工作。傳送官方 Anthropic Messages 請求到 SeedRouter:更改基礎 URL 和 API 金鑰,保留請求主體。同一個模型也支援 OpenAI Chat Completions 與 Responses 的格式。
模型 ID
| 模型 ID | 上下文視窗 | 最大輸出 | 思考 | 預設思考強度 |
|---|---|---|---|---|
claude-fable-5-1 | 100 萬 token | 128K token | 自適應,永遠啟用 | high |
參見模型頁查看目前價格。
快速範例
curl https://api.seedrouter.ai/v1/messages \
-H "x-api-key: $SEEDROUTER_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-H "Content-Type: application/json" \
-d '{
"model": "claude-fable-5-1",
"max_tokens": 1024,
"messages": [{"role": "user", "content": "Summarize the trade-offs of event sourcing in three bullet points."}]
}'端點
| 格式 | 方法和路徑 | 驗證方式 |
|---|---|---|
| Anthropic Messages | POST https://api.seedrouter.ai/v1/messages | x-api-key: <key> 或 Authorization: Bearer <key>,加上 anthropic-version |
| OpenAI Chat Completions | POST https://api.seedrouter.ai/v1/chat/completions | Authorization: Bearer <key> |
| OpenAI Responses | POST https://api.seedrouter.ai/v1/responses | Authorization: Bearer <key> |
Messages 端點會逐字轉發你的請求主體(包括選用欄位),並回傳官方回應。anthropic-beta 標頭也會被轉發。請把 API 金鑰保存在伺服器端程式碼中。
參數
| 名稱 | 型別 | 必填 | 預設值 | 說明 |
|---|---|---|---|---|
model | string | 是 | — | claude-fable-5-1。 |
max_tokens | integer | 是 | — | 0–128000。包括花在思考上的 token。0 只預熱提示快取。 |
messages | object[] | 是 | — | 交替的「使用者」與「助理」對話輪次;content 是字串或內容區塊陣列。最後一輪必須是「使用者」。例外:繼續 pause_turn 回應時,將其內容作為最後一則 assistant 訊息原樣送回。 |
system | string or object[] | 否 | — | 系統提示。 |
thinking | object | 否 | {"type": "adaptive"} | 思考是自適應的且永遠啟用。display:omitted(預設)或 summarized。 |
output_config.effort | enum | 否 | high | low、medium、high、xhigh、max。控制模型思考程度。 |
output_config.format | object | 否 | — | 結構化輸出的 JSON 綱要。 |
stop_sequences | string[] | 否 | — | 當生成這些字串之一時停止。 |
stream | boolean | 否 | false | 以伺服器傳送事件的形式串流回應。 |
temperature | number | 否 | — | 僅為向後相容接受 1(預設值),其他任何值都會回傳 400 錯誤。請省略此項。 |
top_p | number | 否 | — | 僅為向後相容接受 0.99 到 1 之間的值,其他任何值都會回傳 400 錯誤。請省略此項。 |
top_k | integer | 否 | — | 不接受:任何值都會回傳 400 錯誤。請省略此項。 |
tools | object[] | 否 | — | 工具定義。 |
tool_choice | object | 否 | — | auto 或 none;強制使用工具(any 或 tool)不受此模型支援。 |
metadata.user_id | string | 否 | — | 你的終端使用者的不透明 ID,最多 512 個字元。 |
cache_control | object | 否 | — | 頂級提示快取中斷點。 |
container, context_management, mcp_servers, diagnostics, service_tier, inference_geo, speed | — | 否 | — | 逐字轉發。 |
思考與思考強度
Claude Fable 5.1 永遠使用自適應思考:模型決定思考多少,output_config.effort 則控制思考強度。更高的強度通常表示更多輸出 token、更長的等待時間和更高的成本。當 thinking.display 設為 summarized 時,回應包含你可以展示的 thinking 區塊;當設為 omitted 時,它們會被省略。思考 token 按輸出 token 計費。
媒體輸入
圖片和 PDF 在使用者對話輪次的 content 中以 image 與 document 區塊呈現,具有 url 來源或(如官方 API)base64 來源:
{"role": "user", "content": [
{"type": "image", "source": {"type": "url", "url": "https://example.com/chart.png"}},
{"type": "text", "text": "What does this chart show?"}
]}請將範例 URL 換成你自己、可存取的檔案。
計費維度
參見模型頁上的目前費率。請求按使用的 token 計費:
- 輸入 token、
- 輸出 token(包括思考)、
- 提示快取讀取、以及
- 提示快取寫入,有分別的 5 分鐘與 1 小時費率。
費用來自完成回應回報的 usage。失敗的請求不計費。你的帳戶使用記錄顯示每個請求的確切費用。
輸出
非串流請求回傳官方訊息物件:
{
"id": "msg_...",
"type": "message",
"role": "assistant",
"model": "claude-fable-5-1",
"content": [{"type": "text", "text": "..."}],
"stop_reason": "end_turn",
"usage": {"input_tokens": 18, "output_tokens": 4, "cache_read_input_tokens": 0, "cache_creation_input_tokens": 0}
}當使用 "stream": true 時,回應是官方事件的串流:message_start、content_block_start、content_block_delta、content_block_stop、message_delta 與 message_stop。最後的 message_delta 帶有輸出 token 計數。
OpenAI 相容格式
同一個模型支援 OpenAI 格式,所以現有的 OpenAI 程式碼只需一個新的基礎 URL 和模型 ID:
from openai import OpenAI
client = OpenAI(api_key="YOUR_SEEDROUTER_KEY", base_url="https://api.seedrouter.ai/v1")
chat = client.chat.completions.create(
model="claude-fable-5-1",
messages=[{"role": "user", "content": "Hello"}],
)
response = client.responses.create(model="claude-fable-5-1", input="Hello")這些請求會被轉換成 Messages 格式,所以沒有 Messages 對應的欄位沒有效果。它們的回應攜帶官方 OpenAI 欄位,可能包括一些額外的使用欄位;請讀取 usage.total_tokens 與官方欄位。
錯誤
/v1/messages 上的錯誤使用 Anthropic 形式,{"type": "error", "error": {"type": "...", "message": "..."}};其他格式使用 {"error": {"code": ..., "message": "..."}}。code 是來自共用錯誤目錄的代碼。失敗的請求不計費。
實用建議
- 從預設思考強度開始,只有在任務需要更多思考時才提高它;強度變化會同時影響品質與成本。
- 設置
max_tokens足夠高以容納思考與答案:它是兩者的共用預算。 - 將長的、重複使用的上下文放在首位,並用
cache_control標記它,以便後續請求以較低費率從快取讀取。
