Claude Opus 5.5 が SeedRouter で利用できます
SeedRouter Docs

Claude Fable 5.1

Anthropic の公式 Messages API、または OpenAI Chat Completions と Responses フォーマットで Claude Fable 5.1 を呼び出します: アダプティブ思考、100万トークンのコンテキストウィンドウ、最大128Kの出力トークン。

View Markdown

Claude Fable 5.1 は Anthropic の現在の Fable モデルで、要求の厳しい推論と長時間実行のエージェント作業に向いています。公式の Anthropic Messages リクエストを SeedRouter に送信します: ベース URL と API キーを変更し、ボディはそのままにします。同じモデルは OpenAI Chat Completions と Responses フォーマットにも対応しています。

モデル ID

モデル IDコンテキストウィンドウ最大出力思考デフォルト努力度
claude-fable-5-1100万トークン128Kトークンアダプティブ、常時有効high

現在の料金はモデルページをご確認ください。

クイックサンプル

curl https://api.seedrouter.ai/v1/messages \
  -H "x-api-key: $SEEDROUTER_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "claude-fable-5-1",
    "max_tokens": 1024,
    "messages": [{"role": "user", "content": "Summarize the trade-offs of event sourcing in three bullet points."}]
  }'

エンドポイント

フォーマットメソッドとパス認証
Anthropic MessagesPOST https://api.seedrouter.ai/v1/messagesx-api-key: <key> または Authorization: Bearer <key>、加えて anthropic-version
OpenAI Chat CompletionsPOST https://api.seedrouter.ai/v1/chat/completionsAuthorization: Bearer <key>
OpenAI ResponsesPOST https://api.seedrouter.ai/v1/responsesAuthorization: Bearer <key>

Messages エンドポイントはリクエストボディをそのまま転送し、オプショナルフィールドも含めて、公式レスポンスを返します。anthropic-beta ヘッダーも渡されます。API キーはサーバー側のコードに保管してください。

パラメータ

名前型必須デフォルト説明
modelstringはい—claude-fable-5-1。
max_tokensintegerはい—0~128000。思考に費やされたトークンを含みます。0 はプロンプトキャッシュの事前ウォーミングのみです。
messagesobject[]はい—交互の user と assistant ターン。content は文字列またはコンテンツブロックの配列です。最後のターンは user である必要があります。例外:pause_turn のレスポンスを続行するときは、その内容を最後の assistant メッセージとしてそのまま送り返します。
systemstring or object[]いいえ—システムプロンプト。
thinkingobjectいいえ{"type": "adaptive"}思考はアダプティブで常時有効です。display: omitted(デフォルト)または summarized。
output_config.effortenumいいえhighlow、medium、high、xhigh、max。モデルがどの程度思考するかを操作します。
output_config.formatobjectいいえ—構造化出力用の JSON スキーマ。
stop_sequencesstring[]いいえ—これらの文字列のいずれかが生成されたら停止します。
streambooleanいいえfalseレスポンスをサーバー送信イベントとしてストリーミングします。
temperaturenumberいいえ—後方互換性のため 1(デフォルト)のみ受け入れられ、それ以外の値は 400 エラーを返します。省略してください。
top_pnumberいいえ—後方互換性のため 0.99 から 1 までの値のみ受け入れられ、それ以外の値は 400 エラーを返します。省略してください。
top_kintegerいいえ—受け入れられません: 任意の値は 400 エラーを返します。省略してください。
toolsobject[]いいえ—ツール定義。
tool_choiceobjectいいえ—auto または none。ツールを強制する(any または tool)はこのモデルでサポートされていません。
metadata.user_idstringいいえ—エンドユーザーの不透明 ID、最大 512 文字。
cache_controlobjectいいえ—トップレベルのプロンプトキャッシュブレークポイント。
container, context_management, mcp_servers, diagnostics, service_tier, inference_geo, speed—いいえ—そのまま転送されます。

思考と努力度

Claude Fable 5.1 は常時アダプティブ思考を使用します: モデルが思考量を決定し、output_config.effort がそれを操作します。より高い努力度は通常、より多くの出力トークン、より長い待機時間、およびより高いコストを意味します。thinking.display を summarized に設定すると、レスポンスに表示できる thinking ブロックが含まれます。omitted に設定すると、それらは除外されます。思考トークンは出力トークンとして請求されます。

メディア入力

画像と PDF はユーザーターンの content に image および document ブロックとして入ります。url ソース、または公式 API のように base64 ソースがあります:

{"role": "user", "content": [
  {"type": "image", "source": {"type": "url", "url": "https://example.com/chart.png"}},
  {"type": "text", "text": "What does this chart show?"}
]}

例の URL を、アクセスできる独自のファイルに置き換えてください。

請求ディメンション

モデルページの現在のレートをご覧ください。リクエストは使用するトークンで請求されます:

  • 入力トークン、
  • 出力トークン(思考を含む)、
  • プロンプトキャッシュ読み込み、および
  • プロンプトキャッシュ書き込み(5 分と 1 時間の個別レート付き)。

請求は完成したレスポンスで報告された usage から差し引かれます。失敗したリクエストは請求されません。アカウントの使用記録にすべてのリクエストの正確な請求額が表示されます。

出力

非ストリーミングリクエストは公式メッセージオブジェクトを返します:

{
  "id": "msg_...",
  "type": "message",
  "role": "assistant",
  "model": "claude-fable-5-1",
  "content": [{"type": "text", "text": "..."}],
  "stop_reason": "end_turn",
  "usage": {"input_tokens": 18, "output_tokens": 4, "cache_read_input_tokens": 0, "cache_creation_input_tokens": 0}
}

"stream": true の場合、レスポンスは公式イベントのストリーム: message_start、content_block_start、content_block_delta、content_block_stop、message_delta、message_stopです。最終的な message_delta は出力トークン数を含みます。

OpenAI 互換フォーマット

同じモデルは OpenAI フォーマットに対応しているため、既存の OpenAI コードは新しいベース URL とモデル ID のみが必要です:

from openai import OpenAI

client = OpenAI(api_key="YOUR_SEEDROUTER_KEY", base_url="https://api.seedrouter.ai/v1")

chat = client.chat.completions.create(
    model="claude-fable-5-1",
    messages=[{"role": "user", "content": "Hello"}],
)
response = client.responses.create(model="claude-fable-5-1", input="Hello")

これらのリクエストは Messages フォーマットに変換されるため、Messages で対応していないフィールドは効果がありません。それらのレスポンスは公式の OpenAI フィールドを含み、いくつかの追加使用フィールドが含まれることがあります。usage.total_tokens と公式フィールドを読んでください。

エラー

/v1/messages 上のエラーは Anthropic シェイプ {"type": "error", "error": {"type": "...", "message": "..."}}を使用します。他のフォーマットは {"error": {"code": ..., "message": "..."}} を使用します。code は共通エラーカタログのコードです。失敗したリクエストは請求されません。

ヒント

  • デフォルトの努力度から始めて、より多くの思考が必要なタスクの場合のみ引き上げます。努力度の変更は品質とコストの両方に影響します。
  • max_tokens を思考と回答の両方に十分に高く設定します: これは両者のための 1 つの予算です。
  • 長い再利用されるコンテキストを最初に置き、cache_control でマークしてください。そうすれば、後のリクエストはより低いレートでキャッシュから読み込めます。

関連リソース