Claude Opus 5.5
Anthropic の公式 Messages API、または OpenAI Chat Completions と Responses フォーマットで Claude Opus 5.5 を呼び出します: アダプティブ思考、100万トークンのコンテキストウィンドウ、最大128Kの出力トークン。
Claude Opus 5.5 は Anthropic の長時間実行のエージェント型コーディングとナレッジワーク向けのモデルです。公式の Anthropic Messages リクエストを SeedRouter に送信します: ベース URL と API キーを変更し、ボディはそのままにします。同じモデルは OpenAI Chat Completions と Responses フォーマットにも対応しています。
モデル ID
| モデル ID | コンテキストウィンドウ | 最大出力 | 思考 | デフォルト努力度 |
|---|---|---|---|---|
claude-opus-5-5 | 100万トークン | 128Kトークン | アダプティブ、常時有効 | medium |
現在の料金はモデルページをご確認ください。
クイックサンプル
curl https://api.seedrouter.ai/v1/messages \
-H "x-api-key: $SEEDROUTER_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-H "Content-Type: application/json" \
-d '{
"model": "claude-opus-5-5",
"max_tokens": 1024,
"messages": [{"role": "user", "content": "Summarize the trade-offs of event sourcing in three bullet points."}]
}'エンドポイント
| フォーマット | メソッドとパス | 認証 |
|---|---|---|
| Anthropic Messages | POST https://api.seedrouter.ai/v1/messages | x-api-key: <key> または Authorization: Bearer <key>、加えて anthropic-version |
| OpenAI Chat Completions | POST https://api.seedrouter.ai/v1/chat/completions | Authorization: Bearer <key> |
| OpenAI Responses | POST https://api.seedrouter.ai/v1/responses | Authorization: Bearer <key> |
Messages エンドポイントはリクエストボディをそのまま転送し、オプショナルフィールドも含めて、公式レスポンスを返します。anthropic-beta ヘッダーも渡されます。API キーはサーバー側のコードに保管してください。
パラメータ
| 名前 | 型 | 必須 | デフォルト | 説明 |
|---|---|---|---|---|
model | string | はい | — | claude-opus-5-5。 |
max_tokens | integer | はい | — | 0~128000。思考に費やされたトークンを含みます。0 はプロンプトキャッシュの事前ウォーミングのみです。 |
messages | object[] | はい | — | 交互の user と assistant ターン。content は文字列またはコンテンツブロックの配列です。最後のターンは user である必要があります。例外:pause_turn のレスポンスを続行するときは、その内容を最後の assistant メッセージとしてそのまま送り返します。 |
system | string or object[] | いいえ | — | システムプロンプト。 |
thinking | object | いいえ | {"type": "adaptive"} | 思考はアダプティブで常時有効です。display: omitted(デフォルト)または summarized。 |
output_config.effort | enum | いいえ | medium | low、medium、high、xhigh、max。モデルがどの程度思考するかを操作します。 |
output_config.format | object | いいえ | — | 構造化出力用の JSON スキーマ。 |
stop_sequences | string[] | いいえ | — | これらの文字列のいずれかが生成されたら停止します。 |
stream | boolean | いいえ | false | レスポンスをサーバー送信イベントとしてストリーミングします。 |
temperature | number | いいえ | — | 後方互換性のため 1(デフォルト)のみ受け入れられ、それ以外の値は 400 エラーを返します。省略してください。 |
top_p | number | いいえ | — | 後方互換性のため 0.99 から 1 までの値のみ受け入れられ、それ以外の値は 400 エラーを返します。省略してください。 |
top_k | integer | いいえ | — | 受け入れられません: 任意の値は 400 エラーを返します。省略してください。 |
tools | object[] | いいえ | — | ツール定義。 |
tool_choice | object | いいえ | — | auto または none。ツールを強制する(any または tool)はこのモデルでサポートされていません。 |
metadata.user_id | string | いいえ | — | エンドユーザーの不透明 ID、最大 512 文字。 |
cache_control | object | いいえ | — | トップレベルのプロンプトキャッシュブレークポイント。 |
container, context_management, mcp_servers, diagnostics, service_tier, inference_geo, speed | — | いいえ | — | そのまま転送されます。 |
思考と努力度
Claude Opus 5.5 は常時アダプティブ思考を使用します: モデルが思考量を決定し、output_config.effort がそれを操作します。より高い努力度は通常、より多くの出力トークン、より長い待機時間、およびより高いコストを意味します。thinking.display を summarized に設定すると、レスポンスに表示できる thinking ブロックが含まれます。omitted に設定すると、それらは除外されます。思考トークンは出力トークンとして請求されます。
メディア入力
画像と PDF はユーザーターンの content に image および document ブロックとして入ります。url ソース、または公式 API のように base64 ソースがあります:
{"role": "user", "content": [
{"type": "image", "source": {"type": "url", "url": "https://example.com/chart.png"}},
{"type": "text", "text": "What does this chart show?"}
]}例の URL を、アクセスできる独自のファイルに置き換えてください。
請求ディメンション
モデルページの現在のレートをご覧ください。リクエストは使用するトークンで請求されます:
- 入力トークン、
- 出力トークン(思考を含む)、
- プロンプトキャッシュ読み込み、および
- プロンプトキャッシュ書き込み(5 分と 1 時間の個別レート付き)。
請求は完成したレスポンスで報告された usage から差し引かれます。失敗したリクエストは請求されません。アカウントの使用記録にすべてのリクエストの正確な請求額が表示されます。
出力
非ストリーミングリクエストは公式メッセージオブジェクトを返します:
{
"id": "msg_...",
"type": "message",
"role": "assistant",
"model": "claude-opus-5-5",
"content": [{"type": "text", "text": "..."}],
"stop_reason": "end_turn",
"usage": {"input_tokens": 18, "output_tokens": 4, "cache_read_input_tokens": 0, "cache_creation_input_tokens": 0}
}"stream": true の場合、レスポンスは公式イベントのストリーム: message_start、content_block_start、content_block_delta、content_block_stop、message_delta、message_stopです。最終的な message_delta は出力トークン数を含みます。
OpenAI 互換フォーマット
同じモデルは OpenAI フォーマットに対応しているため、既存の OpenAI コードは新しいベース URL とモデル ID のみが必要です:
from openai import OpenAI
client = OpenAI(api_key="YOUR_SEEDROUTER_KEY", base_url="https://api.seedrouter.ai/v1")
chat = client.chat.completions.create(
model="claude-opus-5-5",
messages=[{"role": "user", "content": "Hello"}],
)
response = client.responses.create(model="claude-opus-5-5", input="Hello")これらのリクエストは Messages フォーマットに変換されるため、Messages で対応していないフィールドは効果がありません。それらのレスポンスは公式の OpenAI フィールドを含み、いくつかの追加使用フィールドが含まれることがあります。usage.total_tokens と公式フィールドを読んでください。
エラー
/v1/messages 上のエラーは Anthropic シェイプ {"type": "error", "error": {"type": "...", "message": "..."}}を使用します。他のフォーマットは {"error": {"code": ..., "message": "..."}} を使用します。code は共通エラーカタログのコードです。失敗したリクエストは請求されません。
ヒント
- デフォルトの努力度から始めて、より多くの思考が必要なタスクの場合のみ引き上げます。努力度の変更は品質とコストの両方に影響します。
max_tokensを思考と回答の両方に十分に高く設定します: これは両者のための 1 つの予算です。- 長い再利用されるコンテキストを最初に置き、
cache_controlでマークしてください。そうすれば、後のリクエストはより低いレートでキャッシュから読み込めます。
