Claude Opus 5.5을(를) SeedRouter에서 사용할 수 있습니다
SeedRouter Docs

Claude Fable 5

Claude Fable 5를 공식 Anthropic Messages API 또는 OpenAI Chat Completions 및 Responses 형식으로 호출합니다: 적응형 사고, 100만 토큰 컨텍스트 윈도우, 최대 128,000 출력 토큰.

View Markdown

Claude Fable 5는 Anthropic의 이전 Fable 모델이며 Claude Fable 5.1과 함께 여전히 사용 가능합니다. 공식 Anthropic Messages 요청을 SeedRouter로 보냅니다: 기본 URL과 API 키만 바꾸고 본문은 그대로 유지합니다. 같은 모델이 OpenAI Chat Completions 및 Responses 형식도 지원합니다.

모델 ID

모델 ID컨텍스트 윈도우최대 출력사고기본 effort
claude-fable-5100만 토큰128,000 토큰적응형, 항상 활성화high

모델 페이지에서 현재 요금을 확인하세요.

빠른 예제

curl https://api.seedrouter.ai/v1/messages \
  -H "x-api-key: $SEEDROUTER_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "claude-fable-5",
    "max_tokens": 1024,
    "messages": [{"role": "user", "content": "Summarize the trade-offs of event sourcing in three bullet points."}]
  }'

엔드포인트

형식메서드 및 경로인증
Anthropic MessagesPOST https://api.seedrouter.ai/v1/messagesx-api-key: <key> 또는 Authorization: Bearer <key>, 그리고 anthropic-version
OpenAI Chat CompletionsPOST https://api.seedrouter.ai/v1/chat/completionsAuthorization: Bearer <key>
OpenAI ResponsesPOST https://api.seedrouter.ai/v1/responsesAuthorization: Bearer <key>

Messages 엔드포인트는 옵션 필드를 포함한 요청 본문을 그대로 전달하고 공식 응답을 반환합니다. anthropic-beta 헤더도 전달됩니다. API 키는 서버 측 코드에 보관하세요.

파라미터

이름타입필수기본값설명
modelstring예—claude-fable-5.
max_tokensinteger예—0–128000. 사고에 소비된 토큰을 포함합니다. 0은 프롬프트 캐시를 사전 워밍만 합니다.
messagesobject[]예—교대로 나오는 user와 assistant 턴. content는 문자열 또는 콘텐츠 블록 배열입니다. 마지막 턴은 user여야 합니다. 예외: pause_turn 응답을 이어가려면 그 내용을 마지막 assistant 메시지로 그대로 다시 보냅니다.
systemstring or object[]아니요—시스템 프롬프트.
thinkingobject아니요{"type": "adaptive"}사고는 적응형이며 항상 활성화됩니다. display: omitted(기본값) 또는 summarized.
output_config.effortenum아니요highlow, medium, high, xhigh, max. 모델이 생각하는 정도를 제어합니다.
output_config.formatobject아니요—구조화된 출력을 위한 JSON 스키마.
stop_sequencesstring[]아니요—이 문자열 중 하나가 생성되면 중단합니다.
streamboolean아니요false응답을 서버 전송 이벤트로 스트리밍합니다.
temperaturenumber아니요—하위 호환성을 위해 1(기본값)만 허용되며, 그 외의 값은 400 오류를 반환합니다. 이를 생략하세요.
top_pnumber아니요—하위 호환성을 위해 0.99~1 사이의 값만 허용되며, 그 외의 값은 400 오류를 반환합니다. 이를 생략하세요.
top_kinteger아니요—허용되지 않음: 모든 값이 400 오류를 반환합니다. 이를 생략하세요.
toolsobject[]아니요—도구 정의.
tool_choiceobject아니요—auto, any, tool 또는 none.
metadata.user_idstring아니요—최종 사용자를 위한 불투명 ID, 최대 512자.
cache_controlobject아니요—최상위 레벨 프롬프트 캐시 중단점.
container, context_management, mcp_servers, diagnostics, service_tier, inference_geo, speed—아니요—그대로 전달됩니다.

사고와 effort

Claude Fable 5는 항상 적응형 사고를 사용합니다: 모델이 생각할 정도를 결정하고 output_config.effort가 이를 조종합니다. 더 높은 effort는 보통 더 많은 출력 토큰, 더 긴 대기 시간, 더 높은 비용을 의미합니다. thinking.display를 summarized로 설정하면 응답에 thinking 블록이 포함됩니다. omitted일 때는 Claude Fable 5가 여전히 thinking 블록을 반환하지만 텍스트는 비어 있습니다. 첫 번째 블록이 아닌 text 블록에서 답변을 읽으세요. 사고 토큰은 출력 토큰으로 청구됩니다.

미디어 입력

이미지와 PDF는 사용자 턴의 content에 image와 document 블록으로 들어가며, url 소스 또는 공식 API처럼 base64 소스를 사용합니다:

{"role": "user", "content": [
  {"type": "image", "source": {"type": "url", "url": "https://example.com/chart.png"}},
  {"type": "text", "text": "What does this chart show?"}
]}

예제 URL을 본인의 공개 액세스 가능 파일로 바꾸세요.

청구 규모

모델 페이지의 현재 요금을 참조하세요. 요청은 사용한 토큰으로 청구됩니다:

  • 입력 토큰,
  • 사고를 포함한 출력 토큰,
  • 프롬프트 캐시 읽기, 그리고
  • 5분 및 1시간 요금이 별도인 프롬프트 캐시 쓰기.

청구는 완성된 응답과 함께 보고된 usage에서 가져옵니다. 실패한 요청은 청구되지 않습니다. 계정의 사용 기록에 모든 요청의 정확한 청구 금액이 표시됩니다.

출력

비스트리밍 요청은 공식 메시지 객체를 반환합니다:

{
  "id": "msg_...",
  "type": "message",
  "role": "assistant",
  "model": "claude-fable-5",
  "content": [{"type": "text", "text": "..."}],
  "stop_reason": "end_turn",
  "usage": {"input_tokens": 18, "output_tokens": 4, "cache_read_input_tokens": 0, "cache_creation_input_tokens": 0}
}

"stream": true일 때 응답은 공식 이벤트 스트림입니다: message_start, content_block_start, content_block_delta, content_block_stop, message_delta, message_stop. 최종 message_delta가 출력 토큰 수를 포함합니다.

OpenAI 호환 형식

같은 모델이 OpenAI 형식도 지원하므로, 기존 OpenAI 코드는 새 기본 URL과 모델 ID만 필요합니다:

from openai import OpenAI

client = OpenAI(api_key="YOUR_SEEDROUTER_KEY", base_url="https://api.seedrouter.ai/v1")

chat = client.chat.completions.create(
    model="claude-fable-5",
    messages=[{"role": "user", "content": "Hello"}],
)
response = client.responses.create(model="claude-fable-5", input="Hello")

이 요청은 Messages 형식으로 변환되므로, Messages 대응물이 없는 필드는 영향을 미치지 않습니다. 응답은 공식 OpenAI 필드를 포함하며 몇 가지 추가 사용 필드가 포함될 수 있습니다. usage.total_tokens과 공식 필드를 읽으세요.

오류

/v1/messages의 오류는 Anthropic 형태인 {"type": "error", "error": {"type": "...", "message": "..."}}를 사용합니다. 다른 형식은 {"error": {"code": ..., "message": "..."}}를 사용합니다. code은 공통 오류 카탈로그의 코드입니다. 실패한 요청은 청구되지 않습니다.

팁

  • 기본 effort부터 시작하고 더 많은 사고가 필요한 작업에서만 높이세요. effort 변경은 품질과 비용 모두에 영향을 미칩니다.
  • max_tokens를 사고와 답변 모두에 충분하게 설정하세요: 이는 둘 다의 단일 예산입니다.
  • 길고 재사용되는 컨텍스트를 먼저 놓고 cache_control로 표시하여 이후 요청이 더 낮은 요금으로 캐시에서 읽도록 하세요.

관련