Claude Opus 5.5 уже доступна в SeedRouter
SeedRouter Docs

Claude Fable 5.1

Вызывайте Claude Fable 5.1 через официальный API Messages от Anthropic или форматы OpenAI Chat Completions и Responses: адаптивное мышление, контекстное окно из 1M токенов и до 128K выходных токенов.

View Markdown

Claude Fable 5.1 — актуальная модель Fable от Anthropic для интенсивного анализа и долгоживущих агентных задач. Отправьте официальное тело запроса Messages от Anthropic в SeedRouter: измените только базовый URL и API-ключ, остальное оставьте неизменным. Та же модель принимает форматы OpenAI Chat Completions и Responses.

ID модели

ID моделиКонтекстное окноМаксимальный выводМышлениеУсилие по умолчанию
claude-fable-5-11M токенов128K токеновАдаптивное, всегда активноhigh

Актуальные цены смотрите на странице модели.

Краткий пример

curl https://api.seedrouter.ai/v1/messages \
  -H "x-api-key: $SEEDROUTER_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "claude-fable-5-1",
    "max_tokens": 1024,
    "messages": [{"role": "user", "content": "Summarize the trade-offs of event sourcing in three bullet points."}]
  }'

Конечные точки

ФорматМетод и путьАутентификация
Anthropic MessagesPOST https://api.seedrouter.ai/v1/messagesx-api-key: <key> или Authorization: Bearer <key>, плюс anthropic-version
OpenAI Chat CompletionsPOST https://api.seedrouter.ai/v1/chat/completionsAuthorization: Bearer <key>
OpenAI ResponsesPOST https://api.seedrouter.ai/v1/responsesAuthorization: Bearer <key>

Конечная точка Messages пересылает тело вашего запроса, включая необязательные поля, и возвращает официальный ответ. Заголовок anthropic-beta также пересылается. Храните API-ключ в коде на серверной стороне.

Параметры

ИмяТипОбязательныйПо умолчаниюПримечания
modelstringДа—claude-fable-5-1.
max_tokensintegerДа—0–128000. Включает токены, потраченные на мышление. 0 только предварительно прогревает кэш промпта.
messagesobject[]Да—Чередующиеся user и assistant обороты; content — строка или массив блоков контента. Последний оборот должен быть user. Исключение: чтобы продолжить ответ pause_turn, отправьте его содержимое без изменений последним сообщением assistant.
systemstring или object[]Нет—Системный промпт.
thinkingobjectНет{"type": "adaptive"}Мышление адаптивное и всегда включено. display: omitted (по умолчанию) или summarized.
output_config.effortenumНетhighlow, medium, high, xhigh, max. Управляет глубиной рассуждений модели.
output_config.formatobjectНет—JSON-схема для структурированного вывода.
stop_sequencesstring[]Нет—Остановить при генерировании одной из этих строк.
streambooleanНетfalseТранслировать ответ как серверные события.
temperaturenumberНет—Для обратной совместимости принимается только 1 (значение по умолчанию); любое другое значение возвращает ошибку 400. Опустите этот параметр.
top_pnumberНет—Для обратной совместимости принимаются только значения от 0.99 до 1; любое другое значение возвращает ошибку 400. Опустите этот параметр.
top_kintegerНет—Не принимается: любое значение возвращает ошибку 400. Опустите этот параметр.
toolsobject[]Нет—Определения инструментов.
tool_choiceobjectНет—auto или none; принудительный выбор инструмента (any или tool) не поддерживается этой моделью.
metadata.user_idstringНет—Непрозрачный идентификатор вашего пользователя, до 512 символов.
cache_controlobjectНет—Точка перерыва кэша промпта верхнего уровня.
container, context_management, mcp_servers, diagnostics, service_tier, inference_geo, speed—Нет—Пересылаются как отправлены.

Мышление и усилие

Claude Fable 5.1 всегда использует адаптивное мышление: модель решает, сколько думать, а output_config.effort управляет этим. Более высокие усилия обычно означают больше выходных токенов, более длительное ожидание и более высокую стоимость. При установке thinking.display на summarized ответ включает блоки thinking, которые вы можете показать; при omitted они опускаются. Токены мышления тарифицируются как выходные токены.

Входные медиа

Изображения и PDF-файлы передаются в content пользовательского оборота как блоки image и document с источником url или, как в официальном API, источником base64:

{"role": "user", "content": [
  {"type": "image", "source": {"type": "url", "url": "https://example.com/chart.png"}},
  {"type": "text", "text": "What does this chart show?"}
]}

Замените пример URL собственным общедоступным файлом.

Измерения стоимости

Смотрите актуальные тарифы на странице модели. Запрос тарифицируется по используемым токенам:

  • входные токены,
  • выходные токены, включая мышление,
  • чтение из кэша промпта, и
  • запись в кэш промпта, с отдельными тарифами на 5 минут и 1 час.

Сумма берётся из usage, возвращённого с завершённым ответом. Неудачный запрос не тарифицируется. Записи использования вашей учётной записи показывают точную сумму для каждого запроса.

Вывод

Нестриминговый запрос возвращает официальный объект сообщения:

{
  "id": "msg_...",
  "type": "message",
  "role": "assistant",
  "model": "claude-fable-5-1",
  "content": [{"type": "text", "text": "..."}],
  "stop_reason": "end_turn",
  "usage": {"input_tokens": 18, "output_tokens": 4, "cache_read_input_tokens": 0, "cache_creation_input_tokens": 0}
}

При "stream": true ответ — это поток официальных событий: message_start, content_block_start, content_block_delta, content_block_stop, message_delta и message_stop. Финальное message_delta содержит количество выходных токенов.

Форматы, совместимые с OpenAI

Та же модель отвечает на форматы OpenAI, поэтому существующему коду OpenAI требуется только новый базовый URL и ID модели:

from openai import OpenAI

client = OpenAI(api_key="YOUR_SEEDROUTER_KEY", base_url="https://api.seedrouter.ai/v1")

chat = client.chat.completions.create(
    model="claude-fable-5-1",
    messages=[{"role": "user", "content": "Hello"}],
)
response = client.responses.create(model="claude-fable-5-1", input="Hello")

Эти запросы преобразуются в формат Messages, поэтому поле без аналога в Messages не имеет эффекта. Их ответы содержат официальные поля OpenAI и могут включать несколько дополнительных полей использования; читайте usage.total_tokens и официальные поля.

Ошибки

Ошибки на /v1/messages используют форму Anthropic, {"type": "error", "error": {"type": "...", "message": "..."}}; другие форматы используют {"error": {"code": ..., "message": "..."}}. Поле code — это код из общего каталога ошибок. Неудачные запросы не тарифицируются.

Советы

  • Начните с усилия по умолчанию и повышайте его только для задач, требующих более глубокого анализа; усилие влияет и на качество, и на стоимость.
  • Установите max_tokens достаточно высоким для мышления и ответа: это один бюджет для обоих.
  • Поместите долгий, повторно используемый контекст в начало и отметьте его cache_control, чтобы последующие запросы читали его из кэша по более низкому тарифу.

Связанные материалы