Claude Opus 5.5 כבר זמין ב-SeedRouter
SeedRouter Docs

Claude Fable 5.1

קריאה ל-Claude Fable 5.1 עם ה-API הרשמי של Anthropic Messages, או ה-OpenAI Chat Completions ו-Responses: חשיבה אדפטיבית, חלון קשר של 1M טוקנים וטוקנים פלט של עד 128K.

View Markdown

Claude Fable 5.1 הוא מודל Fable הנוכחי של Anthropic לעבודת חשיבה מדויקת וסוכנים ממושכים. שלח את בקשת Anthropic Messages הרשמית ל-SeedRouter: שנה את כתובת הבסיס ואת מפתח ה-API, שמור את גוף הבקשה. אותו מודל גם עונה לפורמטים OpenAI Chat Completions ו-Responses.

מזהה המודל

מזהה המודלחלון קשרפלט מקסימליחשיבהעומק חשיבה ברירת מחדל
claude-fable-5-11M tokens128K tokensאדפטיבי, תמיד פעילhigh

ראה את דף המודל לקבלת המחירים הנוכחיים.

דוגמה מהירה

curl https://api.seedrouter.ai/v1/messages \
  -H "x-api-key: $SEEDROUTER_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "claude-fable-5-1",
    "max_tokens": 1024,
    "messages": [{"role": "user", "content": "Summarize the trade-offs of event sourcing in three bullet points."}]
  }'

נקודות קצה

פורמטשיטה וכתובתאימות
Anthropic MessagesPOST https://api.seedrouter.ai/v1/messagesx-api-key: <key> או Authorization: Bearer <key>, בתוספת anthropic-version
OpenAI Chat CompletionsPOST https://api.seedrouter.ai/v1/chat/completionsAuthorization: Bearer <key>
OpenAI ResponsesPOST https://api.seedrouter.ai/v1/responsesAuthorization: Bearer <key>

נקודת הקצה Messages מעבירה את גוף הבקשה שלך כפי שנשלח, כולל שדות אופציונליים, והחוזרת את התשובה הרשמית. כותרת anthropic-beta מועברת גם. שמור את מפתח ה-API בקוד שרץ בצד השרת.

פרמטרים

שםסוגחובהברירת מחדלהערות
modelstringכן—claude-fable-5-1.
max_tokensintegerכן—0–128000. כולל הטוקנים שהמודל הוציא בחשיבה. 0 רק מחזק את מטמון הפרומפט.
messagesobject[]כן—תורות משתמש והעונה לסירוגין; content הוא מחרוזת או מערך של בלוקי תוכן. התור האחרון חייב להיות user. חריג: כדי להמשיך תגובת pause_turn, שלח את התוכן שלה בחזרה כפי שהוא כהודעת assistant האחרונה.
systemstring or object[]לא—הנחיות המערכת.
thinkingobjectלא{"type": "adaptive"}החשיבה היא אדפטיבית ותמיד פעילה. display: omitted (ברירת מחדל) או summarized.
output_config.effortenumלאhighlow, medium, high, xhigh, max. משפיע על עומק החשיבה של המודל.
output_config.formatobjectלא—סכמה JSON לתוכן מובנה.
stop_sequencesstring[]לא—עצור כשאחד מהמחרוזות האלה נוצר.
streambooleanלאfalseסטרום התשובה כאירועי שנשלחו בשרת.
temperaturenumberלא—רק 1 (ברירת המחדל) מתקבל, לצורך תאימות לאחור; כל ערך אחר מחזיר שגיאת 400. השמט אותו.
top_pnumberלא—רק ערכים מ-0.99 עד 1 מתקבלים, לצורך תאימות לאחור; כל ערך אחר מחזיר שגיאת 400. השמט אותו.
top_kintegerלא—לא מקבל: כל ערך מחזיר שגיאת 400. השאר פתוח.
toolsobject[]לא—הגדרות כלים.
tool_choiceobjectלא—auto או none; כפיית כלי (any או tool) אינה נתמכת על ידי מודל זה.
metadata.user_idstringלא—מזהה אטום למשתמש הקצה שלך, עד 512 תווים.
cache_controlobjectלא—נקודת כניסה למטמון הפרומפט ברמה עליונה.
container, context_management, mcp_servers, diagnostics, service_tier, inference_geo, speed—לא—מועברים כשנשלחו.

חשיבה ועומק חשיבה

Claude Fable 5.1 משתמש תמיד בחשיבה אדפטיבית: המודל מחליט כמה לחשוב, ו-output_config.effort משפיע על זה. עומק חשיבה גבוה יותר בדרך כלל אומר יותר טוקנים פלט, המתנה ארוכה יותר ועלות גבוהה יותר. כאשר thinking.display מוגדר ל-summarized, התשובה כוללת בלוקי thinking שאתה יכול להציג; כאשר הוא omitted, הם מושמטים. טוקנים של חשיבה מחויבים כטוקנים פלט.

קלטי מדיה

תמונות וקבצי PDF הולכים בתור content בתור בלוקי image ו-document, עם מקור url או, כפי שנמצא ב-API הרשמי, מקור base64:

{"role": "user", "content": [
  {"type": "image", "source": {"type": "url", "url": "https://example.com/chart.png"}},
  {"type": "text", "text": "What does this chart show?"}
]}

החלף את כתובת הדוגמה בקובץ ציבורי שלך.

מימדי חיוב

ראה את התעריפים הנוכחיים בדף המודל. בקשה מחויבת לפי הטוקנים בהם היא משתמשת:

  • טוקנים קלט,
  • טוקנים פלט, כולל חשיבה,
  • קריאות מטמון הפרומפט, ו-
  • כתיבות מטמון הפרומפט, עם תעריפים נפרדים ל-5 דקות ו-1 שעה.

הסכום נלקח מה-usage המדווח עם התשובה המסיימת. בקשה שנכשלת אינה מחויבת. רשימת השימוש של החשבון שלך מציגה את התשלום המדויק לכל בקשה.

פלט

בקשה שאינה סטרימינג מחזירה את אובייקט ההודעה הרשמי:

{
  "id": "msg_...",
  "type": "message",
  "role": "assistant",
  "model": "claude-fable-5-1",
  "content": [{"type": "text", "text": "..."}],
  "stop_reason": "end_turn",
  "usage": {"input_tokens": 18, "output_tokens": 4, "cache_read_input_tokens": 0, "cache_creation_input_tokens": 0}
}

כאשר "stream": true התשובה היא סטרום של אירועים רשמיים: message_start, content_block_start, content_block_delta, content_block_stop, message_delta ו-message_stop. ה-message_delta הסופי מכיל את מספר טוקנים הפלט.

פורמטים תואמי OpenAI

אותו מודל עונה לפורמטים של OpenAI, כך שקוד OpenAI קיים צריך רק כתובת בסיס חדשה ומזהה מודל:

from openai import OpenAI

client = OpenAI(api_key="YOUR_SEEDROUTER_KEY", base_url="https://api.seedrouter.ai/v1")

chat = client.chat.completions.create(
    model="claude-fable-5-1",
    messages=[{"role": "user", "content": "Hello"}],
)
response = client.responses.create(model="claude-fable-5-1", input="Hello")

הבקשות הללו מומרות לפורמט Messages, כך ששדה ללא מקביל ב-Messages אין השפעה. התשובות שלהם משאירות את השדות הרשמיים של OpenAI וייתכן שיכללו כמה שדות שימוש נוספים; קרא usage.total_tokens והשדות הרשמיים.

שגיאות

שגיאות ב-/v1/messages משתמשות בצורת Anthropic, {"type": "error", "error": {"type": "...", "message": "..."}}; הפורמטים האחרים משתמשים ב-{"error": {"code": ..., "message": "..."}}. ה-code הוא קוד מ-קטלוג השגיאות המשותף. בקשות שנכשלו אינן מחויבות.

טיפים

  • התחל עם עומק החשיבה ברירת המחדל והגביל אותו רק לתפקידים שצריכים חשיבה יותר; שינויי עומק החשיבה משפיעים על איכות ועלות.
  • הגדר max_tokens גבוה מספיק לחשיבה ולתשובה: זה תקציב אחד לשניהם.
  • שים הקשר ארוך וחוזר קדימה וסמן אותו עם cache_control כדי שבקשות מאוחרות יקראו אותו מהמטמון בתעריף נמוך יותר.

קשור