Claude Fable 5
קריאה ל-Claude Fable 5 עם ה-API הרשמי של Anthropic Messages, או ה-OpenAI Chat Completions ו-Responses: חשיבה אדפטיבית, חלון קשר של 1M טוקנים וטוקנים פלט של עד 128K.
Claude Fable 5 הוא מודל Fable הקודם של Anthropic, עדיין זמין לצד Claude Fable 5.1. שלח את בקשת Anthropic Messages הרשמית ל-SeedRouter: שנה את כתובת הבסיס ואת מפתח ה-API, שמור את גוף הבקשה. אותו מודל גם עונה לפורמטים OpenAI Chat Completions ו-Responses.
מזהה המודל
| מזהה המודל | חלון קשר | פלט מקסימלי | חשיבה | עומק חשיבה ברירת מחדל |
|---|---|---|---|---|
claude-fable-5 | 1M tokens | 128K tokens | אדפטיבי, תמיד פעיל | high |
ראה את דף המודל לקבלת המחירים הנוכחיים.
דוגמה מהירה
curl https://api.seedrouter.ai/v1/messages \
-H "x-api-key: $SEEDROUTER_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-H "Content-Type: application/json" \
-d '{
"model": "claude-fable-5",
"max_tokens": 1024,
"messages": [{"role": "user", "content": "Summarize the trade-offs of event sourcing in three bullet points."}]
}'נקודות קצה
| פורמט | שיטה וכתובת | אימות |
|---|---|---|
| Anthropic Messages | POST https://api.seedrouter.ai/v1/messages | x-api-key: <key> או Authorization: Bearer <key>, בתוספת anthropic-version |
| OpenAI Chat Completions | POST https://api.seedrouter.ai/v1/chat/completions | Authorization: Bearer <key> |
| OpenAI Responses | POST https://api.seedrouter.ai/v1/responses | Authorization: Bearer <key> |
נקודת הקצה Messages מעבירה את גוף הבקשה שלך כפי שנשלח, כולל שדות אופציונליים, והחוזרת את התשובה הרשמית. כותרת anthropic-beta מועברת גם. שמור את מפתח ה-API בקוד שרץ בצד השרת.
פרמטרים
| שם | סוג | חובה | ברירת מחדל | הערות |
|---|---|---|---|---|
model | string | כן | — | claude-fable-5. |
max_tokens | integer | כן | — | 0–128000. כולל הטוקנים שהמודל הוציא בחשיבה. 0 רק מחזק את מטמון הפרומפט. |
messages | object[] | כן | — | תורות משתמש והעונה לסירוגין; content הוא מחרוזת או מערך של בלוקי תוכן. התור האחרון חייב להיות user. חריג: כדי להמשיך תגובת pause_turn, שלח את התוכן שלה בחזרה כפי שהוא כהודעת assistant האחרונה. |
system | string or object[] | לא | — | הנחיות המערכת. |
thinking | object | לא | {"type": "adaptive"} | החשיבה היא אדפטיבית ותמיד פעילה. display: omitted (ברירת מחדל) או summarized. |
output_config.effort | enum | לא | high | low, medium, high, xhigh, max. משפיע על עומק החשיבה של המודל. |
output_config.format | object | לא | — | סכמה JSON לתוכן מובנה. |
stop_sequences | string[] | לא | — | עצור כשאחד מהמחרוזות האלה נוצר. |
stream | boolean | לא | false | סטרום התשובה כאירועי שנשלחו בשרת. |
temperature | number | לא | — | רק 1 (ברירת המחדל) מתקבל, לצורך תאימות לאחור; כל ערך אחר מחזיר שגיאת 400. השמט אותו. |
top_p | number | לא | — | רק ערכים מ-0.99 עד 1 מתקבלים, לצורך תאימות לאחור; כל ערך אחר מחזיר שגיאת 400. השמט אותו. |
top_k | integer | לא | — | לא מקבל: כל ערך מחזיר שגיאת 400. השאר פתוח. |
tools | object[] | לא | — | הגדרות כלים. |
tool_choice | object | לא | — | auto, any, tool או none. |
metadata.user_id | string | לא | — | מזהה אטום למשתמש הקצה שלך, עד 512 תווים. |
cache_control | object | לא | — | נקודת כניסה למטמון הפרומפט ברמה עליונה. |
container, context_management, mcp_servers, diagnostics, service_tier, inference_geo, speed | — | לא | — | מועברים כשנשלחו. |
חשיבה ועומק חשיבה
Claude Fable 5 משתמש תמיד בחשיבה אדפטיבית: המודל מחליט כמה לחשוב, ו-output_config.effort משפיע על זה. עומק חשיבה גבוה יותר בדרך כלל אומר יותר טוקנים פלט, המתנה ארוכה יותר ועלות גבוהה יותר. כאשר thinking.display מוגדר ל-summarized, התשובה כוללת בלוקי thinking שאתה יכול להציג; כאשר הוא omitted, Claude Fable 5 עדיין מחזיר בלוק thinking, אך הטקסט שלו ריק. קרא את התשובה מהבלוקים של text, לא מהבלוק הראשון. טוקנים של חשיבה מחויבים כטוקנים פלט.
קלטי מדיה
תמונות וקבצי PDF הולכים בתור content בתור בלוקי image ו-document, עם מקור url או, כפי שנמצא ב-API הרשמי, מקור base64:
{"role": "user", "content": [
{"type": "image", "source": {"type": "url", "url": "https://example.com/chart.png"}},
{"type": "text", "text": "What does this chart show?"}
]}החלף את כתובת הדוגמה בקובץ ציבורי שלך.
מימדי חיוב
ראה את התעריפים הנוכחיים בדף המודל. בקשה מחויבת לפי הטוקנים בהם היא משתמשת:
- טוקנים קלט,
- טוקנים פלט, כולל חשיבה,
- קריאות מטמון הפרומפט, ו-
- כתיבות מטמון הפרומפט, עם תעריפים נפרדים ל-5 דקות ו-1 שעה.
הסכום נלקח מה-usage המדווח עם התשובה המסיימת. בקשה שנכשלת אינה מחויבת. רשימת השימוש של החשבון שלך מציגה את התשלום המדויק לכל בקשה.
פלט
בקשה שאינה סטרימינג מחזירה את אובייקט ההודעה הרשמי:
{
"id": "msg_...",
"type": "message",
"role": "assistant",
"model": "claude-fable-5",
"content": [{"type": "text", "text": "..."}],
"stop_reason": "end_turn",
"usage": {"input_tokens": 18, "output_tokens": 4, "cache_read_input_tokens": 0, "cache_creation_input_tokens": 0}
}כאשר "stream": true התשובה היא סטרום של אירועים רשמיים: message_start, content_block_start, content_block_delta, content_block_stop, message_delta ו-message_stop. ה-message_delta הסופי מכיל את מספר טוקנים הפלט.
פורמטים תואמי OpenAI
אותו מודל עונה לפורמטים של OpenAI, כך שקוד OpenAI קיים צריך רק כתובת בסיס חדשה ומזהה מודל:
from openai import OpenAI
client = OpenAI(api_key="YOUR_SEEDROUTER_KEY", base_url="https://api.seedrouter.ai/v1")
chat = client.chat.completions.create(
model="claude-fable-5",
messages=[{"role": "user", "content": "Hello"}],
)
response = client.responses.create(model="claude-fable-5", input="Hello")הבקשות הללו מומרות לפורמט Messages, כך ששדה ללא מקביל ב-Messages אין השפעה. התשובות שלהם משאירות את השדות הרשמיים של OpenAI וייתכן שיכללו כמה שדות שימוש נוספים; קרא usage.total_tokens והשדות הרשמיים.
שגיאות
שגיאות ב-/v1/messages משתמשות בצורת Anthropic, {"type": "error", "error": {"type": "...", "message": "..."}}; הפורמטים האחרים משתמשים ב-{"error": {"code": ..., "message": "..."}}. ה-code הוא קוד מ-קטלוג השגיאות המשותף. בקשות שנכשלו אינן מחויבות.
טיפים
- התחל עם עומק החשיבה ברירת המחדל והגביל אותו רק לתפקידים שצריכים חשיבה יותר; שינויי עומק החשיבה משפיעים על איכות ועלות.
- הגדר
max_tokensגבוה מספיק לחשיבה ולתשובה: זה תקציב אחד לשניהם. - שים הקשר ארוך וחוזר קדימה וסמן אותו עם
cache_controlכדי שבקשות מאוחרות יקראו אותו מהמטמון בתעריף נמוך יותר.
