Claude Opus 5.5
קריאה ל-Claude Opus 5.5 עם ה-API הרשמי של Anthropic Messages, או ה-OpenAI Chat Completions ו-Responses: חשיבה אדפטיבית, חלון קשר של 1M טוקנים וטוקנים פלט של עד 128K.
Claude Opus 5.5 הוא מודל של Anthropic לפיתוח סוכנים ממושך ועבודת ידע. שלח את בקשת Anthropic Messages הרשמית ל-SeedRouter: שנה את כתובת הבסיס ואת מפתח ה-API, שמור את גוף הבקשה. אותו מודל גם עונה לפורמטים OpenAI Chat Completions ו-Responses.
מזהה המודל
| מזהה המודל | חלון קשר | פלט מקסימלי | חשיבה | עומק חשיבה ברירת מחדל |
|---|---|---|---|---|
claude-opus-5-5 | 1M tokens | 128K tokens | אדפטיבי, תמיד פעיל | medium |
ראה את דף המודל לקבלת המחירים הנוכחיים.
דוגמה מהירה
curl https://api.seedrouter.ai/v1/messages \
-H "x-api-key: $SEEDROUTER_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-H "Content-Type: application/json" \
-d '{
"model": "claude-opus-5-5",
"max_tokens": 1024,
"messages": [{"role": "user", "content": "Summarize the trade-offs of event sourcing in three bullet points."}]
}'נקודות קצה
| פורמט | שיטה וכתובת | אימות |
|---|---|---|
| Anthropic Messages | POST https://api.seedrouter.ai/v1/messages | x-api-key: <key> או Authorization: Bearer <key>, בתוספת anthropic-version |
| OpenAI Chat Completions | POST https://api.seedrouter.ai/v1/chat/completions | Authorization: Bearer <key> |
| OpenAI Responses | POST https://api.seedrouter.ai/v1/responses | Authorization: Bearer <key> |
נקודת הקצה Messages מעבירה את גוף הבקשה שלך כפי שנשלח, כולל שדות אופציונליים, והחוזרת את התשובה הרשמית. כותרת anthropic-beta מועברת גם. שמור את מפתח ה-API בקוד שרץ בצד השרת.
פרמטרים
| שם | סוג | חובה | ברירת מחדל | הערות |
|---|---|---|---|---|
model | string | כן | — | claude-opus-5-5. |
max_tokens | integer | כן | — | 0–128000. כולל הטוקנים שהמודל הוציא בחשיבה. 0 רק מחזק את מטמון הפרומפט. |
messages | object[] | כן | — | תורות משתמש והעונה לסירוגין; content הוא מחרוזת או מערך של בלוקי תוכן. התור האחרון חייב להיות user. חריג: כדי להמשיך תגובת pause_turn, שלח את התוכן שלה בחזרה כפי שהוא כהודעת assistant האחרונה. |
system | string or object[] | לא | — | הנחיות המערכת. |
thinking | object | לא | {"type": "adaptive"} | החשיבה היא אדפטיבית ותמיד פעילה. display: omitted (ברירת מחדל) או summarized. |
output_config.effort | enum | לא | medium | low, medium, high, xhigh, max. משפיע על עומק החשיבה של המודל. |
output_config.format | object | לא | — | סכמה JSON לתוכן מובנה. |
stop_sequences | string[] | לא | — | עצור כשאחד מהמחרוזות האלה נוצר. |
stream | boolean | לא | false | סטרום התשובה כאירועי שנשלחו בשרת. |
temperature | number | לא | — | רק 1 (ברירת המחדל) מתקבל, לצורך תאימות לאחור; כל ערך אחר מחזיר שגיאת 400. השמט אותו. |
top_p | number | לא | — | רק ערכים מ-0.99 עד 1 מתקבלים, לצורך תאימות לאחור; כל ערך אחר מחזיר שגיאת 400. השמט אותו. |
top_k | integer | לא | — | לא מקבל: כל ערך מחזיר שגיאת 400. השאר פתוח. |
tools | object[] | לא | — | הגדרות כלים. |
tool_choice | object | לא | — | auto או none; כפיית כלי (any או tool) אינה נתמכת על ידי מודל זה. |
metadata.user_id | string | לא | — | מזהה אטום למשתמש הקצה שלך, עד 512 תווים. |
cache_control | object | לא | — | נקודת כניסה למטמון הפרומפט ברמה עליונה. |
container, context_management, mcp_servers, diagnostics, service_tier, inference_geo, speed | — | לא | — | מועברים כשנשלחו. |
חשיבה ועומק חשיבה
Claude Opus 5.5 משתמש תמיד בחשיבה אדפטיבית: המודל מחליט כמה לחשוב, ו-output_config.effort משפיע על זה. עומק חשיבה גבוה יותר בדרך כלל אומר יותר טוקנים פלט, המתנה ארוכה יותר ועלות גבוהה יותר. כאשר thinking.display מוגדר ל-summarized, התשובה כוללת בלוקי thinking שאתה יכול להציג; כאשר הוא omitted, הם מושמטים. טוקנים של חשיבה מחויבים כטוקנים פלט.
קלטי מדיה
תמונות וקבצי PDF הולכים בתור content בתור בלוקי image ו-document, עם מקור url או, כפי שנמצא ב-API הרשמי, מקור base64:
{"role": "user", "content": [
{"type": "image", "source": {"type": "url", "url": "https://example.com/chart.png"}},
{"type": "text", "text": "What does this chart show?"}
]}החלף את כתובת הדוגמה בקובץ ציבורי שלך.
מימדי חיוב
ראה את התעריפים הנוכחיים בדף המודל. בקשה מחויבת לפי הטוקנים בהם היא משתמשת:
- טוקנים קלט,
- טוקנים פלט, כולל חשיבה,
- קריאות מטמון הפרומפט, ו-
- כתיבות מטמון הפרומפט, עם תעריפים נפרדים ל-5 דקות ו-1 שעה.
הסכום נלקח מה-usage המדווח עם התשובה המסיימת. בקשה שנכשלת אינה מחויבת. רשימת השימוש של החשבון שלך מציגה את התשלום המדויק לכל בקשה.
פלט
בקשה שאינה סטרימינג מחזירה את אובייקט ההודעה הרשמי:
{
"id": "msg_...",
"type": "message",
"role": "assistant",
"model": "claude-opus-5-5",
"content": [{"type": "text", "text": "..."}],
"stop_reason": "end_turn",
"usage": {"input_tokens": 18, "output_tokens": 4, "cache_read_input_tokens": 0, "cache_creation_input_tokens": 0}
}כאשר "stream": true התשובה היא סטרום של אירועים רשמיים: message_start, content_block_start, content_block_delta, content_block_stop, message_delta ו-message_stop. ה-message_delta הסופי מכיל את מספר טוקנים הפלט.
פורמטים תואמי OpenAI
אותו מודל עונה לפורמטים של OpenAI, כך שקוד OpenAI קיים צריך רק כתובת בסיס חדשה ומזהה מודל:
from openai import OpenAI
client = OpenAI(api_key="YOUR_SEEDROUTER_KEY", base_url="https://api.seedrouter.ai/v1")
chat = client.chat.completions.create(
model="claude-opus-5-5",
messages=[{"role": "user", "content": "Hello"}],
)
response = client.responses.create(model="claude-opus-5-5", input="Hello")הבקשות הללו מומרות לפורמט Messages, כך ששדה ללא מקביל ב-Messages אין השפעה. התשובות שלהם משאירות את השדות הרשמיים של OpenAI וייתכן שיכללו כמה שדות שימוש נוספים; קרא usage.total_tokens והשדות הרשמיים.
שגיאות
שגיאות ב-/v1/messages משתמשות בצורת Anthropic, {"type": "error", "error": {"type": "...", "message": "..."}}; הפורמטים האחרים משתמשים ב-{"error": {"code": ..., "message": "..."}}. ה-code הוא קוד מ-קטלוג השגיאות המשותף. בקשות שנכשלו אינן מחויבות.
טיפים
- התחל עם עומק החשיבה ברירת המחדל והגביל אותו רק לתפקידים שצריכים חשיבה יותר; שינויי עומק החשיבה משפיעים על איכות ועלות.
- הגדר
max_tokensגבוה מספיק לחשיבה ולתשובה: זה תקציב אחד לשניהם. - שים הקשר ארוך וחוזר קדימה וסמן אותו עם
cache_controlכדי שבקשות מאוחרות יקראו אותו מהמטמון בתעריף נמוך יותר.
