Text
Claude Haiku 5.5
תיעוד Messages של Claude Haiku 5.5: פרמטרים, חשיבה, כפיית כלים, שימוש במטמון, תכונות בטא, הזרמה וטיפול בתשובות.
השתמש ב-claude-haiku-5-5 עם POST https://api.seedrouter.ai/v1/messages. המודל מקבל טקסט, תמונות ומסמכים ומחזיר טקסט או בקשות לכלים. עמוד המודל מציג תעריפי טוקנים עדכניים.
החוזה להלן מבוסס על התיעוד של Anthropic הייעודי למודל, שנבדק ב-9 באוקטובר 2026. מגבלות היכולת הרשמיות ואימות מקצה לקצה הם דברים נפרדים: קבלה של שדה אינה מוכיחה שהתרחש האפקט המיועד שלו. בדוק את תוצאות התאימות להלן לפני שימוש באפשרויות מתקדמות.
התחלה מהירה
curl https://api.seedrouter.ai/v1/messages \
-H "x-api-key: $SEEDROUTER_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-H "Content-Type: application/json" \
-d '{
"model": "claude-haiku-5-5",
"max_tokens": 1024,
"messages": [{"role": "user", "content": "Classify this request as billing, technical or account: I was charged twice. Return only the label."}]
}'import os
import anthropic
client = anthropic.Anthropic(
api_key=os.environ["SEEDROUTER_API_KEY"],
base_url="https://api.seedrouter.ai",
)
message = client.messages.create(
model="claude-haiku-5-5",
max_tokens=1024,
messages=[{"role": "user", "content": "Summarize the purpose of a database index."}],
)
for block in message.content:
if block.type == "text":
print(block.text)import Anthropic from '@anthropic-ai/sdk';
const client = new Anthropic({
apiKey: process.env.SEEDROUTER_API_KEY,
baseURL: 'https://api.seedrouter.ai',
});
const message = await client.messages.create({
model: 'claude-haiku-5-5',
max_tokens: 1024,
messages: [{ role: 'user', content: 'Summarize the purpose of a database index.' }],
});
for (const block of message.content) {
if (block.type === 'text') console.log(block.text);
}שמור את מפתח API בשרת. בחר בלוקים בתשובה לפי type; תשובה עשויה להתחיל בחשיבה או בקריאה לכלי.
package main
import (
"bytes"
"encoding/json"
"fmt"
"io"
"net/http"
"os"
"time"
)
func main() {
body, err := json.Marshal(map[string]any{
"model": "claude-haiku-5-5",
"max_tokens": 1024,
"messages": []map[string]string{
{"role": "user", "content": "Summarize the purpose of a database index."},
},
})
if err != nil { panic(err) }
req, err := http.NewRequest("POST", "https://api.seedrouter.ai/v1/messages", bytes.NewReader(body))
if err != nil { panic(err) }
req.Header.Set("x-api-key", os.Getenv("SEEDROUTER_API_KEY"))
req.Header.Set("anthropic-version", "2023-06-01")
req.Header.Set("Content-Type", "application/json")
client := &http.Client{Timeout: 2 * time.Minute}
res, err := client.Do(req)
if err != nil { panic(err) }
defer res.Body.Close()
data, err := io.ReadAll(res.Body)
if err != nil { panic(err) }
if res.StatusCode >= 400 { panic(fmt.Sprintf("HTTP %d: %s", res.StatusCode, data)) }
fmt.Println(string(data))
}פרמטרי הבקשה
בחוזה המקורי יש 25 שדות ברמה העליונה. אופציונלי אינו אומר שמותר ערך ריק: רק שורות שמציינות במפורש null מקבלות אותו. שדות לא מוכרים ושדות דגימה שאינם נתמכים מושמטים לפני ההעברה, לפי מדיניות הפרמטרים של מודלי טקסט. ערכים לא תקינים בשדות נתמכים מחזירים invalid_request_error לפני היצירה.
| שדה | נדרש | חוזה |
|---|---|---|
model | כן | claude-haiku-5-5. |
max_tokens | כן | מספר שלם 0–128000, כולל חשיבה. אין ברירת מחדל ב-API. ה-Playground מתחיל ב-8192. |
messages | כן | 1–100000 הודעות עם תפקיד ומחרוזת או מערך בלוקי תוכן. ראה כללי שיחה להלן. |
system | לא | מחרוזת או מערך בלוקי טקסט. אינו מקבל null. |
thinking | לא | adaptive כברירת מחדל, או disabled. אין תקציב ידני ואין מצב between_tools. |
output_config | לא | אובייקט עם effort, format ושדה בטא אופציונלי task_budget. |
stop_sequences | לא | מערך מחרוזות עצירה. |
stream | לא | ערך בוליאני; false כברירת מחדל. |
temperature | לא | השמט. מושמט כאן; ערך התאימות הרשמי הוא 1. |
top_p | לא | השמט. מושמט כאן; ערך התאימות הרשמי הוא 0.99. |
top_k | לא | אינו נתמך ומושמט. |
tools | לא | מערך כלי לקוח או הצהרות רשמיות על כלי שרת. |
tool_choice | לא | auto, none, any, או tool בשם מפורש. כפיית כלים נתמכת. |
metadata | לא | אובייקט; user_id אופציונלי הוא מחרוזת באורך עד 512 תווים או null. |
cache_control | לא | null או {"type":"ephemeral","ttl":"5m"}; TTL מקבל גם 1h. ברירת המחדל של TTL היא 5m. |
container | לא | null, מחרוזת מזהה קונטיינר, או אובייקט עם מזהה אופציונלי ועד 20 מיומנויות. |
context_management | לא | null או אובייקט עם עריכות ההקשר הרשמיות; נדרשות כותרות הבטא המתאימות. |
mcp_servers | לא | מערך של עד 20 שרתי URL; דורש כותרת בטא תואמת ל-MCP. |
service_tier | לא | auto או standard_only. ל-Haiku אין קיבולת Priority Tier. |
inference_geo | לא | global, us, או null. השמטה משתמשת בברירת המחדל של החשבון; בדוק שימוש מדווח לפני הנחת אזור. |
diagnostics | לא | null או אובייקט; previous_message_id הוא null או מחרוזת באורך עד 256 תווים. |
compaction | לא | null או {"type":"summarize","instructions":"..."}. ההוראות אופציונליות, מקבלות null ובאורך עד 16384 תווים. |
fallbacks | לא | null או default עם הבטא המתאימה. ל-Haiku אין מודלי חלופה אוטומטיים; רשימות מפורשות אינן תקינות. |
fallback_credit_token | לא | null, מחרוזת טוקן, או {token,mode}. על API לאמת זכאות ותוקף; אל תניח שכל מודל הוא יעד זכאי. |
speed | לא | standard או null. מצב מהיר אינו נתמך. |
ה-Playground מספק בקרות לשדות הנתמכים, כולל בקרות JSON למבנים מקוננים. פרמטרי דגימה ומהירות standard הקבועה מושמטים מהטופס. מזהה המודל קבוע לעמוד זה. השתמש בתצוגה המקדימה של בקשת JSON כדי לבחון את הגוף שנשלח.
חשיבה ומאמץ
ברירת המחדל היא חשיבה אדפטיבית במאמץ medium, ללא הצגת טקסט החשיבה. רמת המאמץ מקבלת low, medium, high, xhigh, max, או null לשימוש בברירת המחדל.
{
"thinking": {"type": "adaptive", "display": "summarized"},
"output_config": {"effort": "medium"}
}לכיבוי החשיבה, השתמש ב-{"type":"disabled"} במאמץ low, medium או high. אל תכלול display או block_binding במצב disabled. הערכים enabled, budget_tokens, between_tools, וחשיבה כבויה ב-xhigh/max אינם תקינים.
display במצב adaptive מקבל omitted, summarized, או null. ערך הבטא הכללי updates דורש thinking-display-updates-2026-08-18; Anthropic אינה מבססת כרגע עדכוני התקדמות קריאים עבור Haiku, ולכן אין להסתמך על פלט זה.
thinking.block_binding האופציונלי דורש thinking-binding-controls-2026-08-01. הוא null או אובייקט שבו prefix_mismatch_behavior הוא error, drop_block, או null. השאר תורים קודמים בשיחה ובלוקי חשיבה מלאים ללא שינוי בעת שליחה חוזרת של ההיסטוריה. חתימות חשיבה קשורות לחשבון שיצר אותן או לחשבון המקושר אליו.
output_config.task_budget הוא null או { "type": "tokens", "total": 20000 } עם remaining אופציונלי מסוג מספר שלם/null. הוא דורש task-budgets-2026-03-13; total חייב להיות לפחות 20000. אין כאן מגבלת טווח נוספת ל-remaining.
כלים ופלט מובנה
כלי לקוח דורשים שם של 1–128 אותיות, ספרות, קווים תחתונים או מקפים, ו-input_schema עם type: "object". השתמש ב-tool_choice: {"type":"any"} או ב-{"type":"tool","name":"lookup"} כדי לכפות כלי שהוצהר. עם חשיבה אדפטיבית, תשובה עם כלי כפוי מתחילה בקריאה לכלי ללא בלוק חשיבה.
disable_parallel_tool_use הוא ערך בוליאני אופציונלי לבחירות auto, any ו-tool; הוא אינו שדה של none. שלח חזרה את תוצאת הכלי עם tool_use_id המקורי. ה-Playground מציג קריאות אך אינו מפעיל את כלי הלקוח שלך.
{
"tools": [{
"name": "lookup",
"description": "Look up a product by SKU.",
"input_schema": {
"type": "object",
"properties": {"sku": {"type": "string"}},
"required": ["sku"],
"additionalProperties": false
}
}],
"tool_choice": {"type": "tool", "name": "lookup"}
}תשובות מובנות משתמשות ב-output_config.format: {"type":"json_schema","schema":{...}}. פעל לפי תת-הקבוצה של JSON Schema הנתמכת ב-Anthropic, כולל additionalProperties: false באובייקטים. מבנה תקין אינו מבטיח ערכים נכונים עובדתית. לכלים קשיחים ולפלט מובנה יש מגבלות ברמת הסכמה; ראה התיעוד הרשמי לפלט מובנה.
שימוש במחשב דורש computer_toolset_20260801; גרסאות כלי המחשב הישנות אינן תקינות. לשימוש בדפדפן יש browser_toolset_20260801 משלו. הצהרה על כלי אינה מאמתת שפעילות מלאה עם כלי שרת עובדת. בדוק את המדריך הרשמי לכלי ואת דרישות הבטא לפני השימוש.
שיחות וניהול הקשר
מילוי מראש רגיל של הודעת assistant אינו נתמך. המשך לאחר השהיית כלי שרת שונה מכך: שלח שוב את בלוקי assistant המלאים לפי פרוטוקול Messages.
הודעת מערכת עם תוכן יכולה להופיע אחרי הודעת משתמש או תוצאה של כלי שרת מושהה. חייבת לבוא אחריה הודעת assistant או שהיא תהיה ההודעה האחרונה. הודעות מערכת רצופות נבחנות כקבוצה אחת. אל תכניס הודעה כזו בין קריאת כלי לקוח לתוצאה הנדרשת שלה.
הודעת מערכת ללא תוכן יכולה לשנות רק output_config.effort עם mid-conversation-output-config-2026-07-01. היא יכולה להופיע בכל מקום. כשהחשיבה כבויה, היא אינה יכולה לשנות את המאמץ האפקטיבי. שדה המערכת clear_at מקבל never, next_user_message, או null עם mid-conversation-system-clear-at-2026-08-21; הודעות המוגבלות לתור מאפשרות טקסט בלבד, ללא הגדרות פלט או שמירת בלוקים במטמון.
עריכות הקשר כוללות:
| עריכה | בטא | מגבלות עיקריות |
|---|---|---|
clear_tool_uses_20250919 | context-management-2025-06-27 | ספירת הפעלה לפחות 1; ספירת שמירה לפחות 0. |
clear_thinking_20251015 | context-management-2025-06-27 | שמור הכול, או לפחות תור חשיבה אחד. מקם לפני ניקוי שימושי כלים כאשר משלבים עריכות. |
compact_20260112 | compact-2026-01-12 | סף הפעלה של טוקני קלט לפחות 50000; ברירת המחדל 150000. |
compaction לפי דרישה דורש compact-2026-09-04. אי אפשר לשלב אותו עם context_management, stop_sequences, פורמט פלט, כלים כפויים או task_budget.remaining. גם בלוק דחיסה חתום אינו ניתן לשילוב עם task_budget.remaining או דחיסה לפי סף. שמור את הבלוק והחתימה שהוחזרו בעת ההמשך.
תמונות, קובצי PDF וגודל בקשה
תמונות מקבלות JPEG, PNG, GIF ו-WebP באמצעות URL, base64 או הפניה לקובץ. קובצי PDF מקבלים URL, base64 או הפניה לקובץ. הפניות לקבצים דורשות את בטא Files API המתאימה וגישה תקפה לקובץ. מסמכי טקסט יכולים להשתמש במקורות טקסט או תוכן.
מגבלת הבקשה המקורית היא 32 MB. המגבלות הרשמיות לתמונות הן עד 600 תמונות, 10 MB של נתונים בקידוד base64 לכל תמונה ו-8000 פיקסלים בכל צלע; בקשות עם תמונות רבות עשויות להיות כפופות למגבלות הדוקות יותר של הפלטפורמה. קובצי PDF חייבים להיות לא מוצפנים ולהכיל לכל היותר 600 עמודים עבור גודל ההקשר של מודל זה. API עדיין אחראית לבדיקת קבצים מרוחקים; בדיקות מבנה מקומיות אינן יכולות להוכיח את תוכן ה-URL.
ה-Playground מעלה קבצים מצורפים לפני שליחת כתובות URL. JSON של השיחה תומך גם בבלוקי תוכן מדיה מקוריים. בדיקות הגבולות המלאים של גודל המדיה וחלון ההקשר נפרדות מבקשת דוגמה קטנה.
שמירת פרומפטים במטמון וחיוב
הפרומפט המזערי לשמירה במטמון ב-Haiku הוא 512 טוקנים. פרומפטים מסומנים קטנים יותר יכולים לרוץ ללא יצירת רשומה במטמון. השתמש בארבע נקודות מטמון לכל היותר; בקרת מטמון אוטומטית ברמה העליונה צורכת נקודה אחת. מקם קידומות מטמון ארוכות חיים לפני קצרות חיים.
max_tokens: 0 מבקש חימום מקדים של המטמון ללא יצירת תשובה. אי אפשר לשלב אותו עם stream: true, פלט מובנה או כפיית שימוש בכלים. שמור על הגדרות חשיבה ומאמץ עקביות בין הכנת המטמון לבקשות שמשתמשות בו מחדש.
קרא את usage.input_tokens, output_tokens, cache_creation_input_tokens, cache_read_input_tokens, ואת פירוט 5m/1h תחת cache_creation. חשיבה כלולה בטוקני הפלט; פירוט מדווח של טוקני חשיבה אינו חיוב נוסף שיש להוסיף שוב. התעריפים העדכניים מופיעים בסעיף המחירים, עם הסבר נוסף במדריך המחירים.
תשובות, הזרמה ושגיאות
תשובה שהושלמה מכילה id, type: "message", role: "assistant", model, content, stop_reason, stop_sequence ו-usage. שדות אופציונליים container, diagnostics, context_management, stop_details ו-input_transformations נשמרים כאשר הם מוחזרים.
טפל ב-end_turn, max_tokens, stop_sequence, tool_use, pause_turn, compaction, refusal ו-model_context_window_exceeded. עצירה במגבלה או סירוב אינם זהים לשגיאת HTTP. לעולם אל תניח שבלוק התוכן הראשון מובטח להיות טקסט.
הזרמה משתמשת באירועי Messages SSE: message_start, content_block_start, content_block_delta, content_block_stop, message_delta ו-message_stop. טפל גם באירועי ping ו-error. שמור חתימות חשיבה ובלוקי כלים הנחוצים לתורים הבאים.
שגיאות משתמשות במבנה של Anthropic:
{"type":"error","error":{"type":"invalid_request_error","message":"max_tokens must be an integer from 0 to 128000."}}בקשות שמחזירות שגיאה אינן מחויבות. ראה טיפול בשגיאות לסוגי השגיאות המשותפים.
פורמטים תואמי OpenAI
אותו מזהה זמין ב-/v1/chat/completions וב-/v1/responses. השתמש בשדות המקוריים שלהם: Chat משתמש ב-messages; Responses משתמש ב-input. האפשרויות המקוריות של Claude שייכות ל-Messages ואין להעתיק אותן במלואן לגוף בפורמט OpenAI.
curl https://api.seedrouter.ai/v1/chat/completions \
-H "Authorization: Bearer $SEEDROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"claude-haiku-5-5","max_tokens":256,"messages":[{"role":"user","content":"Reply with OK."}]}'curl https://api.seedrouter.ai/v1/responses \
-H "Authorization: Bearer $SEEDROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"claude-haiku-5-5","max_output_tokens":256,"input":"Reply with OK."}'תוצאות תאימות
נבדק ב-9 באוקטובר 2026 בסביבת הפיתוח. בדיקות אלה מבססות את ההתנהגות שנצפתה בבקשות מסוימות, ולא כל מגבלה רשמית או פריסה בייצור.
| יכולת | תוצאה שנצפתה |
|---|---|
| Messages מקורי ו-SSE | אומתו תשובת טקסט ורצף אירועים מלא. |
| סיווג | הוחזר Billing; 41 טוקני קלט ו-5 טוקני פלט. |
| JSON מובנה וכלי לקוח | אומתו ערכי JSON, בחירה אוטומטית/none/לפי שם/any, ארגומנטים לכלים קשיחים והמשך עם תוצאות כלים. |
| תמונות וקובצי PDF | הוחזרו צבע התמונה וסמן ה-PDF הצפויים מדוגמאות base64. מלוא מגבלות המדיה לא נבדקו. |
| חימום מקדים למטמון | max_tokens: 0 החזיר ללא טקסט שנוצר ועם אפס טוקני פלט. |
| מטמון לחמש דקות ולשעה | אומתו יצירה ושימוש לאחר פגיעת מטמון עבור שני ערכי TTL. |
| רצפי עצירה | הוחזר גורם העצירה המבוקש והיצירה נעצרה לפני הסיומת שהוחרגה. |
| חשיבה ומאמץ | כל חמש רמות המאמץ התקבלו. חלק מבקשות הכיבוי המפורשות עדיין החזירו בלוקי חשיבה. קבלה לבדה אינה מאמתת התנהגות מאמץ. |
| הוראות מערכת ומאמץ לכל הודעה | התוצאות לא היו עקביות; בדיקת מאמץ לכל הודעה בתקציב גדול יותר עדיין החזירה טקסט לא קשור. בדוק את השיחה המדויקת שלך לפני השקה. |
| דחיסה לפי דרישה | הוחזרו בלוק דחיסה חתום ו-stop_reason: compaction. אימות של שליחה חוזרת מלאה וחיוב עדיין ממתין להשלמה. |
| מטא-נתונים ואזור ההסקה | metadata.user_id החזיר שגיאת הרשאה; אזור מפורש החזיר מגבלה לפי סוג חשבון. |
| MCP | בטא MCP הנוכחית החזירה מגבלת פרטי גישה. פעילות MCP מלאה לא אומתה. |
| OpenAI Chat ו-Responses | בקשות בסיסיות ובקשות הסקה מפורשות max/none החזירו את התשובה הצפויה. משמעות הגדרות ההסקה לא בוססה באופן עצמאי. |
| שדות בטא אחרים | תקציב משימה, בקרות קשירה וחלופת default התקבלו; מלוא משמעות התכונות לא בוססה. |
חיוב כתיבת מטמון לשעה ודחיסה לא עברו אימות לקראת שחרור. ריצות במלוא ההקשר/הפלט, כלים מתארחים בעלי חיוב נפרד, גישה ל-Files API ומימוש זיכוי חלופה לא נבדקו. שמור את מבני הבקשות הרשמיים; אל תסיק תמיכה מסטטוס הצלחה בלבד.
