Claude Opus 5.5 è disponibile su SeedRouter
LogoSeedRouter

Cerca modelli per nome, es. 'nano banana'

Cerca modelli per nome, es. 'nano banana'

Text

Claude Haiku 5.5

View Markdown

Guida Messages di Claude Haiku 5.5: parametri, pensiero, strumenti forzati, cache, funzioni beta, streaming e gestione delle risposte.

Usa claude-haiku-5-5 con POST https://api.seedrouter.ai/v1/messages. Il modello accetta testo, immagini e documenti e restituisce testo o richieste di strumenti. La pagina del modello mostra le tariffe attuali dei token.

Il contratto seguente segue la documentazione Anthropic specifica del modello, controllata il 9 ottobre 2026. I limiti ufficiali delle capacità e la verifica end-to-end sono distinti: l'accettazione di un campo non dimostra che si sia verificato l'effetto previsto. Consulta i risultati di compatibilità prima di usare opzioni avanzate.

Avvio rapido

curl https://api.seedrouter.ai/v1/messages \
  -H "x-api-key: $SEEDROUTER_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "claude-haiku-5-5",
    "max_tokens": 1024,
    "messages": [{"role": "user", "content": "Classify this request as billing, technical or account: I was charged twice. Return only the label."}]
  }'
import os
import anthropic

client = anthropic.Anthropic(
    api_key=os.environ["SEEDROUTER_API_KEY"],
    base_url="https://api.seedrouter.ai",
)
message = client.messages.create(
    model="claude-haiku-5-5",
    max_tokens=1024,
    messages=[{"role": "user", "content": "Summarize the purpose of a database index."}],
)
for block in message.content:
    if block.type == "text":
        print(block.text)
import Anthropic from '@anthropic-ai/sdk';

const client = new Anthropic({
  apiKey: process.env.SEEDROUTER_API_KEY,
  baseURL: 'https://api.seedrouter.ai',
});
const message = await client.messages.create({
  model: 'claude-haiku-5-5',
  max_tokens: 1024,
  messages: [{ role: 'user', content: 'Summarize the purpose of a database index.' }],
});
for (const block of message.content) {
  if (block.type === 'text') console.log(block.text);
}

Conserva la chiave API sul server. Seleziona i blocchi di risposta per type; una risposta può iniziare con pensiero o una chiamata a uno strumento.

package main

import (
    "bytes"
    "encoding/json"
    "fmt"
    "io"
    "net/http"
    "os"
    "time"
)

func main() {
    body, err := json.Marshal(map[string]any{
        "model": "claude-haiku-5-5",
        "max_tokens": 1024,
        "messages": []map[string]string{
            {"role": "user", "content": "Summarize the purpose of a database index."},
        },
    })
    if err != nil { panic(err) }
    req, err := http.NewRequest("POST", "https://api.seedrouter.ai/v1/messages", bytes.NewReader(body))
    if err != nil { panic(err) }
    req.Header.Set("x-api-key", os.Getenv("SEEDROUTER_API_KEY"))
    req.Header.Set("anthropic-version", "2023-06-01")
    req.Header.Set("Content-Type", "application/json")
    client := &http.Client{Timeout: 2 * time.Minute}
    res, err := client.Do(req)
    if err != nil { panic(err) }
    defer res.Body.Close()
    data, err := io.ReadAll(res.Body)
    if err != nil { panic(err) }
    if res.StatusCode >= 400 { panic(fmt.Sprintf("HTTP %d: %s", res.StatusCode, data)) }
    fmt.Println(string(data))
}

Parametri della richiesta

Il contratto nativo contiene 25 campi di primo livello. Opzionale non significa nullable: solo le righe che citano esplicitamente null lo accettano. I campi sconosciuti e i campi di campionamento non supportati vengono scartati prima dell'inoltro, secondo la politica dei parametri dei modelli di testo. I valori non validi dei campi supportati restituiscono un invalid_request_error prima della generazione.

CampoObbligatorioContratto
modelSìclaude-haiku-5-5.
max_tokensSìIntero 0–128000, incluso il pensiero. Nessun valore predefinito API. Il Playground parte da 8192.
messagesSì1–100000 messaggi con ruolo e stringa o array di blocchi di contenuto. Vedi le regole di conversazione sotto.
systemNoStringa o array di blocchi di testo. Non null.
thinkingNoadaptive per impostazione predefinita, oppure disabled. Nessun budget manuale e nessuna modalità between_tools.
output_configNoOggetto con effort, format e il campo beta opzionale task_budget.
stop_sequencesNoArray di stringhe di arresto.
streamNoBooleano; false per impostazione predefinita.
temperatureNoOmetti. Scartato qui; il valore ufficiale di compatibilità è 1.
top_pNoOmetti. Scartato qui; il valore ufficiale di compatibilità è 0.99.
top_kNoNon supportato e scartato.
toolsNoArray di strumenti client o dichiarazioni ufficiali di strumenti server.
tool_choiceNoauto, none, any o tool specificato per nome. Gli strumenti forzati sono supportati.
metadataNoOggetto; user_id opzionale è una stringa di massimo 512 caratteri o null.
cache_controlNoNull o {"type":"ephemeral","ttl":"5m"}; il TTL accetta anche 1h. Il TTL predefinito è 5m.
containerNoNull, stringa ID del container oppure oggetto con ID opzionale e fino a 20 skill.
context_managementNoNull oppure oggetto con modifiche ufficiali al contesto; si applicano gli header beta.
mcp_serversNoArray di massimo 20 server URL; richiede l'header beta MCP corrispondente.
service_tierNoauto o standard_only. Haiku non ha capacità Priority Tier.
inference_geoNoglobal, us o null. Se omesso, usa il valore predefinito dell'account; esamina l'uso dichiarato prima di presumere una regione.
diagnosticsNoNull oppure oggetto; previous_message_id è null o una stringa di massimo 256 caratteri.
compactionNoNull o {"type":"summarize","instructions":"..."}. Le istruzioni sono opzionali, nullable e lunghe massimo 16384 caratteri.
fallbacksNoNull o default con la beta corrispondente. Haiku non ha modelli di fallback automatici; gli elenchi espliciti non sono validi.
fallback_credit_tokenNoNull, stringa token o {token,mode}. L'API deve verificare idoneità e validità; non presumere che qualsiasi modello sia una destinazione idonea.
speedNostandard o null. La modalità veloce non è supportata.

Il Playground fornisce controlli per i campi supportati, inclusi controlli JSON per strutture annidate. I parametri di campionamento e la velocità standard fissa sono omessi dal modulo. L'ID del modello è fisso per questa pagina. Usa l'anteprima JSON della richiesta per esaminare il corpo inviato.

Pensiero e sforzo

L'impostazione predefinita è il pensiero adattivo con sforzo medium e testo del pensiero omesso. Lo sforzo accetta low, medium, high, xhigh, max oppure null per usare il valore predefinito.

{
  "thinking": {"type": "adaptive", "display": "summarized"},
  "output_config": {"effort": "medium"}
}

Per disattivare il pensiero, usa {"type":"disabled"} con sforzo low, medium o high. Non includere display o block_binding in modalità disabled. enabled, budget_tokens, between_tools e il pensiero disabled con xhigh/max non sono validi.

Il campo adattivo display accetta omitted, summarized o null. Il valore beta generico updates richiede thinking-display-updates-2026-08-18; Anthropic attualmente non stabilisce aggiornamenti di avanzamento leggibili per Haiku, quindi non fare affidamento su tale output.

Il campo opzionale thinking.block_binding richiede thinking-binding-controls-2026-08-01. È null oppure un oggetto il cui prefix_mismatch_behavior è error, drop_block o null. Conserva invariati i turni precedenti e i blocchi di pensiero completi quando ripresenti la cronologia. Le firme del pensiero sono associate all'account che le ha prodotte o a un account collegato.

output_config.task_budget è null oppure { "type": "tokens", "total": 20000 } con remaining opzionale intero/null. Richiede task-budgets-2026-03-13; total deve essere almeno 20000. Qui non viene imposto alcun altro intervallo a remaining.

Strumenti e output strutturato

Gli strumenti client richiedono un nome di 1–128 lettere, cifre, underscore o trattini e un input_schema con type: "object". Usa tool_choice: {"type":"any"} o {"type":"tool","name":"lookup"} per forzare uno strumento dichiarato. Con pensiero adattivo, una risposta con strumento forzato inizia dalla chiamata allo strumento senza blocco di pensiero.

disable_parallel_tool_use è un booleano opzionale per le scelte auto, any e tool; non è un campo di none. Restituisci il risultato dello strumento con il tool_use_id originale. Il Playground mostra le chiamate ma non esegue i tuoi strumenti client.

{
  "tools": [{
    "name": "lookup",
    "description": "Look up a product by SKU.",
    "input_schema": {
      "type": "object",
      "properties": {"sku": {"type": "string"}},
      "required": ["sku"],
      "additionalProperties": false
    }
  }],
  "tool_choice": {"type": "tool", "name": "lookup"}
}

Le risposte strutturate usano output_config.format: {"type":"json_schema","schema":{...}}. Segui il sottoinsieme di JSON Schema supportato da Anthropic, incluso additionalProperties: false negli oggetti. Una struttura valida non garantisce valori fattualmente corretti. Gli strumenti strict e l'output strutturato hanno limiti sull'intero schema; vedi la guida ufficiale all'output strutturato.

L'uso del computer richiede computer_toolset_20260801; le vecchie versioni degli strumenti computer non sono valide. L'uso del browser ha il proprio browser_toolset_20260801. Dichiarare uno strumento non verifica che una sessione completa di strumenti server funzioni. Consulta la guida ufficiale dello strumento e i requisiti beta prima di usarlo.

Conversazioni e gestione del contesto

Il normale prefill dell'assistente non è supportato. Continuare uno strumento server in pausa è diverso: reinvia i blocchi completi dell'assistente come indicato dal protocollo Messages.

Un messaggio di sistema con contenuto può comparire dopo un messaggio utente o il risultato di uno strumento server in pausa. Deve essere seguito da un messaggio assistente oppure essere l'ultimo messaggio. I messaggi di sistema consecutivi vengono valutati come un unico gruppo. Non inserirne uno tra una chiamata a uno strumento client e il suo risultato obbligatorio.

Un messaggio di sistema senza contenuto può modificare solo output_config.effort con mid-conversation-output-config-2026-07-01. Può comparire ovunque. Quando il pensiero è disattivato, non può modificare lo sforzo effettivo. Il campo di sistema clear_at accetta never, next_user_message o null con mid-conversation-system-clear-at-2026-08-21; i messaggi limitati al turno ammettono solo testo, senza configurazione di output o cache dei blocchi.

Le modifiche al contesto includono:

ModificaBetaVincoli principali
clear_tool_uses_20250919context-management-2025-06-27Conteggio di attivazione almeno 1; conteggio da conservare almeno 0.
clear_thinking_20251015context-management-2025-06-27Conserva tutto o almeno un turno di pensiero. Posiziona prima della cancellazione degli usi degli strumenti quando combini modifiche.
compact_20260112compact-2026-01-12Soglia di attivazione dei token di input almeno 50000; valore predefinito 150000.

La compaction su richiesta richiede compact-2026-09-04. Non può essere combinata con context_management, stop_sequences, formato di output, strumenti forzati o task_budget.remaining. Un blocco di compattazione firmato non può essere combinato neppure con task_budget.remaining o compattazione a soglia. Conserva il blocco restituito e la firma quando continui.

Immagini, PDF e dimensione della richiesta

Le immagini accettano JPEG, PNG, GIF e WebP tramite URL, base64 o riferimento a file. I PDF accettano URL, base64 o riferimento a file. I riferimenti richiedono la beta Files API pertinente e accesso valido al file. I documenti di testo possono usare fonti di testo o contenuto.

Il limite della richiesta nativa è 32 MB. I limiti ufficiali delle immagini sono fino a 600 immagini, 10 MB di dati codificati in base64 per immagine e 8000 pixel su ciascun lato; le richieste con molte immagini possono avere limiti più restrittivi specifici della piattaforma. I PDF devono essere non cifrati e avere al massimo 600 pagine per il contesto di questo modello. L'API resta responsabile dell'ispezione dei file remoti; i controlli locali sulla struttura non possono dimostrare il contenuto di un URL.

Il Playground carica gli allegati prima di inviare gli URL. Il JSON della conversazione supporta anche blocchi di contenuto multimediale nativi. Le prove dei limiti completi di dimensione dei media e finestra di contesto sono distinte da una piccola richiesta di esempio.

Cache dei prompt e fatturazione

Il prompt minimo memorizzabile nella cache di Haiku è di 512 token. I prompt marcati più brevi possono essere eseguiti senza creare una voce di cache. Usa al massimo quattro punti di interruzione della cache; il controllo automatico della cache di primo livello occupa uno slot. Posiziona i prefissi con durata maggiore prima di quelli con durata minore.

max_tokens: 0 richiede il preriscaldamento della cache senza generare una risposta. Non può accompagnare stream: true, output strutturato o uso forzato di strumenti. Mantieni coerenti le impostazioni di pensiero e sforzo tra la preparazione della cache e le richieste che la riutilizzano.

Leggi usage.input_tokens, output_tokens, cache_creation_input_tokens, cache_read_input_tokens e la suddivisione 5m/1h sotto cache_creation. Il pensiero è incluso nei token di output; una suddivisione dei token di pensiero dichiarata non è un costo aggiuntivo da sommare. Le tariffe attuali sono nella sezione prezzi, con altre spiegazioni nella guida ai prezzi.

Risposte, streaming ed errori

Una risposta completata contiene id, type: "message", role: "assistant", model, content, stop_reason, stop_sequence e usage. I campi opzionali container, diagnostics, context_management, stop_details e input_transformations vengono conservati quando restituiti.

Gestisci end_turn, max_tokens, stop_sequence, tool_use, pause_turn, compaction, refusal e model_context_window_exceeded. Un arresto per limite o un rifiuto non equivalgono a un errore HTTP. Non considerare mai garantito che il primo blocco di contenuto sia testo.

Lo streaming usa gli eventi SSE di Messages: message_start, content_block_start, content_block_delta, content_block_stop, message_delta e message_stop. Gestisci anche gli eventi ping ed error. Conserva le firme del pensiero e i blocchi di strumenti necessari ai turni successivi.

Gli errori usano la struttura Anthropic:

{"type":"error","error":{"type":"invalid_request_error","message":"max_tokens must be an integer from 0 to 128000."}}

Le richieste che restituiscono un errore non vengono addebitate. Vedi la gestione degli errori per i tipi di errore condivisi.

Formati compatibili con OpenAI

Lo stesso ID è disponibile con /v1/chat/completions e /v1/responses. Usa i loro campi nativi: Chat usa messages; Responses usa input. Le opzioni native Claude appartengono a Messages e non vanno copiate integralmente in un corpo in formato OpenAI.

curl https://api.seedrouter.ai/v1/chat/completions \
  -H "Authorization: Bearer $SEEDROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"claude-haiku-5-5","max_tokens":256,"messages":[{"role":"user","content":"Reply with OK."}]}'
curl https://api.seedrouter.ai/v1/responses \
  -H "Authorization: Bearer $SEEDROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"claude-haiku-5-5","max_output_tokens":256,"input":"Reply with OK."}'

Risultati di compatibilità

Verificato il 9 ottobre 2026 nell'ambiente di sviluppo. Queste verifiche stabiliscono il comportamento osservato di richieste specifiche, non tutti i limiti ufficiali o il rilascio in produzione.

CapacitàRisultato osservato
Messages nativo e SSERisposta testuale e sequenza completa degli eventi verificate.
ClassificazioneHa restituito Billing; 41 token di input e 5 di output.
JSON strutturato e strumenti clientVerificati valori JSON, selezione automatica/none/per nome/any, argomenti di strumenti strict e continuazione con risultato dello strumento.
Immagini e PDFHa restituito il colore dell'immagine e il marcatore PDF attesi da campioni base64. I limiti completi dei media non sono stati testati.
Preriscaldamento della cachemax_tokens: 0 non ha restituito testo generato e ha restituito zero token di output.
Cache di cinque minuti e un'oraVerificati creazione e successivo uso tramite cache hit per entrambi i TTL.
Sequenze di arrestoHa restituito il motivo richiesto e si è fermato prima del suffisso escluso.
Pensiero e sforzoTutti e cinque i valori di sforzo sono stati accettati. Alcune richieste esplicite con pensiero disabled hanno comunque restituito blocchi di pensiero. La sola accettazione non verifica il comportamento dello sforzo.
Istruzioni di sistema e sforzo per messaggioRisultati incoerenti; un test per messaggio con budget maggiore ha comunque restituito testo non pertinente. Prova la tua conversazione esatta prima del rilascio.
Compattazione su richiestaHa restituito un blocco di compattazione firmato e stop_reason: compaction. La validazione di ripresentazione completa e fatturazione resta da completare.
Metadati e geografia di inferenzametadata.user_id ha restituito un errore di autorizzazione; la geografia esplicita ha restituito una restrizione per tipo di account.
MCPLa beta MCP attuale ha restituito una restrizione sulle credenziali. Non è stata verificata una sessione MCP completa.
OpenAI Chat e ResponsesRichieste di base e richieste di ragionamento esplicite max/none hanno restituito la risposta attesa. La semantica di ragionamento non è stata stabilita indipendentemente.
Altri campi betaBudget delle attività, controlli di associazione e fallback default sono stati accettati; la semantica completa delle funzioni non è stata stabilita.

La fatturazione della scrittura cache di un'ora e della compattazione non ha superato la validazione per il rilascio. Non sono state testate esecuzioni con contesto/output massimi, strumenti ospitati con costi separati, accesso alla Files API o riscatto di crediti di fallback. Mantieni le strutture ufficiali delle richieste; non dedurre supporto da un solo stato di successo.

Riferimenti