Claude Opus 5.5
Chiama Claude Opus 5.5 con l'API Messages ufficiale di Anthropic, o i formati Chat Completions e Responses di OpenAI: ragionamento adattivo, finestra di contesto di 1M token e fino a 128K token di output.
Claude Opus 5.5 è il modello di Anthropic per il coding agentico di lunga durata e il lavoro intellettuale. Invia la richiesta Messages ufficiale di Anthropic a SeedRouter: cambia l'URL di base e la chiave API, mantieni il corpo. Lo stesso modello risponde anche ai formati Chat Completions e Responses di OpenAI.
ID modello
| ID modello | Finestra di contesto | Output massimo | Ragionamento | Livello di effort predefinito |
|---|---|---|---|---|
claude-opus-5-5 | 1M token | 128K token | Adattivo, sempre attivo | medium |
Consulta la pagina del modello per i prezzi attuali.
Esempio rapido
curl https://api.seedrouter.ai/v1/messages \
-H "x-api-key: $SEEDROUTER_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-H "Content-Type: application/json" \
-d '{
"model": "claude-opus-5-5",
"max_tokens": 1024,
"messages": [{"role": "user", "content": "Summarize the trade-offs of event sourcing in three bullet points."}]
}'Endpoint
| Formato | Metodo e percorso | Autenticazione |
|---|---|---|
| Anthropic Messages | POST https://api.seedrouter.ai/v1/messages | x-api-key: <key> oppure Authorization: Bearer <key>, più anthropic-version |
| OpenAI Chat Completions | POST https://api.seedrouter.ai/v1/chat/completions | Authorization: Bearer <key> |
| OpenAI Responses | POST https://api.seedrouter.ai/v1/responses | Authorization: Bearer <key> |
L'endpoint Messages inoltra il corpo della richiesta così come inviato, inclusi i campi facoltativi, e restituisce la risposta ufficiale. Un'intestazione anthropic-beta viene inoltrata anche. Mantieni la chiave API nel codice lato server.
Parametri
| Nome | Tipo | Obbligatorio | Predefinito | Note |
|---|---|---|---|---|
model | string | Sì | — | claude-opus-5-5. |
max_tokens | integer | Sì | — | 0–128000. Include i token spesi sul ragionamento. 0 preriscalda solo la cache dei prompt. |
messages | object[] | Sì | — | Turni alternati user e assistant; content è una stringa o un array di blocchi di contenuto. L'ultimo turno deve essere user. Eccezione: per proseguire una risposta pause_turn, reinvia il suo contenuto invariato come ultimo messaggio assistant. |
system | string o object[] | No | — | Prompt di sistema. |
thinking | object | No | {"type": "adaptive"} | Il ragionamento è adattivo e sempre attivo. display: omitted (predefinito) o summarized. |
output_config.effort | enum | No | medium | low, medium, high, xhigh, max. Orienta quanto il modello pensa. |
output_config.format | object | No | — | Uno schema JSON per l'output strutturato. |
stop_sequences | string[] | No | — | Ferma quando una di queste stringhe viene generata. |
stream | boolean | No | false | Trasmetti la risposta come server-sent events. |
temperature | number | No | — | È accettato solo 1 (il valore predefinito), per retrocompatibilità; qualsiasi altro valore restituisce un errore 400. Omettilo. |
top_p | number | No | — | Sono accettati solo valori da 0.99 a 1, per retrocompatibilità; qualsiasi altro valore restituisce un errore 400. Omettilo. |
top_k | integer | No | — | Non accettato: qualsiasi valore restituisce un errore 400. Omettilo. |
tools | object[] | No | — | Definizioni degli strumenti. |
tool_choice | object | No | — | auto o none; forzare uno strumento (any o tool) non è supportato da questo modello. |
metadata.user_id | string | No | — | Un id opaco per l'utente finale, fino a 512 caratteri. |
cache_control | object | No | — | Punto di interruzione della cache dei prompt a livello superiore. |
container, context_management, mcp_servers, diagnostics, service_tier, inference_geo, speed | — | No | — | Inoltrati così come inviati. |
Ragionamento e livello di effort
Claude Opus 5.5 utilizza sempre il ragionamento adattivo: il modello decide quanto pensare, e output_config.effort lo orienta. Un effort più elevato di solito significa più token di output, un'attesa più lunga e un costo maggiore. Con thinking.display impostato su summarized, la risposta include blocchi thinking che puoi mostrare; con omitted, vengono omessi. I token di ragionamento vengono fatturati come token di output.
Input multimediali
Le immagini e i PDF vanno nel content di un turno utente come blocchi image e document, con una fonte url o, come nell'API ufficiale, una fonte base64:
{"role": "user", "content": [
{"type": "image", "source": {"type": "url", "url": "https://example.com/chart.png"}},
{"type": "text", "text": "What does this chart show?"}
]}Sostituisci l'URL di esempio con un file pubblicamente raggiungibile del tuo.
Dimensioni di fatturazione
Vedi i prezzi attuali nella pagina del modello. Una richiesta viene fatturata in base ai token che utilizza:
- token di input,
- token di output, incluso il ragionamento,
- letture della cache dei prompt, e
- scritture della cache dei prompt, con tariffe separate per 5 minuti e 1 ora.
L'addebito viene prelevato dall'usage segnalato con la risposta completata. Una richiesta che fallisce non viene addebitata. I record di utilizzo del tuo account mostrano l'addebito esatto per ogni richiesta.
Output
Una richiesta non in streaming restituisce l'oggetto messaggio ufficiale:
{
"id": "msg_...",
"type": "message",
"role": "assistant",
"model": "claude-opus-5-5",
"content": [{"type": "text", "text": "..."}],
"stop_reason": "end_turn",
"usage": {"input_tokens": 18, "output_tokens": 4, "cache_read_input_tokens": 0, "cache_creation_input_tokens": 0}
}Con "stream": true la risposta è un flusso degli eventi ufficiali: message_start, content_block_start, content_block_delta, content_block_stop, message_delta e message_stop. Il message_delta finale riporta il conteggio dei token di output.
Formati compatibili con OpenAI
Lo stesso modello risponde ai formati OpenAI, quindi il codice OpenAI esistente ha bisogno solo di un nuovo URL di base e ID modello:
from openai import OpenAI
client = OpenAI(api_key="YOUR_SEEDROUTER_KEY", base_url="https://api.seedrouter.ai/v1")
chat = client.chat.completions.create(
model="claude-opus-5-5",
messages=[{"role": "user", "content": "Hello"}],
)
response = client.responses.create(model="claude-opus-5-5", input="Hello")Queste richieste vengono convertite al formato Messages, quindi un campo senza controparte Messages non ha effetto. Le loro risposte riportano i campi OpenAI ufficiali e possono includere pochi campi di utilizzo extra; leggi usage.total_tokens e i campi ufficiali.
Errori
Gli errori su /v1/messages utilizzano la forma Anthropic, {"type": "error", "error": {"type": "...", "message": "..."}}; gli altri formati usano {"error": {"code": ..., "message": "..."}}. Il code è un codice dal catalogo errori comune. Le richieste fallite non vengono addebitate.
Suggerimenti
- Inizia con l'effort predefinito e aumentalo solo per attività che necessitano di più ragionamento; le modifiche all'effort influenzano sia la qualità che il costo.
- Imposta
max_tokensabbastanza alto per il ragionamento e la risposta: è un unico budget per entrambi. - Posiziona il contesto lungo e riutilizzato per primo e contrassegnalo con
cache_controlin modo che le richieste successive lo leggano dalla cache al tasso inferiore.
