Claude Opus 5.5 è disponibile su SeedRouter
SeedRouter Docs

Claude Fable 5

Chiama Claude Fable 5 con l'API Messages ufficiale di Anthropic, o i formati Chat Completions e Responses di OpenAI: ragionamento adattivo, finestra di contesto di 1M token e fino a 128K token di output.

View Markdown

Claude Fable 5 è il modello Fable precedente di Anthropic, ancora disponibile insieme a Claude Fable 5.1. Invia la richiesta Messages ufficiale di Anthropic a SeedRouter: cambia l'URL di base e la chiave API, mantieni il corpo. Lo stesso modello risponde anche ai formati Chat Completions e Responses di OpenAI.

ID modello

ID modelloFinestra di contestoOutput massimoRagionamentoLivello di effort predefinito
claude-fable-51M token128K tokenAdattivo, sempre attivohigh

Consulta la pagina del modello per i prezzi attuali.

Esempio rapido

curl https://api.seedrouter.ai/v1/messages \
  -H "x-api-key: $SEEDROUTER_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "claude-fable-5",
    "max_tokens": 1024,
    "messages": [{"role": "user", "content": "Summarize the trade-offs of event sourcing in three bullet points."}]
  }'

Endpoint

FormatoMetodo e percorsoAutenticazione
Anthropic MessagesPOST https://api.seedrouter.ai/v1/messagesx-api-key: <key> oppure Authorization: Bearer <key>, più anthropic-version
OpenAI Chat CompletionsPOST https://api.seedrouter.ai/v1/chat/completionsAuthorization: Bearer <key>
OpenAI ResponsesPOST https://api.seedrouter.ai/v1/responsesAuthorization: Bearer <key>

L'endpoint Messages inoltra il corpo della richiesta così come inviato, inclusi i campi facoltativi, e restituisce la risposta ufficiale. Un'intestazione anthropic-beta viene inoltrata anche. Mantieni la chiave API nel codice lato server.

Parametri

NomeTipoObbligatorioPredefinitoNote
modelstringSì—claude-fable-5.
max_tokensintegerSì—0–128000. Include i token spesi sul ragionamento. 0 preriscalda solo la cache dei prompt.
messagesobject[]Sì—Turni alternati user e assistant; content è una stringa o un array di blocchi di contenuto. L'ultimo turno deve essere user. Eccezione: per proseguire una risposta pause_turn, reinvia il suo contenuto invariato come ultimo messaggio assistant.
systemstring o object[]No—Prompt di sistema.
thinkingobjectNo{"type": "adaptive"}Il ragionamento è adattivo e sempre attivo. display: omitted (predefinito) o summarized.
output_config.effortenumNohighlow, medium, high, xhigh, max. Orienta quanto il modello pensa.
output_config.formatobjectNo—Uno schema JSON per l'output strutturato.
stop_sequencesstring[]No—Ferma quando una di queste stringhe viene generata.
streambooleanNofalseTrasmetti la risposta come server-sent events.
temperaturenumberNo—È accettato solo 1 (il valore predefinito), per retrocompatibilità; qualsiasi altro valore restituisce un errore 400. Omettilo.
top_pnumberNo—Sono accettati solo valori da 0.99 a 1, per retrocompatibilità; qualsiasi altro valore restituisce un errore 400. Omettilo.
top_kintegerNo—Non accettato: qualsiasi valore restituisce un errore 400. Omettilo.
toolsobject[]No—Definizioni degli strumenti.
tool_choiceobjectNo—auto, any, tool o none.
metadata.user_idstringNo—Un id opaco per l'utente finale, fino a 512 caratteri.
cache_controlobjectNo—Punto di interruzione della cache dei prompt a livello superiore.
container, context_management, mcp_servers, diagnostics, service_tier, inference_geo, speed—No—Inoltrati così come inviati.

Ragionamento e livello di effort

Claude Fable 5 utilizza sempre il ragionamento adattivo: il modello decide quanto pensare, e output_config.effort lo orienta. Un effort più elevato di solito significa più token di output, un'attesa più lunga e un costo maggiore. Con thinking.display impostato su summarized, la risposta include blocchi thinking che puoi mostrare; con omitted, Claude Fable 5 restituisce comunque un blocco thinking, ma il suo testo è vuoto. Leggi la risposta dai blocchi text, non dal primo blocco. I token di ragionamento vengono fatturati come token di output.

Input multimediali

Le immagini e i PDF vanno nel content di un turno utente come blocchi image e document, con una fonte url o, come nell'API ufficiale, una fonte base64:

{"role": "user", "content": [
  {"type": "image", "source": {"type": "url", "url": "https://example.com/chart.png"}},
  {"type": "text", "text": "What does this chart show?"}
]}

Sostituisci l'URL di esempio con un file pubblicamente raggiungibile del tuo.

Dimensioni di fatturazione

Vedi i prezzi attuali nella pagina del modello. Una richiesta viene fatturata in base ai token che utilizza:

  • token di input,
  • token di output, incluso il ragionamento,
  • letture della cache dei prompt, e
  • scritture della cache dei prompt, con tariffe separate per 5 minuti e 1 ora.

L'addebito viene prelevato dall'usage segnalato con la risposta completata. Una richiesta che fallisce non viene addebitata. I record di utilizzo del tuo account mostrano l'addebito esatto per ogni richiesta.

Output

Una richiesta non in streaming restituisce l'oggetto messaggio ufficiale:

{
  "id": "msg_...",
  "type": "message",
  "role": "assistant",
  "model": "claude-fable-5",
  "content": [{"type": "text", "text": "..."}],
  "stop_reason": "end_turn",
  "usage": {"input_tokens": 18, "output_tokens": 4, "cache_read_input_tokens": 0, "cache_creation_input_tokens": 0}
}

Con "stream": true la risposta è un flusso degli eventi ufficiali: message_start, content_block_start, content_block_delta, content_block_stop, message_delta e message_stop. Il message_delta finale riporta il conteggio dei token di output.

Formati compatibili con OpenAI

Lo stesso modello risponde ai formati OpenAI, quindi il codice OpenAI esistente ha bisogno solo di un nuovo URL di base e ID modello:

from openai import OpenAI

client = OpenAI(api_key="YOUR_SEEDROUTER_KEY", base_url="https://api.seedrouter.ai/v1")

chat = client.chat.completions.create(
    model="claude-fable-5",
    messages=[{"role": "user", "content": "Hello"}],
)
response = client.responses.create(model="claude-fable-5", input="Hello")

Queste richieste vengono convertite al formato Messages, quindi un campo senza controparte Messages non ha effetto. Le loro risposte riportano i campi OpenAI ufficiali e possono includere pochi campi di utilizzo extra; leggi usage.total_tokens e i campi ufficiali.

Errori

Gli errori su /v1/messages utilizzano la forma Anthropic, {"type": "error", "error": {"type": "...", "message": "..."}}; gli altri formati usano {"error": {"code": ..., "message": "..."}}. Il code è un codice dal catalogo errori comune. Le richieste fallite non vengono addebitate.

Suggerimenti

  • Inizia con l'effort predefinito e aumentalo solo per attività che necessitano di più ragionamento; le modifiche all'effort influenzano sia la qualità che il costo.
  • Imposta max_tokens abbastanza alto per il ragionamento e la risposta: è un unico budget per entrambi.
  • Posiziona il contesto lungo e riutilizzato per primo e contrassegnalo con cache_control in modo che le richieste successive lo leggano dalla cache al tasso inferiore.

Correlati