Claude Opus 5.5 ist auf SeedRouter verfügbar
SeedRouter Docs

Claude Opus 5.5

Rufen Sie Claude Opus 5.5 mit der offiziellen Anthropic-API für Messages auf, oder verwenden Sie die OpenAI-Formate Chat Completions und Responses: adaptives Denken, ein Kontextfenster mit 1M Token und bis zu 128K Token Ausgabe.

View Markdown

Claude Opus 5.5 ist das Modell von Anthropic für langfristige agentische Code-Entwicklung und Wissensarbeit. Sende die offizielle Anthropic-Messages-Anfrage an SeedRouter: änder die Basis-URL und den API-Schlüssel, behalte den Body bei. Dasselbe Modell beantwortet auch die OpenAI-Formate Chat Completions und Responses.

Modell-ID

Modell-IDKontextfensterMaximale AusgabeDenkenStandard-Denktiefe
claude-opus-5-51M Token128K TokenAdaptiv, immer anmedium

Die aktuellen Preise findest du auf der Modellseite.

Kurzbeispiel

curl https://api.seedrouter.ai/v1/messages \
  -H "x-api-key: $SEEDROUTER_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "claude-opus-5-5",
    "max_tokens": 1024,
    "messages": [{"role": "user", "content": "Summarize the trade-offs of event sourcing in three bullet points."}]
  }'

Endpunkte

FormatMethode und PfadAuthentifizierung
Anthropic MessagesPOST https://api.seedrouter.ai/v1/messagesx-api-key: <key> oder Authorization: Bearer <key>, plus anthropic-version
OpenAI Chat CompletionsPOST https://api.seedrouter.ai/v1/chat/completionsAuthorization: Bearer <key>
OpenAI ResponsesPOST https://api.seedrouter.ai/v1/responsesAuthorization: Bearer <key>

Der Messages-Endpunkt leitet deinen Request-Body unverändert weiter, einschließlich optionaler Felder, und gibt die offizielle Antwort zurück. Ein anthropic-beta-Header wird ebenfalls durchgeleitet. Bewahre den API-Schlüssel in serverseitigem Code auf.

Parameter

NameTypErforderlichStandardHinweise
modelstringJa—claude-opus-5-5.
max_tokensintegerJa—0–128000. Umfasst die Token, die für Denken ausgegeben werden. 0 wärmt nur den Prompt-Cache vor.
messagesobject[]Ja—Abwechselnde user- und assistant-Sprecherwechsel; content ist ein String oder ein Array von Content-Blöcken. Der letzte Sprecherwechsel muss user sein. Ausnahme: Um eine pause_turn-Antwort fortzusetzen, sende ihren Inhalt unverändert als letzte assistant-Nachricht zurück.
systemstring oder object[]Nein—System-Prompt.
thinkingobjectNein{"type": "adaptive"}Denken ist adaptiv und immer an. display: omitted (Standard) oder summarized.
output_config.effortenumNeinmediumlow, medium, high, xhigh, max. Steuert die Denktiefe des Modells.
output_config.formatobjectNein—Ein JSON-Schema für strukturierte Ausgabe.
stop_sequencesstring[]Nein—Stoppt, wenn eine dieser Zeichenketten generiert wird.
streambooleanNeinfalseStreame die Antwort als Server-Sent Events.
temperaturenumberNein—Aus Gründen der Abwärtskompatibilität wird nur 1 (der Standardwert) akzeptiert; jeder andere Wert gibt einen 400-Fehler zurück. Lass diesen Parameter weg.
top_pnumberNein—Aus Gründen der Abwärtskompatibilität werden nur Werte von 0.99 bis 1 akzeptiert; jeder andere Wert gibt einen 400-Fehler zurück. Lass diesen Parameter weg.
top_kintegerNein—Nicht akzeptiert: jeder Wert gibt einen 400-Fehler zurück. Lass diesen Parameter weg.
toolsobject[]Nein—Tool-Definitionen.
tool_choiceobjectNein—auto oder none; das Erzwingen eines Tools (any oder tool) wird von diesem Modell nicht unterstützt.
metadata.user_idstringNein—Eine durchsichtige ID für deinen Endnutzer, bis zu 512 Zeichen.
cache_controlobjectNein—Breakpoint für Prompt-Cache auf oberster Ebene.
container, context_management, mcp_servers, diagnostics, service_tier, inference_geo, speed—Nein—Werden wie erhalten durchgeleitet.

Denken und Denktiefe

Claude Opus 5.5 verwendet immer adaptives Denken: Das Modell entscheidet, wie viel es denkt, und output_config.effort steuert das. Höhere Denktiefe bedeutet normalerweise mehr Output-Token, längere Wartezeit und höhere Kosten. Wenn thinking.display auf summarized gesetzt ist, enthält die Antwort thinking-Blöcke, die du anzeigen kannst; bei omitted werden sie weggelassen. Denk-Token werden als Output-Token berechnet.

Medieneingaben

Bilder und PDFs gehen in einen Sprecherwechsel des Benutzers als image- und document-Blöcke mit einer url-Quelle oder, wie in der offiziellen API, einer base64-Quelle:

{"role": "user", "content": [
  {"type": "image", "source": {"type": "url", "url": "https://example.com/chart.png"}},
  {"type": "text", "text": "What does this chart show?"}
]}

Ersetze die Beispiel-URL durch eine öffentlich erreichbare Datei deiner eigenen.

Abrechnungsdimensionen

Siehe die aktuellen Tarife auf der Modellseite. Eine Anfrage wird nach den Token berechnet, die sie verbraucht:

  • Input-Token,
  • Output-Token, einschließlich Denken,
  • Prompt-Cache-Lesevorgänge, und
  • Prompt-Cache-Schreibvorgänge mit separaten 5-Minuten- und 1-Stunden-Tarifen.

Die Gebühr wird von der usage entnommen, die mit der fertigen Antwort gemeldet wird. Eine Anfrage, die fehlschlägt, wird nicht berechnet. Die Nutzungsdatensätze deines Kontos zeigen die genaue Gebühr für jede Anfrage.

Ausgabe

Eine Non-Streaming-Anfrage gibt das offizielle Message-Objekt zurück:

{
  "id": "msg_...",
  "type": "message",
  "role": "assistant",
  "model": "claude-opus-5-5",
  "content": [{"type": "text", "text": "..."}],
  "stop_reason": "end_turn",
  "usage": {"input_tokens": 18, "output_tokens": 4, "cache_read_input_tokens": 0, "cache_creation_input_tokens": 0}
}

Mit "stream": true ist die Antwort ein Stream der offiziellen Events: message_start, content_block_start, content_block_delta, content_block_stop, message_delta und message_stop. Das letzte message_delta enthält die Anzahl der Output-Token.

OpenAI-kompatible Formate

Dasselbe Modell beantwortet die OpenAI-Formate, sodass vorhandener OpenAI-Code nur eine neue Basis-URL und Modell-ID benötigt:

from openai import OpenAI

client = OpenAI(api_key="YOUR_SEEDROUTER_KEY", base_url="https://api.seedrouter.ai/v1")

chat = client.chat.completions.create(
    model="claude-opus-5-5",
    messages=[{"role": "user", "content": "Hello"}],
)
response = client.responses.create(model="claude-opus-5-5", input="Hello")

Diese Anfragen werden in das Messages-Format konvertiert, sodass ein Feld ohne Messages-Äquivalent keine Auswirkung hat. Ihre Antworten enthalten die offiziellen OpenAI-Felder und können ein paar zusätzliche Nutzungsfelder enthalten; lies usage.total_tokens und die offiziellen Felder.

Fehler

Fehler auf /v1/messages verwenden die Anthropic-Form, {"type": "error", "error": {"type": "...", "message": "..."}}; die anderen Formate verwenden {"error": {"code": ..., "message": "..."}}. Der code ist ein Code aus dem gemeinsamen Fehlerkatalog. Fehlgeschlagene Anfragen werden nicht berechnet.

Tipps

  • Beginne mit der Standard-Denktiefe und erhöhe sie nur für Aufgaben, die mehr Denken benötigen; Denktiefe ändert sowohl Qualität als auch Kosten.
  • Setze max_tokens hoch genug für Denken und Antwort: es ist ein Budget für beide.
  • Platziere langen, wiederverwendeten Kontext zuerst und markiere ihn mit cache_control, damit spätere Anfragen ihn aus dem Cache mit niedrigerem Tarif lesen.

Verwandt