Claude Fable 5, Fable 5.1 i Opus 5.5 API: cena za milion tokenów
Cena Claude API za milion tokenów: stawki wejścia, wyjścia, cache promptów i jak są rozliczane żądania w SeedRouter.
Czytaj jako MarkdownClaude Fable 5.1, Claude Fable 5 i Claude Opus 5.5 są rozliczane za token w SeedRouter, z oddzielnymi stawkami dla wejścia, wyjścia i dwóch operacji cache promptów. Claude Opus 5.5 jest najtańszy z trzech za token. Claude Fable 5.1 i Claude Fable 5 mają tę samą cenę za wejście i wyjście, ale Fable 5.1 odczytuje cache promptów za ćwierć stawki Fable 5. Nie ma subskrypcji, a żądanie, które się nie powiedzie, nie jest rozliczane.
Poniższe tabele są odczytywane z tabeli stawek, która rozlicza twoje konto, więc pokazują, ile kosztuje żądanie dzisiaj.
Ile kosztuje Claude Fable 5.1, Fable 5 i Opus 5.5 za milion tokenów?
Claude Fable 5.1
Current rates are temporarily unavailable. No price estimate is provided; unavailable rates must not be interpreted as free usage.
Claude Fable 5
Current rates are temporarily unavailable. No price estimate is provided; unavailable rates must not be interpreted as free usage.
Claude Opus 5.5
Current rates are temporarily unavailable. No price estimate is provided; unavailable rates must not be interpreted as free usage.
Każdy model ma jedną tabelę. Wejście i wyjście to stawki bazowe. "Wyjście" obejmuje rozumowanie modelu, ponieważ tokeny rozumowania to tokeny wyjścia. Kolumny cache dotyczą tylko wtedy, gdy używasz cache promptów. Jeśli nie da się załadować stawki, tabela to zaznacza zamiast pokazywać zero; traktuj ją jako nieznaną, nigdy jako darmową.
Dla odniesienia, tak Anthropic strukturuje swoją stawkę na własnym API, z strony cennika Claude z 27 września 2026 r. Każdy wiersz to wielokrotność stawki wejścia tego modelu:
| Model | Wejście | Wyjście | Cache write, 5 min | Cache write, 1 godzina | Cache read |
|---|---|---|---|---|---|
| Claude Fable 5.1 | 1× | 5× | 1.25× | 2× | 0.025× |
| Claude Fable 5 | 1× | 5× | 1.25× | 2× | 0.1× |
| Claude Opus 5.5 | 1× | 5× | 1.25× | 2× | 0.05× |
Na tej liście Claude Fable 5.1 i Claude Fable 5 mają tę samą stawkę wejścia, a stawka wejścia Claude Opus 5.5 stanowi 40% jej wartości.
Jak jest rozliczane jedno żądanie Claude?
Każda odpowiedź zawiera obiekt usage, a opłata jest obliczana na jego podstawie, nie na podstawie max_tokens:
cost = ( input_tokens × input rate
+ output_tokens × output rate
+ cache_read_input_tokens × cache-read rate
+ 5-minute cache writes × 5-minute write rate
+ 1-hour cache writes × 1-hour write rate ) / 1,000,000W formacie Messages dwa rodzaje cache writes są raportowane oddzielnie w usage.cache_creation.ephemeral_5m_input_tokens i usage.cache_creation.ephemeral_1h_input_tokens.
max_tokens to tylko pułap. Żądanie z max_tokens: 32000, które zapisze 900 tokenów, płaci za 900.
Który model Claude jest najtańszy dla mojej pracy?
| Prace | Najtańszy wybór | Dlaczego |
|---|---|---|
| Większość pracy z kodem i koncepcyjnej | Claude Opus 5.5 | Najniższe stawki wejścia i wyjścia; Anthropic sugeruje rozpoczęcie od tego |
| Głębokie rozumowanie, długie uruchomienia agentów | Claude Fable 5.1 | Taka sama stawka wejścia i wyjścia jak Fable 5, tańszy cache read |
| Istniejący kod, który wymusza wywołanie narzędzia | Claude Fable 5 | Jedynym z trzech, który akceptuje wymuszony tool_choice |
| Długie wspólne prompty wysyłane wiele razy | Claude Opus 5.5 lub Fable 5.1 | Cache read na poziomie 5% i 2.5% stawki wejścia |
Jeden klucz SeedRouter wywoływa wszystkie trzy, więc przełączenie to zmiana model. Poradnik Claude Fable 5.1 czy Fable 5 czy Opus 5.5 obejmuje, co jeszcze się zmienia między nimi.
Ile oszczędzić dzięki cache promptów?
Cache opłaca się, gdy ten sam długi prefiks, taki jak prompt systemowy, baza kodu lub dokument, jest wysyłany raz po raz. Pierwsze żądanie zapisuje prefiks do cache, co kosztuje więcej niż zwykłe wejście. Późniejsze żądania odczytują go z powrotem za drobny ułamek stawki wejścia.
Na liście Anthropic cache write na 5 minut kosztuje 1.25 raza stawkę wejścia, a write na 1 godzinę kosztuje 2 razy. Cache read kosztuje 2.5% stawki wejścia na Claude Fable 5.1, 5% na Claude Opus 5.5 i 10% na Claude Fable 5. Kolumny cache w tabelach powyżej to stawki SeedRouter dla tych samych pięciu linii.
Przy tych współczynnikach cache write na 5 minut zwraca się za pierwszym razem, gdy prefiks jest ponownie odczytywany, a write na 1 godzinę od drugiego odczytu. Używaj write na 1 godzinę, gdy żądania są bardziej niż pięć minut od siebie. Aby włączyć cache, dodaj cache_control do żądania, jak opisano w dokumentacji API Claude Opus 5.5.
Czy ustawienie effort zmienia cenę?
Nie stawkę, ale rachunek. Effort (output_config.effort: low, medium, high, xhigh lub max) decyduje, ile model się zastanawia, a rozumowanie jest rozliczane jako wyjście. To samo pytanie przy low zwykle kosztuje mniej niż przy max. Claude Fable 5.1 i Claude Fable 5 domyślnie mają high; Claude Opus 5.5 domyślnie ma medium.
Rozumowanie nie można wyłączyć na tych trzech modelach, tylko zmniejszyć. Jeśli zadanie jest proste, niższy effort to najbardziej bezpośredni sposób na obniżenie kosztów.
Czy subskrypcja Claude Pro lub Max to to samo, co dostęp do API?
Nie. Artykuł pomocy Anthropic jest wyraźny: "Płatna subskrypcja Claude ulepsza twoje doświadczenie w czacie, ale nie obejmuje dostępu do Claude API ani Console" (źródło). Pro i Max obejmują aplikacje Claude. Wywołania API są rozliczane za token, oddzielnie.
W SeedRouter jest tylko strona za token. Doładujesz raz na stronie rozliczeń, kredyty nigdy nie wygasają, a każde zakończone żądanie jest odejmowane od tego salda. To samo saldo opłaca każdy model w katalogu.
Najczęściej zadawane pytania
Ile kosztuje milion tokenów Claude?
To zależy od modelu i tego, czy tokeny są wejściem czy wyjściem. Wyjście kosztuje pięć razy tyle co wejście na wszystkich trzech modelach. Powyższe tabele na żywo dają stawkę dla każdego, a wiersz Claude Opus 5.5 jest najniższy.
Czy Claude Opus 5.5 jest tańszy niż Claude Fable 5.1?
Tak, w każdym wierszu tabeli. Na liście Anthropic stawki wejścia i wyjścia Claude Opus 5.5 stanowią 40% wartości Claude Fable 5.1, a stawki SeedRouter powyżej zachowują tę kolejność.
Czy Claude Opus 5.5 jest tańszy niż Claude Opus 5?
Na liście Anthropic, tak: jego stawki wejścia i wyjścia są o 20% poniżej Claude Opus 5, a cache read jest o 60% poniżej. SeedRouter nie sprzedaje Claude Opus 5.
Czy długi prompt kosztuje więcej za token?
Nie. Anthropic rozlicza pełne okno kontekstu 1M tokenów tych modeli po standardowej stawce: na stronie cennika napisane jest, że "żądanie z 900k tokenami jest rozliczane po tej samej stawce za token co żądanie z 9k tokenami." Długi prompt kosztuje więcej tylko dlatego, że ma więcej tokenów.
Czy dostępne są rabaty Batch API lub szybki tryb?
Nie w SeedRouter. Żądania przechodzą przez standardowe punkty końcowe Messages, Chat Completions i Responses i są rozliczane po stawkach w tabelach powyżej.
Gdzie mogę zobaczyć, ile kosztowało żądanie?
W historii użycia, żądanie po żądaniu. Sama odpowiedź API raportuje liczby tokenów w usage, ale bez kwoty w dolarach.
Wycen, zanim wyślesz
Zacznij od Claude Opus 5.5, przenieś zadanie do Claude Fable 5.1 tylko wtedy, gdy potrzebuje głębszego rozumowania, a cache każdy prefiks, który wysyłasz więcej niż raz. Sprawdź powyższe tabele na żywo przed dużą pracą, doładuj konto na stronie rozliczeń, a zobacz strony Claude Fable 5.1, Claude Fable 5 i Claude Opus 5.5, aby spróbować każdego modelu w przeglądarce.



