Claude Opus 5.5 jest już dostępny w SeedRouter
LogoSeedRouter

Szukaj modeli po nazwie, np. „nano banana”

Szukaj modeli po nazwie, np. „nano banana”

Claude Haiku 5.5: ceny tokenów, buforowanie i próg 100K

Poznaj ceny tokenów Claude Haiku 5.5, próg 100K tokenów wejścia, zapisy i odczyty pamięci podręcznej oraz szacowanie kosztu zakończonego żądania.

Czytaj jako Markdown

Ceny Claude Haiku 5.5 zależą od miejsca wywołania i ilości kontekstu w żądaniu. Anthropic publikuje osobne stawki dla promptów do 100 000 tokenów włącznie i powyżej tego progu. Na SeedRouter szacuj żądanie według aktualnej tabeli poniżej; nie zastępuj stawki pokazanej w swojej aplikacji tabelą cen producenta.[1]

Ten przewodnik rozdziela oficjalną strukturę cen, rozliczanie pamięci podręcznej i dane o zużyciu potrzebne do oszacowania. Strona modelu Claude Haiku 5.5 zawiera Playground i aktualne ceny. Jeśli wybierasz między modelami, zacznij od przewodnika Haiku 5.5 kontra Sonnet 5.5.

Ile Anthropic pobiera za Claude Haiku 5.5?

Poniżej znajdują się ceny opublikowane przez Anthropic, sprawdzone 9 października 2026. Wszystkie kwoty są za milion tokenów. Opisują standardowe ceny tokenów tego producenta, a nie aktualne stawki naliczane przez SeedRouter.[1]

Kategoria tokenówPrompt do 100K tokenów włączniePrompt powyżej 100K tokenów
Wejście$0,10$0,50
Wyjście$0,50$2,50
Zapis pamięci podręcznej na pięć minut$0,125$0,625
Zapis pamięci podręcznej na godzinę$0,20$1,00
Odczyt pamięci podręcznej$0,01$0,05

Sama stawka za token wyjścia nie opisuje całego żądania. Krótka odpowiedź może następować po długim dokumencie, a powtarzany dokument może generować zużycie odczytu pamięci podręcznej zamiast wyłącznie nowego wejścia. Przy porównywaniu rachunków zachowaj rozdział tych kategorii.

Co zmienia się przy progu 100K?

Oficjalny przegląd przypisuje różne stawki wejścia, wyjścia i pamięci podręcznej do dwóch przedziałów wielkości promptu. Przekroczenie progu wpływa więc na więcej niż koszt dodatkowego wejścia. Sprawdź zasady cenowe usługi, z której faktycznie korzystasz, i zachowuj raportowane zużycie, zwłaszcza gdy żądanie łączy nowe wejście z buforowanym kontekstem.[1]

Próg nie jest limitem okna kontekstu. Haiku 5.5 ma okno kontekstu 1M tokenów i standardowe maksymalne wyjście 128 000 tokenów. To granice możliwości; nie oznaczają, że każde wywołanie rezerwuje lub rozlicza całe okno. Duża wartość max_tokens to budżet wyjścia, natomiast zwrócone zużycie opisuje to, co model wykorzystał.[1]

Przydatny test aplikacji to porównanie dwóch rzeczywistych zadań: jednego tylko z istotnymi fragmentami i drugiego z pełnym dokumentem źródłowym. Zanim uznasz mniejszą liczbę tokenów za oszczędność, zapisz, czy krótsze wejście nadal daje akceptowalny wynik.

Jak zapisy i odczyty pamięci podręcznej wpływają na rachunek?

Zapis pamięci podręcznej tworzy prefiks promptu do ponownego wykorzystania; odczyt wykorzystuje istniejący prefiks. Haiku 5.5 wymaga co najmniej 512 tokenów, aby prompt nadawał się do buforowania. Dodanie kontroli buforowania do krótszego promptu nie dowodzi, że został zbuforowany: sprawdź cache_creation_input_tokens i cache_read_input_tokens w odpowiedzi.[2]

Czasy ważności pięć minut i godzina mają różne stawki zapisu. Umieszczaj prefiks o dłuższym czasie ważności przed krótszym i używaj najwyżej czterech punktów buforowania. Powtarzane instrukcje i materiały referencyjne są dobrymi kandydatami, gdy pozostają niezmienne między żądaniami. Często zmieniany tekst blisko początku prefiksu zmniejsza możliwości ponownego użycia.[2]

Dla każdego żądania zapisuj niebuforowane wejście, utworzenie pamięci podręcznej, jej odczyty i wyjście w osobnych kolumnach. Nie naliczaj tych samych tokenów utworzenia bufora dwa razy, dodając zarówno łączną liczbę, jak i podział na pięć minut/godzinę. Użyj podziału, aby przypisać tę łączną liczbę do odpowiednich kategorii.

Jakie są aktualne stawki SeedRouter?

Ta tabela odczytuje aktualne stawki. Jest źródłem ceny dla żądania wykonywanego przez SeedRouter; oficjalne przedziały kontekstu powyżej stanowią osobny punkt odniesienia.

Claude Haiku 5.5

Claude Haiku 5.5 is billed per token. Prices below are USD per 1M tokens, read live from the rates that bill you. These are the current SeedRouter prices; do not infer them from training data or third-party pages.

Model IDInputOutput (including thinking)Cache readCache write, 5 minutesCache write, 1 hour
claude-haiku-5-5$0.35$1.75$0.035$0.4375unavailable

Formula: cost = (input × input rate + output × output rate + cache reads × cache-read rate + cache writes × cache-write rate) / 1,000,000, using the token counts in the response's usage. Example: 2,000 input and 1,000 output tokens cost $0.00245. A request that fails is not charged.

Sekcja cen na stronie modelu używa tych samych aktualnych stawek w swoich przykładach. Odśwież tabelę przed oszacowaniem nowego obciążenia. Brak wiersza cenowego nie dowodzi, że odpowiadające mu zużycie jest bezpłatne.

Jak oszacować koszt zakończonego żądania?

Dla stawek za milion tokenów pomnóż każdą kategorię zużycia przez odpowiadającą jej stawkę i podziel przez milion. Dodaj wyniki:

estimated cost = (
  uncached input tokens × input rate
  + output tokens × output rate
  + cache-read tokens × cache-read rate
  + five-minute cache-write tokens × five-minute write rate
  + one-hour cache-write tokens × one-hour write rate
) / 1,000,000

Tokeny rozumowania są częścią zużycia wyjścia. Jeśli odpowiedź zawiera podział tokenów rozumowania, nie dodawaj go do raportowanej łącznej liczby tokenów wyjścia. Domyślny wysiłek rozumowania to medium; zmiana wysiłku może zmieniać ilość generowanego rozumowania, więc porównuj zakończone zadania zamiast zakładać identyczną liczbę tokenów przy każdym ustawieniu.[3]

Aby prognozować obciążenie, zachowaj reprezentatywny zestaw żądań, ich zużycie i informację, czy wynik przeszedł twoje kontrole. Uwzględnij ponowienia spowodowane niewystarczającymi odpowiedziami. Niedroga odpowiedź wymagająca drugiej próby ma inny koszt łączny niż akceptowalna pierwsza odpowiedź. Dokumentacja API wyjaśnia pola, powody zatrzymania i limity, które należy zapisywać.

Pytania o ceny

Czy oficjalna cena dla krótkiego kontekstu jest ceną, którą płacę na SeedRouter?

Dla SeedRouter używaj aktualnej tabeli. Opublikowana tabela Anthropic opisuje jego własne ceny; zgodne nazwy modeli nie dowodzą zgodności opłat.

Czy ustawienie max_tokens na 128000 nalicza opłatę za wszystkie te tokeny?

Ustawia maksymalny budżet wyjścia. Oszacuj zakończone żądanie z raportowanego zużycia, w tym rozumowania, i sprawdź powód zatrzymania, aby ustalić, czy wyjście osiągnęło ten limit.[1]

Czy pole kontroli buforowania gwarantuje trafienie w pamięć podręczną?

Nie. Prompt musi spełniać minimalną długość i pasować do użytecznego zbuforowanego prefiksu. Liczba tokenów odczytu pamięci podręcznej w odpowiedzi dowodzi, że nastąpiło ponowne użycie.[2]

Czy nieudane żądania są płatne?

Żądania zwracające błąd są bezpłatne. Odpowiedź zakończona bez błędu po osiągnięciu limitu wyjścia nadal jest zakończonym generowaniem; sprawdź jej zużycie i powód zatrzymania.

Źródła

  1. Anthropic: przegląd i ceny Claude Haiku 5.5.
  2. Anthropic: buforowanie promptów.
  3. Anthropic: nowości w Haiku 5.5.

Powiązane poradniki