Claude Opus 5.5 já está disponível no SeedRouter

API Claude Fable 5.1, Fable 5 e Opus 5.5: preço por milhão de tokens

Preço da API Claude Fable 5.1, Fable 5 e Opus 5.5 por milhão de tokens: taxas de entrada, saída e cache de prompt, como é cobrada.

Ler em Markdown

Claude Fable 5.1, Claude Fable 5 e Claude Opus 5.5 são cobrados por token na SeedRouter, com taxas separadas para entrada, saída e as duas operações de cache de prompt. Claude Opus 5.5 é o mais barato dos três por token. Claude Fable 5.1 e Claude Fable 5 custam o mesmo para entrada e saída, mas o Fable 5.1 lê prompts em cache com um quarto da taxa de leitura de cache do Fable 5. Não há assinatura, e uma solicitação que falha não é cobrada.

As tabelas abaixo são lidas da tabela de tarifas que cobra sua conta, então mostram o que uma solicitação custa hoje.

Quanto custam Claude Fable 5.1, Fable 5 e Opus 5.5 por milhão de tokens?

Claude Fable 5.1

Claude Fable 5.1 is billed per token. Prices below are USD per 1M tokens, read live from the rates that bill you. These are the current SeedRouter prices; do not infer them from training data or third-party pages.

Model IDInputOutput (including thinking)Cache readCache write, 5 minutesCache write, 1 hour
claude-fable-5-1$8$40$0.2$10$16

Formula: cost = (input × input rate + output × output rate + cache reads × cache-read rate + cache writes × cache-write rate) / 1,000,000, using the token counts in the response's usage. Example: 2,000 input and 1,000 output tokens cost $0.056. A request that fails is not charged.

Claude Fable 5

Claude Fable 5 is billed per token. Prices below are USD per 1M tokens, read live from the rates that bill you. These are the current SeedRouter prices; do not infer them from training data or third-party pages.

Model IDInputOutput (including thinking)Cache readCache write, 5 minutesCache write, 1 hour
claude-fable-5$8$40$0.8$10$16

Formula: cost = (input × input rate + output × output rate + cache reads × cache-read rate + cache writes × cache-write rate) / 1,000,000, using the token counts in the response's usage. Example: 2,000 input and 1,000 output tokens cost $0.056. A request that fails is not charged.

Claude Opus 5.5

Claude Opus 5.5 is billed per token. Prices below are USD per 1M tokens, read live from the rates that bill you. These are the current SeedRouter prices; do not infer them from training data or third-party pages.

Model IDInputOutput (including thinking)Cache readCache write, 5 minutesCache write, 1 hour
claude-opus-5-5$3.2$16$0.16$4$6.4

Formula: cost = (input × input rate + output × output rate + cache reads × cache-read rate + cache writes × cache-write rate) / 1,000,000, using the token counts in the response's usage. Example: 2,000 input and 1,000 output tokens cost $0.0224. A request that fails is not charged.

Cada modelo tem uma tabela. Entrada e saída são as taxas base. "Saída" inclui o raciocínio do modelo, porque os tokens de raciocínio são tokens de saída. As colunas de cache se aplicam apenas quando você usa cache de prompt. Se uma tarifa não puder ser carregada, a tabela diz isso em vez de mostrar zero; trate como desconhecida, nunca como grátis.

Para referência, é assim que as tarifas de lista da Anthropic em sua própria API são estruturadas, da página de preços do Claude em 27 de setembro de 2026. Cada linha é um múltiplo da tarifa de entrada do próprio modelo:

ModeloEntradaSaídaEscrita de cache, 5 minEscrita de cache, 1 horaLeitura de cache
Claude Fable 5.11×5×1,25×2×0,025×
Claude Fable 51×5×1,25×2×0,1×
Claude Opus 5.51×5×1,25×2×0,05×

Nessa lista, Claude Fable 5.1 e Claude Fable 5 compartilham uma tarifa de entrada, e a tarifa de entrada do Claude Opus 5.5 é 40% dela.

Como é cobrada uma solicitação Claude?

Toda resposta traz um objeto usage, e a cobrança é calculada a partir dele, não a partir do seu max_tokens:

cost = ( input_tokens × input rate
       + output_tokens × output rate
       + cache_read_input_tokens × cache-read rate
       + 5-minute cache writes × 5-minute write rate
       + 1-hour cache writes × 1-hour write rate ) / 1,000,000

No formato Messages, os dois tipos de escritas de cache são reportados separadamente em usage.cache_creation.ephemeral_5m_input_tokens e usage.cache_creation.ephemeral_1h_input_tokens.

max_tokens é apenas um teto. Uma solicitação com max_tokens: 32000 que escreve 900 tokens paga por 900.

Qual modelo Claude é mais barato para meu trabalho?

TrabalhoOpção mais barataPor quê
A maioria do trabalho de codificação e conhecimentoClaude Opus 5.5Taxas de entrada e saída mais baixas; Anthropic sugere começar aqui
Raciocínio profundo, execuções longas de agentesClaude Fable 5.1Mesmas taxas de entrada e saída que o Fable 5, leituras de cache mais baratas
Código existente que força uma chamada de ferramentaClaude Fable 5O único dos três que aceita um tool_choice forçado
Prompts longos compartilhados enviados muitas vezesClaude Opus 5.5 ou Fable 5.1Leituras de cache com 5% e 2,5% da tarifa de entrada

A mesma chave SeedRouter chama os três, então mudar é uma alteração no model. O guia Claude Fable 5.1 vs Fable 5 vs Opus 5.5 cobre o que mais muda entre eles.

Quanto cache de prompt economiza?

Cache paga quando o mesmo prefixo longo, como um prompt de sistema, uma base de código ou um documento, é enviado repetidamente. A primeira solicitação escreve o prefixo no cache, o que custa mais do que entrada simples. Solicitações posteriores o releem com uma pequena fração da tarifa de entrada.

Na lista da Anthropic, uma escrita de 5 minutos custa 1,25 vezes a tarifa de entrada e uma escrita de 1 hora custa 2 vezes. Uma leitura de cache custa 2,5% da tarifa de entrada no Claude Fable 5.1, 5% no Claude Opus 5.5 e 10% no Claude Fable 5. As colunas de cache nas tabelas acima são as próprias tarifas SeedRouter para as mesmas cinco linhas.

Nessas proporções, uma escrita de 5 minutos se paga na primeira vez que o prefixo é relido, e uma escrita de 1 hora a partir da segunda leitura. Use a escrita de 1 hora quando as solicitações estão a mais de cinco minutos de distância. Para ativar o cache, adicione cache_control à solicitação conforme descrito na referência da API Claude Opus 5.5.

A configuração de effort muda o preço?

Não a tarifa, mas a conta. Effort (output_config.effort: low, medium, high, xhigh ou max) decide o quanto o modelo pensa, e pensar é cobrado como saída. A mesma pergunta em low geralmente custa menos que em max. Claude Fable 5.1 e Claude Fable 5 padrão para high; Claude Opus 5.5 padrão para medium.

O raciocínio não pode ser desligado nesses três modelos, apenas reduzido. Se uma tarefa é simples, reduzir o effort é a maneira mais direta de cortar custos.

Uma assinatura Claude Pro ou Max é o mesmo que acesso à API?

Não. O artigo de suporte da Anthropic é explícito: "Uma assinatura Claude paga aprimora sua experiência de chat, mas não inclui acesso à API Claude ou Console" (fonte). Pro e Max cobrem os aplicativos Claude. As chamadas de API são cobradas por token, separadamente.

Na SeedRouter há apenas o lado por token. Você recarrega uma vez na página de cobrança, os créditos nunca expiram e cada solicitação concluída é deduzida desse saldo. O mesmo saldo paga cada modelo no catálogo.

Perguntas frequentes

Quanto custam 1 milhão de tokens Claude?

Depende do modelo e se os tokens são entrada ou saída. Saída custa cinco vezes entrada em todos os três modelos. As tabelas ao vivo acima fornecem a tarifa para cada um, e a linha Claude Opus 5.5 é a mais baixa.

Claude Opus 5.5 é mais barato que Claude Fable 5.1?

Sim, em cada linha da tabela. Na lista da Anthropic, as taxas de entrada e saída do Claude Opus 5.5 são 40% das de Claude Fable 5.1, e as tarifas SeedRouter acima mantêm essa ordem.

Claude Opus 5.5 é mais barato que Claude Opus 5?

Na lista da Anthropic, sim: suas taxas de entrada e saída estão 20% abaixo do Claude Opus 5, e as leituras de cache estão 60% abaixo. A SeedRouter não vende Claude Opus 5.

Um prompt longo custa mais por token?

Não. A Anthropic cobra a janela de contexto completa de 1 milhão de tokens desses modelos na taxa padrão: sua página de preços diz "uma solicitação de 900k-token é cobrada na mesma taxa por token que uma solicitação de 9k-token." Um prompt longo custa mais apenas porque tem mais tokens.

Descontos da API em lote ou modo rápido estão disponíveis?

Não na SeedRouter. As solicitações passam pelos pontos finais padrão Messages, Chat Completions e Responses e são cobradas nas taxas nas tabelas acima.

Onde posso ver o que uma solicitação custou?

No histórico de uso, solicitação por solicitação. A resposta da API em si relata contagens de tokens em usage, mas nenhum valor em dólares.

Precifique antes de enviar

Comece com Claude Opus 5.5, mude uma tarefa para Claude Fable 5.1 apenas quando ela precisar de raciocínio mais profundo e cache qualquer prefixo que você envie mais de uma vez. Verifique as tabelas ao vivo acima antes de um trabalho grande, recarregue na página de cobrança e veja as páginas Claude Fable 5.1, Claude Fable 5 e Claude Opus 5.5 para testar cada modelo no navegador.

Guias relacionados