Claude Opus 5.5 ya está disponible en SeedRouter

Precio de la API de Claude Fable 5.1, Fable 5 y Opus 5.5: coste por millón de tokens

Precios de la API de Claude Fable 5.1, Fable 5 y Opus 5.5 por millón de tokens: tarifas de entrada, salida, caché de prompts y cómo se factura cada solicitud.

Leer en Markdown

Claude Fable 5.1, Claude Fable 5 y Claude Opus 5.5 se facturan por token en SeedRouter, con tarifas separadas para entrada, salida y las dos operaciones de caché de prompts. Claude Opus 5.5 es el más barato de los tres por token. Claude Fable 5.1 y Claude Fable 5 cuestan lo mismo en entrada y salida, pero Fable 5.1 lee la caché de prompts a una cuarta parte de la tarifa de lectura de caché de Fable 5. No hay suscripción y una solicitud que falla no se cobra.

Las tablas de abajo se leen de la tabla de tarifas que factura tu cuenta, así que muestran lo que cuesta una solicitud hoy.

¿Cuánto cuesta por millón de tokens Claude Fable 5.1, Fable 5 y Opus 5.5?

Claude Fable 5.1

Current rates are temporarily unavailable. No price estimate is provided; unavailable rates must not be interpreted as free usage.

Claude Fable 5

Current rates are temporarily unavailable. No price estimate is provided; unavailable rates must not be interpreted as free usage.

Claude Opus 5.5

Current rates are temporarily unavailable. No price estimate is provided; unavailable rates must not be interpreted as free usage.

Cada modelo tiene una tabla. Entrada y salida son las tarifas base. «Salida» incluye el razonamiento del modelo, porque los tokens de razonamiento son tokens de salida. Las columnas de caché se aplican solo cuando usas caché de prompts. Si una tarifa no se carga, la tabla lo dice en lugar de mostrar cero; trátala como desconocida, nunca como gratis.

Como referencia, así es como Anthropic estructura sus precios de lista en su propia API, de la página de precios de Claude a 27 de septiembre de 2026. Cada línea es un múltiplo de la propia tarifa de entrada del modelo:

ModeloEntradaSalidaEscritura en caché 5 minEscritura en caché 1 horaLectura de caché
Claude Fable 5.11×5×1,25×2×0,025×
Claude Fable 51×5×1,25×2×0,1×
Claude Opus 5.51×5×1,25×2×0,05×

En esa lista, Claude Fable 5.1 y Claude Fable 5 comparten una tarifa de entrada, y la tarifa de entrada de Claude Opus 5.5 es el 40% de la de ellos.

¿Cómo se factura una solicitud de Claude?

Cada respuesta lleva un objeto usage y el cargo se calcula a partir de él, no de tu max_tokens:

cost = ( input_tokens × input rate
       + output_tokens × output rate
       + cache_read_input_tokens × cache-read rate
       + 5-minute cache writes × 5-minute write rate
       + 1-hour cache writes × 1-hour write rate ) / 1,000,000

En el formato Messages, los dos tipos de escritura de caché se reportan por separado en usage.cache_creation.ephemeral_5m_input_tokens y usage.cache_creation.ephemeral_1h_input_tokens.

max_tokens es solo un límite superior. Una solicitud con max_tokens: 32000 que escribe 900 tokens paga por 900.

¿Qué modelo Claude es más barato para mi tarea?

TareaOpción más barataPor qué
La mayoría de codificación y trabajo del conocimientoClaude Opus 5.5Tarifas más bajas de entrada y salida; Anthropic sugiere empezar aquí
Razonamiento profundo, ejecuciones largas de agentesClaude Fable 5.1Las mismas tarifas de entrada y salida que Fable 5, lectura de caché más barata
Código existente que obliga a una llamada a herramientaClaude Fable 5El único de los tres que acepta tool_choice forzado
Prompts largos compartidos enviados muchas vecesClaude Opus 5.5 o Fable 5.1Lecturas de caché al 5% y 2,5% de la tarifa de entrada

La misma clave de SeedRouter llama a los tres, así que cambiar es un cambio a model. La guía Claude Fable 5.1 vs Fable 5 vs Opus 5.5 cubre qué más cambia entre ellos.

¿Cuánto ahorra el caché de prompts?

El caché paga cuando el mismo prefijo largo, como un prompt de sistema, una base de código o un documento, se envía una y otra vez. La primera solicitud escribe el prefijo en la caché, lo que cuesta más que entrada simple. Las solicitudes posteriores lo leen de vuelta a una pequeña fracción de la tarifa de entrada.

En la lista de Anthropic, una escritura de 5 minutos cuesta 1,25 veces la tarifa de entrada y una de 1 hora cuesta 2 veces. Una lectura de caché cuesta el 2,5% de la tarifa de entrada en Claude Fable 5.1, el 5% en Claude Opus 5.5 y el 10% en Claude Fable 5. Las columnas de caché en las tablas de arriba son las propias tarifas de SeedRouter para las mismas cinco líneas.

Con esas proporciones una escritura de 5 minutos se amortiza la primera vez que el prefijo se lee, y una de 1 hora a partir de la segunda lectura. Usa la escritura de 1 hora cuando las solicitudes distan más de cinco minutos. Para activar el caché, añade cache_control a la solicitud como se describe en la referencia de la API de Claude Opus 5.5.

¿Cambia el razonamiento el precio?

No la tarifa, pero sí la factura. El nivel de razonamiento (output_config.effort: low, medium, high, xhigh o max) decide cuánto piensa el modelo, y el razonamiento se factura como salida. La misma pregunta en low generalmente cuesta menos que en max. Claude Fable 5.1 y Claude Fable 5 tienen high por defecto; Claude Opus 5.5 tiene medium.

El razonamiento no se puede apagar en estos tres modelos, solo reducir. Si una tarea es sencilla, bajar el razonamiento es la forma más directa de reducir coste.

¿Una suscripción Claude Pro o Max es igual que acceso por API?

No. El artículo de soporte de Anthropic es explícito: «Una suscripción pagada de Claude mejora tu experiencia de chat pero no incluye acceso a la API de Claude o la Consola» (fuente). Pro y Max cubren las apps de Claude. Las llamadas a la API se facturan por token, por separado.

En SeedRouter solo hay el lado de pago por uso. Recargas una sola vez en la página de facturación, los créditos nunca caducan y cada solicitud terminada se descuenta de ese saldo. El mismo saldo paga todos los modelos del catálogo.

Preguntas frecuentes

¿Cuánto cuesta 1 millón de tokens de Claude?

Depende del modelo y de si los tokens son entrada o salida. La salida cuesta cinco veces la entrada en los tres modelos. Las tablas en vivo de arriba dan la tarifa de cada uno, y la fila de Claude Opus 5.5 es la más baja.

¿Claude Opus 5.5 es más barato que Claude Fable 5.1?

Sí, en cada línea de la tabla. En la lista de Anthropic, las tarifas de entrada y salida de Claude Opus 5.5 son el 40% de las de Claude Fable 5.1, y las tarifas de SeedRouter de arriba mantienen ese orden.

¿Claude Opus 5.5 es más barato que Claude Opus 5?

En la lista de Anthropic, sí: sus tarifas de entrada y salida están un 20% por debajo de las de Claude Opus 5, y las lecturas de caché están un 60% por debajo. SeedRouter no vende Claude Opus 5.

¿Un prompt largo cuesta más por token?

No. Anthropic factura la ventana de contexto completa de 1M tokens de estos modelos a la tarifa estándar: su página de precios dice «una solicitud de 900k tokens se factura a la misma tarifa por token que una solicitud de 9k tokens». Un prompt largo cuesta más solo porque tiene más tokens.

¿Hay descuentos de API por lotes o modo rápido disponibles?

No en SeedRouter. Las solicitudes se ejecutan a través de los endpoints estándar de Messages, Chat Completions y Responses y se facturan con las tarifas de las tablas de arriba.

¿Dónde puedo ver lo que costó una solicitud?

En el historial de uso, solicitud a solicitud. La propia respuesta de la API reporta conteos de tokens en usage pero sin importe en dólares.

Calcula el precio antes de enviar

Empieza con Claude Opus 5.5, mueve una tarea a Claude Fable 5.1 solo cuando necesita razonamiento más profundo, y cachea cualquier prefijo que envíes más de una vez. Revisa las tablas en vivo de arriba antes de un trabajo grande, recarga en la página de facturación y consulta las páginas de Claude Fable 5.1, Claude Fable 5 y Claude Opus 5.5 para probar cada modelo en el navegador.

Guías relacionadas