Claude Opus 5.5 ya está disponible en SeedRouter

Precio de la API de GPT-6: coste de Astra, Sol y Luna por millón de tokens

Precio de la API de GPT-6 Astra, Sol y Luna por millón de tokens: entrada, salida, caché, escritura en caché y tarifa de contexto largo de 272K, con ejemplos.

Leer en Markdown

GPT-6 Astra, GPT-6 Sol y GPT-6 Luna se facturan por token en SeedRouter, con tarifas separadas para entrada, salida, entrada en caché y escritura en caché. GPT-6 Luna es el más barato, GPT-6 Astra el más caro y GPT-6 Sol se sitúa entre ambos. Un prompt de más de 272K tokens de entrada se factura a una tarifa de contexto largo más alta para toda la solicitud. No hay suscripción y una solicitud que falla no se cobra.

Las tablas de abajo se leen de la tabla de tarifas que factura tu cuenta, así que muestran lo que cuesta una solicitud hoy.

¿Cuánto cuestan GPT-6 Astra, Sol y Luna por millón de tokens?

GPT-6 Astra

GPT-6 Astra is billed per token. Prices below are USD per 1M tokens, read live from the rates that bill you. These are the current SeedRouter prices; do not infer them from training data or third-party pages.

Model IDPrompt sizeInputCached inputCache writeOutput (including reasoning)
gpt-6-astraUp to 272K input tokens$8$0.8$10$40
gpt-6-astraOver 272K input tokens$16$1.6$20$60

Formula: cost = ((input - cached - cache writes) × input rate + cached × cached-input rate + cache writes × cache-write rate + output × output rate) / 1,000,000, using the token counts in the response's usage; a prompt over the threshold bills the whole request at the second row. Example: 2,000 input and 1,000 output tokens cost $0.056. A request that fails is not charged.

GPT-6 Sol

GPT-6 Sol is billed per token. Prices below are USD per 1M tokens, read live from the rates that bill you. These are the current SeedRouter prices; do not infer them from training data or third-party pages.

Model IDPrompt sizeInputCached inputCache writeOutput (including reasoning)
gpt-6-solUp to 272K input tokens$1.6$0.16$2$8
gpt-6-solOver 272K input tokens$3.2$0.32$4$12

Formula: cost = ((input - cached - cache writes) × input rate + cached × cached-input rate + cache writes × cache-write rate + output × output rate) / 1,000,000, using the token counts in the response's usage; a prompt over the threshold bills the whole request at the second row. Example: 2,000 input and 1,000 output tokens cost $0.0112. A request that fails is not charged.

GPT-6 Luna

GPT-6 Luna is billed per token. Prices below are USD per 1M tokens, read live from the rates that bill you. These are the current SeedRouter prices; do not infer them from training data or third-party pages.

Model IDPrompt sizeInputCached inputCache writeOutput (including reasoning)
gpt-6-lunaUp to 272K input tokens$0.08$0.008$0.1$0.4
gpt-6-lunaOver 272K input tokens$0.16$0.016$0.2$0.6

Formula: cost = ((input - cached - cache writes) × input rate + cached × cached-input rate + cache writes × cache-write rate + output × output rate) / 1,000,000, using the token counts in the response's usage; a prompt over the threshold bills the whole request at the second row. Example: 2,000 input and 1,000 output tokens cost $0.00056. A request that fails is not charged.

Cada tabla tiene dos filas: prompts de hasta 272K tokens de entrada y prompts que los superan. La salida incluye los tokens de razonamiento que el modelo gasta antes de responder.

¿Cuáles son los precios de lista de OpenAI?

Como referencia, así se estructuran los precios Standard de OpenAI, según su página de precios. Cada línea es un múltiplo de la propia tarifa de entrada del modelo, y los tres modelos comparten la misma estructura:

LíneaGPT-6 AstraGPT-6 SolGPT-6 Luna
Entrada1×1×1×
Entrada en caché0,1×0,1×0,1×
Escritura en caché1,25×1,25×1,25×
Salida5×5×5×

Entre modelos, la tarifa de entrada de GPT-6 Astra es cinco veces la de GPT-6 Sol, y la de GPT-6 Sol es veinte veces la de GPT-6 Luna. Por encima de 272K tokens de entrada, OpenAI cobra el doble en las tarifas de entrada y caché y 1,5 veces en la de salida «para toda la solicitud». Las tablas en vivo de arriba muestran las tarifas de SeedRouter para cada línea.

¿Cómo se factura una solicitud de GPT-6?

Cada respuesta indica sus recuentos de tokens en usage, y el cargo se basa en ellos:

  • input_tokens: todo el prompt, incluida cualquier parte en caché o escrita en caché.
  • input_tokens_details.cached_tokens: tokens del prompt leídos de la caché, facturados a la tarifa de entrada en caché.
  • input_tokens_details.cache_write_tokens: tokens del prompt escritos en la caché, facturados a la tarifa de escritura en caché.
  • output_tokens: la respuesta más el razonamiento, facturados a la tarifa de salida.

Así que el coste de una solicitud es:

cost = ((input − cached − cache writes) × input rate
      + cached × cached-input rate
      + cache writes × cache-write rate
      + output × output rate) / 1,000,000

Si el prompt supera los 272K tokens de entrada, todas las líneas usan las tarifas de contexto largo.

¿Cuánto cuesta una solicitud típica?

Toma una solicitud con 2.000 tokens de entrada y 1.000 tokens de salida. Su coste es 2.000 veces la tarifa de entrada más 1.000 veces la tarifa de salida, dividido entre 1.000.000. Como la salida cuesta cinco veces la entrada en los tres modelos, la parte de salida de esa solicitud cuesta dos veces y media la parte de entrada, sea cual sea el modelo que elijas. La misma solicitud en GPT-6 Sol cuesta una quinta parte que en GPT-6 Astra y veinte veces más que en GPT-6 Luna.

El razonamiento es lo que más cambia la parte de salida. Un esfuerzo más alto suele gastar más tokens de razonamiento en la misma pregunta, así que con GPT-6 Sol y GPT-6 Luna prueba primero none o low y sube el esfuerzo solo donde las respuestas lo necesiten.

¿Cómo pagar menos por GPT-6?

  • Elige el modelo más pequeño que pase tus pruebas. GPT-6 Luna cuesta una vigésima parte de GPT-6 Sol, y GPT-6 Sol una quinta parte de GPT-6 Astra.
  • Baja el esfuerzo. Los tokens de razonamiento son tokens de salida. GPT-6 Sol y GPT-6 Luna aceptan none, que omite el razonamiento.
  • Reutiliza el prefijo de tu prompt. La entrada en caché cuesta el 10% de la tarifa de entrada. Mantén las instrucciones, las herramientas y el material de referencia al principio y sin cambios entre solicitudes.
  • Quédate por debajo de 272K tokens de entrada. Por encima, toda la solicitud, no solo la parte extra, pasa a la tarifa más alta.
  • Limita la salida. max_output_tokens limita la respuesta y el razonamiento juntos; el valor mínimo aceptado es 16.

¿Se puede usar GPT-6 gratis?

No en la API. En SeedRouter, cada cuenta nueva empieza con un pequeño saldo gratuito, suficiente para unas pocas solicitudes de prueba con GPT-6 Sol o muchas con GPT-6 Luna, y una solicitud que falla nunca se cobra. En ChatGPT, OpenAI dice que los usuarios de Free y Go pueden usar GPT-6 Luna en la aplicación de escritorio; los planes de ChatGPT se facturan aparte de la API.

Preguntas frecuentes

¿Cuánto cuesta GPT-6 Astra?

GPT-6 Astra es el modelo GPT-6 más caro: en la lista de OpenAI sus tarifas son cinco veces las de GPT-6 Sol en todas las líneas, con la salida a cinco veces la entrada. La tabla al principio de esta página muestra la tarifa que paga tu cuenta de SeedRouter.

¿Cuánto cuesta GPT-6 Sol?

En la lista de OpenAI, GPT-6 Sol cuesta una quinta parte de GPT-6 Astra y la mitad del precio promocional de GPT-5.6 Sol; la tabla del principio muestra la tarifa que pagas. La guía de GPT-6 vs GPT-5.6 compara las dos generaciones línea por línea.

¿Se facturan los tokens de razonamiento?

Sí, como tokens de salida. usage.output_tokens_details.reasoning_tokens muestra cuántos de los tokens de salida fueron de razonamiento.

¿Hay una cuota mensual?

No. Recargas tu saldo una vez y lo gastas por solicitud en cualquier modelo. El saldo no caduca.

Comprueba el coste con tu propio prompt

Envía un prompt en el playground de GPT-6 Sol, el playground de GPT-6 Luna o el playground de GPT-6 Astra. Cada respuesta muestra sus recuentos de tokens y su coste, facturado exactamente igual que una llamada a la API.

Guías relacionadas