Claude Opus 5.5 уже доступна в SeedRouter

Цены GPT-6 API: сколько стоят Astra, Sol и Luna за миллион токенов

Цены GPT-6 API для Astra, Sol и Luna за миллион токенов: вход, выход, кэшированный вход, запись в кэш и ставка длинного контекста от 272K, с примерами расчёта.

Читать в Markdown

GPT-6 Astra, GPT-6 Sol и GPT-6 Luna тарифицируются в SeedRouter по токенам, с отдельными ставками для входа, выхода, кэшированного входа и записи в кэш. GPT-6 Luna — самая дешёвая, GPT-6 Astra — самая дорогая, а GPT-6 Sol находится между ними. Промпт длиннее 272K входных токенов тарифицируется по более высокой ставке длинного контекста за весь запрос. Подписки нет, и неудачный запрос не оплачивается.

Таблицы ниже считываются из таблицы тарифов, по которой списываются средства с вашего аккаунта, поэтому они показывают, сколько запрос стоит сегодня.

Сколько стоят GPT-6 Astra, Sol и Luna за миллион токенов?

GPT-6 Astra

GPT-6 Astra is billed per token. Prices below are USD per 1M tokens, read live from the rates that bill you. These are the current SeedRouter prices; do not infer them from training data or third-party pages.

Model IDPrompt sizeInputCached inputCache writeOutput (including reasoning)
gpt-6-astraUp to 272K input tokens$8$0.8$10$40
gpt-6-astraOver 272K input tokens$16$1.6$20$60

Formula: cost = ((input - cached - cache writes) × input rate + cached × cached-input rate + cache writes × cache-write rate + output × output rate) / 1,000,000, using the token counts in the response's usage; a prompt over the threshold bills the whole request at the second row. Example: 2,000 input and 1,000 output tokens cost $0.056. A request that fails is not charged.

GPT-6 Sol

GPT-6 Sol is billed per token. Prices below are USD per 1M tokens, read live from the rates that bill you. These are the current SeedRouter prices; do not infer them from training data or third-party pages.

Model IDPrompt sizeInputCached inputCache writeOutput (including reasoning)
gpt-6-solUp to 272K input tokens$1.6$0.16$2$8
gpt-6-solOver 272K input tokens$3.2$0.32$4$12

Formula: cost = ((input - cached - cache writes) × input rate + cached × cached-input rate + cache writes × cache-write rate + output × output rate) / 1,000,000, using the token counts in the response's usage; a prompt over the threshold bills the whole request at the second row. Example: 2,000 input and 1,000 output tokens cost $0.0112. A request that fails is not charged.

GPT-6 Luna

GPT-6 Luna is billed per token. Prices below are USD per 1M tokens, read live from the rates that bill you. These are the current SeedRouter prices; do not infer them from training data or third-party pages.

Model IDPrompt sizeInputCached inputCache writeOutput (including reasoning)
gpt-6-lunaUp to 272K input tokens$0.08$0.008$0.1$0.4
gpt-6-lunaOver 272K input tokens$0.16$0.016$0.2$0.6

Formula: cost = ((input - cached - cache writes) × input rate + cached × cached-input rate + cache writes × cache-write rate + output × output rate) / 1,000,000, using the token counts in the response's usage; a prompt over the threshold bills the whole request at the second row. Example: 2,000 input and 1,000 output tokens cost $0.00056. A request that fails is not charged.

В каждой таблице две строки: промпты до 272K входных токенов и промпты длиннее. Выход включает токены рассуждения, которые модель тратит до ответа.

Какие цены в прайс-листе OpenAI?

Для справки — так устроены стандартные цены OpenAI, со страницы цен. Каждая строка — множитель от ставки входа самой модели, и у всех трёх моделей одинаковая структура:

СтрокаGPT-6 AstraGPT-6 SolGPT-6 Luna
Вход1×1×1×
Кэшированный вход0.1×0.1×0.1×
Запись в кэш1.25×1.25×1.25×
Выход5×5×5×

Между моделями: ставка входа GPT-6 Astra в пять раз выше, чем у GPT-6 Sol, а у GPT-6 Sol — в двадцать раз выше, чем у GPT-6 Luna. Свыше 272K входных токенов OpenAI берёт 2x от ставок входа и кэша и 1,5x от ставки выхода «за весь запрос». Актуальные таблицы выше показывают ставки SeedRouter по каждой строке.

Как тарифицируется запрос к GPT-6?

Каждый ответ сообщает количество токенов в usage, и списание считается по ним:

  • input_tokens: весь промпт, включая кэшированную часть и часть, записанную в кэш.
  • input_tokens_details.cached_tokens: токены промпта, прочитанные из кэша, по ставке кэшированного входа.
  • input_tokens_details.cache_write_tokens: токены промпта, записанные в кэш, по ставке записи в кэш.
  • output_tokens: ответ плюс рассуждение, по ставке выхода.

Итак, стоимость одного запроса:

cost = ((input − cached − cache writes) × input rate
      + cached × cached-input rate
      + cache writes × cache-write rate
      + output × output rate) / 1,000,000

Если промпт длиннее 272K входных токенов, во всех строках применяются ставки длинного контекста.

Сколько стоит типичный запрос?

Возьмём запрос с 2000 входных и 1000 выходных токенов. Его стоимость — 2000, умноженные на ставку входа, плюс 1000, умноженные на ставку выхода, делённые на 1 000 000. Поскольку у всех трёх моделей выход стоит в пять раз дороже входа, выходная часть такого запроса обходится в два с половиной раза дороже входной, какую модель ни выбери. Тот же запрос на GPT-6 Sol стоит пятую часть от GPT-6 Astra и в двадцать раз больше, чем на GPT-6 Luna.

Сильнее всего выходную часть меняет рассуждение. Более высокий уровень обычно тратит больше токенов рассуждения на тот же вопрос, поэтому для GPT-6 Sol и GPT-6 Luna сначала попробуйте none или low и повышайте уровень рассуждения только там, где ответам это нужно.

Как платить за GPT-6 меньше?

  • Берите самую маленькую модель, которая проходит ваши тесты. GPT-6 Luna стоит двадцатую часть от GPT-6 Sol, а GPT-6 Sol — пятую часть от GPT-6 Astra.
  • Снизьте уровень рассуждения. Токены рассуждения — это токены выхода. GPT-6 Sol и GPT-6 Luna принимают none, при котором рассуждение пропускается.
  • Переиспользуйте префикс промпта. Кэшированный вход стоит 10% от ставки входа. Держите инструкции, инструменты и справочные материалы в начале и не меняйте их между запросами.
  • Не выходите за 272K входных токенов. Выше этого порога по более высокой ставке тарифицируется весь запрос, а не только лишняя часть.
  • Ограничьте выход. max_output_tokens ограничивает ответ и рассуждение вместе; минимальное допустимое значение — 16.

GPT-6 бесплатно — это возможно?

Не в API. В SeedRouter каждый новый аккаунт получает небольшой бесплатный баланс, которого хватит на несколько тестовых запросов к GPT-6 Sol или на много запросов к GPT-6 Luna, а неудачный запрос никогда не оплачивается. В ChatGPT, по словам OpenAI, пользователи Free и Go могут пользоваться GPT-6 Luna в десктопном приложении; тарифы ChatGPT оплачиваются отдельно от API.

Часто задаваемые вопросы

Сколько стоит GPT-6 Astra?

GPT-6 Astra — самая дорогая модель GPT-6: по прайс-листу OpenAI её ставки в пять раз выше, чем у GPT-6 Sol, по каждой строке, а выход стоит в пять раз дороже входа. Таблица в начале страницы показывает ставку, которую платит ваш аккаунт SeedRouter.

Сколько стоит GPT-6 Sol?

По прайс-листу OpenAI GPT-6 Sol стоит пятую часть от GPT-6 Astra и половину промо-цены GPT-5.6 Sol; таблица в начале страницы показывает ставку, которую платите вы. Сравнение GPT-6 vs GPT-5.6 сопоставляет два поколения построчно.

Оплачиваются ли токены рассуждения?

Да, как токены выхода. usage.output_tokens_details.reasoning_tokens показывает, сколько из выходных токенов пришлось на рассуждение.

Есть ли ежемесячная плата?

Нет. Вы один раз пополняете баланс и тратите его на запросы к любой модели. Баланс не сгорает.

Проверьте стоимость на своём промпте

Отправьте промпт в Playground GPT-6 Sol, Playground GPT-6 Luna или Playground GPT-6 Astra. Каждый ответ показывает количество токенов и стоимость и тарифицируется точно так же, как вызов через API.

Похожие руководства