GPT-6 API 价格:Astra、Sol 和 Luna 每百万 token 多少钱
GPT-6 Astra、Sol 和 Luna 的 API 价格(每百万 token):输入、输出、缓存输入、缓存写入以及 272K 长上下文费率,附计费示例。
以 Markdown 阅读SeedRouter 上的 GPT-6 Astra、GPT-6 Sol 和 GPT-6 Luna 按 token 计费,输入、输出、缓存输入和缓存写入分别有各自的费率。GPT-6 Luna 最便宜,GPT-6 Astra 最贵,GPT-6 Sol 居中。输入超过 272K tokens 的提示,整次请求按更高的长上下文费率计费。没有订阅,失败的请求不收费。
下面的表格读取的是为你账户计费的费率表,所以显示的是今天一次请求的实际成本。
GPT-6 Astra、Sol 和 Luna 每百万 token 多少钱?
GPT-6 Astra
Current rates are temporarily unavailable. No price estimate is provided; unavailable rates must not be interpreted as free usage.
GPT-6 Sol
Current rates are temporarily unavailable. No price estimate is provided; unavailable rates must not be interpreted as free usage.
GPT-6 Luna
Current rates are temporarily unavailable. No price estimate is provided; unavailable rates must not be interpreted as free usage.
每张表有两行:输入不超过 272K tokens 的提示,以及超过的提示。输出包含模型在回答前消耗的推理 token。
OpenAI 的官方标价是怎样的?
作为参考,下面是 OpenAI Standard 价格的结构,来自其 价格页面。每一行都是该模型自身输入费率的倍数,三个模型的结构相同:
| 计费项 | GPT-6 Astra | GPT-6 Sol | GPT-6 Luna |
|---|---|---|---|
| 输入 | 1× | 1× | 1× |
| 缓存输入 | 0.1× | 0.1× | 0.1× |
| 缓存写入 | 1.25× | 1.25× | 1.25× |
| 输出 | 5× | 5× | 5× |
跨模型来看,GPT-6 Astra 的输入费率是 GPT-6 Sol 的五倍,GPT-6 Sol 的输入费率是 GPT-6 Luna 的二十倍。输入超过 272K tokens 时,OpenAI 会“对整次请求”按 2 倍输入和缓存费率、1.5 倍输出费率收费。上面的实时表格列出了 SeedRouter 每一项的费率。
GPT-6 的一次请求怎么计费?
每个响应都会在 usage 中报告 token 数,费用据此计算:
input_tokens:整个提示,包括缓存读取和缓存写入的部分。input_tokens_details.cached_tokens:从缓存读取的提示 token,按缓存输入费率计费。input_tokens_details.cache_write_tokens:写入缓存的提示 token,按缓存写入费率计费。output_tokens:回答加推理,按输出费率计费。
所以一次请求的费用是:
cost = ((input − cached − cache writes) × input rate
+ cached × cached-input rate
+ cache writes × cache-write rate
+ output × output rate) / 1,000,000如果提示的输入超过 272K tokens,每一项都改用长上下文费率。
一次典型请求要花多少钱?
以一次 2,000 输入 tokens、1,000 输出 tokens 的请求为例。它的费用是 2,000 乘以输入费率,加上 1,000 乘以输出费率,再除以 1,000,000。由于三个模型的输出费率都是输入的五倍,无论选哪个模型,这次请求的输出部分都是输入部分的两倍半。同一个请求,GPT-6 Sol 的花费是 GPT-6 Astra 的五分之一,是 GPT-6 Luna 的二十倍。
推理对输出部分的影响最大。同一个问题,推理强度越高通常消耗的推理 token 越多,所以 GPT-6 Sol 和 GPT-6 Luna 先试 none 或 low,只在回答确实需要的地方调高推理强度。
怎样让 GPT-6 用得更省钱?
- 选能通过你测试的最小模型。 GPT-6 Luna 的价格是 GPT-6 Sol 的二十分之一,GPT-6 Sol 是 GPT-6 Astra 的五分之一。
- 降低推理强度。 推理 token 就是输出 token。GPT-6 Sol 和 GPT-6 Luna 接受
none,可以跳过推理。 - 复用提示前缀。 缓存输入的费用是输入费率的 10%。把指令、工具和参考资料放在开头,并在请求之间保持不变。
- 把输入控制在 272K tokens 以内。 超过之后,是整次请求而不只是超出的部分改按更高费率计费。
- 限制输出长度。
max_output_tokens同时限制回答和推理,最小可设为 16。
GPT-6 可以免费用吗?
API 不免费。在 SeedRouter 上,每个新账户都有一小笔免费余额,够在 GPT-6 Sol 上发几次测试请求,或在 GPT-6 Luna 上发很多次,而且失败的请求永远不收费。在 ChatGPT 中,OpenAI 表示 Free 和 Go 用户可以在桌面应用里使用 GPT-6 Luna;ChatGPT 套餐与 API 分开计费。
常见问题
GPT-6 Astra 多少钱?
GPT-6 Astra 是最贵的 GPT-6 模型:按 OpenAI 的官方标价,它每一行的费率都是 GPT-6 Sol 的五倍,输出是输入的五倍。本页顶部的表格显示的是你的 SeedRouter 账户实际支付的费率。
GPT-6 Sol 多少钱?
按 OpenAI 的官方标价,GPT-6 Sol 是 GPT-6 Astra 的五分之一,是 GPT-5.6 Sol 促销价的一半;你实际支付的费率见顶部表格。GPT-6 vs GPT-5.6 对比指南 逐项对比了两代模型。
推理 token 收费吗?
收费,按输出 token 计费。usage.output_tokens_details.reasoning_tokens 显示输出 token 中有多少是推理。
有月费吗?
没有。你充值一次余额,然后在任何模型上按请求消费。余额不会过期。
用你自己的提示看看花多少钱
在 GPT-6 Sol playground、GPT-6 Luna playground 或 GPT-6 Astra playground 中发送一个提示。每个回答都会显示 token 数和费用,计费方式与 API 调用完全相同。



