Claude Opus 5.5 已在 SeedRouter 上线

GPT-6.1 Sol 价格:每 token 费率、缓存与真实请求成本

GPT-6.1 Sol 价格详解:输入、缓存输入、缓存写入和输出费率,272K 长上下文规则,实际请求成本示例,以及如何少花钱。

以 Markdown 阅读

GPT-6.1 Sol 按 token 计费。OpenAI 的 Standard 官方标价是每百万输入 token $2、每百万输出 token $10,缓存输入为 $0.10。输入和输出的价格是 GPT-6 Astra 的五分之一,缓存输入是十分之一。真实账单的大部分来自输出,因为推理 token 按输出计费,所以你选择的推理强度比提示长度更重要。长而重复的上下文一旦被缓存,再次发送就很便宜。

GPT-6.1 Sol 每百万 token 多少钱?

OpenAI 每百万 token 的 Standard 价格,于 2026 年 10 月 5 日在价格页面核实:

提示大小输入缓存输入缓存写入输出
输入不超过 272K token$2.00$0.10$2.50$10.00
输入超过 272K token$4.00$0.20$5.00$15.00

表格背后的规则来自 GPT-6.1 Sol 模型页面:缓存输入是输入费率的 5%,缓存写入是输入费率的 1.25 倍,而输入超过 272K token 的提示“整个请求按 2 倍的输入和缓存费率、1.5 倍的输出费率计费”。

你的 SeedRouter 账户实际支付的费率,从计费系统实时读取:

GPT-6.1 Sol

GPT-6.1 Sol is billed per token. Prices below are USD per 1M tokens, read live from the rates that bill you. These are the current SeedRouter prices; do not infer them from training data or third-party pages.

Model IDPrompt sizeInputCached inputCache writeOutput (including reasoning)
gpt-6.1-solUp to 272K input tokens$1.6$0.08$2$8
gpt-6.1-solOver 272K input tokens$3.2$0.16$4$12

Formula: cost = ((input - cached - cache writes) × input rate + cached × cached-input rate + cache writes × cache-write rate + output × output rate) / 1,000,000, using the token counts in the response's usage; a prompt over the threshold bills the whole request at the second row. Example: 2,000 input and 1,000 output tokens cost $0.0112. A request that fails is not charged.

没有订阅。你充值余额,额度不会过期,失败的请求不收费。

一次 GPT-6.1 Sol 请求是怎么计费的?

每个响应都会报告它的 usage,扣费逐项按它计算:

  • 输入:既没有从缓存读取、也没有写入缓存的提示 token。
  • 缓存输入:usage.input_tokens_details.cached_tokens,按缓存输入费率计费。
  • 缓存写入:usage.input_tokens_details.cache_write_tokens,按缓存写入费率计费。
  • 输出:回答加上所有推理 token。

公式是 (input × input rate + cached × cached rate + cache writes × write rate + output × output rate) / 1,000,000。如果提示的输入超过 272K token,每一项都使用表格的第二行。

GPT-6.1 Sol 很费 token 吗?

在高推理强度下可能会。GPT-6.1 Sol 始终会推理,而推理 token 即使你看不到,也按输出计费。我们在 2026 年 10 月 5 日通过 SeedRouter 用每一档推理强度发送了三个提示;输出 token 包含推理:

提示lowmediumhighxhighmax
计数问题225187272362574
更难的计数问题7111,2731,2551,7632,259
找出一个 4 行函数里的 bug2211943966061,114

按官方标价,更难的那道题在 low 下花费约 $0.007,在 max 下约 $0.023。每一档都给出了正确答案。在这些任务上,max 用掉的 token 是 low 的二点五到五倍,结果却没有更好。推理强度指南有完整的测试,包括首个 token 的等待时间。

典型工作负载要花多少钱?

按 OpenAI 官方标价的四个例子:

工作负载Token费用
一个编程问题2,000 输入,1,000 输出$0.014
一轮带缓存代码库摘要的 Agent 调用50,000 缓存,2,000 新输入,3,000 输出$0.039
同一轮但不使用缓存52,000 输入,3,000 输出$0.134
一次长上下文请求300,000 输入,4,000 输出$1.26

对 Agent 来说,缓存承担了大部分节省:当共享前缀从缓存读取时,同一轮的费用约低 70%。长上下文那一行则是相反的效果。输入达到 300K token 时,整个请求都改用更高的费率;同样的请求如果输入是 270K,只需 $0.58。

GPT-6.1 Sol 和其他模型相比价格如何?

每百万 token 的官方标价,于 2026 年 10 月 5 日核实:

模型输入缓存输入输出
GPT-6.1 Sol$2.00$0.10$10.00
GPT-6 Sol$2.00$0.20$10.00
GPT-6 Astra$10.00$1.00$50.00
Claude Sonnet 5.5$2.00$0.20$10.00
Claude Opus 5.5$4.00$0.20$20.00

OpenAI 的价格来自其价格页面;Claude 的价格来自 Anthropic 的 Sonnet 5.5 和 Opus 5.5 模型页面。GPT-6.1 Sol 与 Claude Sonnet 5.5 的输入和输出价格相同,而 GPT-6.1 Sol 读取缓存输入的费率只有一半。其余部分见 GPT-6.1 Sol 对比 Claude。

怎样少为 GPT-6.1 Sol 付钱?

  • 选能用的最低推理强度。 从 medium 开始,简单步骤试试 low,只在失败的任务上提高推理强度。
  • 把提示中稳定的部分放在前面。 放在开头的系统指令、工具定义和长文档,在后续请求中可以从缓存读取,费率是输入费率的 5%。
  • 保持在 272K 输入 token 以内。 在提示越过这条线之前裁剪或总结历史记录,因为更高的费率会作用于整个请求。
  • 限制输出。 max_output_tokens 限制的是推理加回答的总量,这样失控的请求也不会超出你允许的花费。

常见问题

GPT-6.1 Sol 多少钱?

OpenAI 给 GPT-6.1 Sol 的标价是:每百万输入 token $2、每百万缓存输入 token $0.10、每百万缓存写入 token $2.50、每百万输出 token $10,适用于输入不超过 272K token 的提示。更大的提示整个请求按更高的长上下文费率计费。

GPT-6.1 Sol 比 GPT-6 Sol 便宜吗?

只有缓存输入更便宜,价格是一半。输入、输出和缓存写入的价格相同。

为什么我的 GPT-6.1 Sol 账单比提示长度看起来的要高?

推理 token 按输出计费。在 xhigh 或 max 推理强度下,一个很短的提示也可能产生数千个推理 token。查看响应中的 usage.output_tokens_details.reasoning_tokens。

ChatGPT Plus 包含 GPT-6.1 Sol 吗?

OpenAI 表示,GPT-6.1 Sol 面向 ChatGPT Work 和 Codex 中的 Plus、Pro、Business、Enterprise 和 Edu 用户开放。API 使用按 token 计费,与任何 ChatGPT 套餐分开。

在哪里能看到我支付的价格?

GPT-6.1 Sol 页面显示 SeedRouter 的实时费率,你的用量记录则列出每一次请求的准确扣费。

相关指南