Claude Opus 5.5 已在 SeedRouter 上线

Claude Fable 5.1 和 Opus 5.5 API 定价:每百万 token 多少钱

Claude Fable 5.1、Fable 5 和 Opus 5.5 的每百万 token API 调用价格:输入 token、输出 token 和提示缓存费率,一次请求如何计费,以及 API 与 Claude 订阅的区别。

以 Markdown 阅读

SeedRouter 上的 Claude Fable 5.1、Claude Fable 5 和 Claude Opus 5.5 按 token 计费,每个模型分别有输入、输出和两种提示缓存操作的费率。Claude Opus 5.5 是这三个模型中每 token 最便宜的。Claude Fable 5.1 和 Claude Fable 5 的输入和输出费率相同,但 Fable 5.1 读取缓存提示的费率是 Fable 5 的四分之一。没有订阅,失败的请求不收费。

下面的表格读取的是为你账户计费的费率表,所以它们显示的是今天的请求成本。

Claude Fable 5.1、Fable 5 和 Opus 5.5 每百万 token 多少钱?

Claude Fable 5.1

Current rates are temporarily unavailable. No price estimate is provided; unavailable rates must not be interpreted as free usage.

Claude Fable 5

Current rates are temporarily unavailable. No price estimate is provided; unavailable rates must not be interpreted as free usage.

Claude Opus 5.5

Current rates are temporarily unavailable. No price estimate is provided; unavailable rates must not be interpreted as free usage.

每个模型一张表。输入和输出是基础费率。"输出"包含模型的思考过程,因为思考 token 是输出 token。缓存栏只在使用提示缓存时适用。如果某个费率无法加载,表格会明确标出,而不是显示为零;将其视为未知,绝不要当作免费。

作为参考,以下是 Anthropic 在其官方 API 上的列表价格结构,来自 Claude 定价页面(2026 年 9 月 27 日)。每行是该模型自身输入费率的倍数:

模型输入输出缓存写入 5 分钟缓存写入 1 小时缓存读取
Claude Fable 5.11×5×1.25×2×0.025×
Claude Fable 51×5×1.25×2×0.1×
Claude Opus 5.51×5×1.25×2×0.05×

在官方价格表中,Claude Fable 5.1 和 Claude Fable 5 共享一个输入费率,Claude Opus 5.5 的输入费率是其 40%。

一次 Claude 请求如何计费?

每个响应都携带一个 usage 对象,收费根据它计算,而不是你的 max_tokens:

cost = ( input_tokens × input rate
       + output_tokens × output rate
       + cache_read_input_tokens × cache-read rate
       + 5-minute cache writes × 5-minute write rate
       + 1-hour cache writes × 1-hour write rate ) / 1,000,000

在 Messages 格式中,两种缓存写入分别报告在 usage.cache_creation.ephemeral_5m_input_tokens 和 usage.cache_creation.ephemeral_1h_input_tokens 中。

max_tokens 只是上限。一个 max_tokens: 32000 的请求如果只写入 900 个 token,就只为 900 个付费。

哪个 Claude 模型最便宜?

工作类型最便宜的选择原因
大多数编码和知识工作Claude Opus 5.5最低的输入和输出费率;Anthropic 建议从这里开始
深度推理、长时间代理运行Claude Fable 5.1与 Fable 5 相同的输入和输出费率,缓存读取更便宜
现有代码强制工具调用Claude Fable 5这三个模型中唯一接受强制 tool_choice 的
多次发送的长共享提示Claude Opus 5.5 或 Fable 5.1缓存读取费率为输入费率的 5% 和 2.5%

同一个 SeedRouter key 可以调用这三个模型,所以切换只需改变 model。Claude Fable 5.1 vs Fable 5 vs Opus 5.5 对比指南介绍了它们之间的其他区别。

提示缓存能省多少钱?

当同一个长前缀(如系统提示、代码库或文档)被一遍遍发送时,缓存就很划算。第一个请求把前缀写入缓存,成本比普通输入高。之后的请求以输入费率的一小部分读取它。

在 Anthropic 的官方价格中,5 分钟写入费用是输入费率的 1.25 倍,1 小时写入是 2 倍。缓存读取费用是 Claude Fable 5.1 的输入费率的 2.5%、Claude Opus 5.5 的 5% 和 Claude Fable 5 的 10%。上面表格中的缓存栏是 SeedRouter 对这五行的自有费率。

按这些比例,5 分钟写入在第一次读回前缀时就能自己赚回成本,1 小时写入从第二次读开始赚钱。当请求间隔超过 5 分钟时使用 1 小时写入。要开启缓存,如 Claude Opus 5.5 API 参考中所述,在请求中添加 cache_control。

努力设置会改变价格吗?

不会改变费率,但会改变账单。努力(output_config.effort:low、medium、high、xhigh 或 max)决定模型思考多少,思考计作输出。同一个问题在 low 下通常比在 max 下便宜。Claude Fable 5.1 和 Claude Fable 5 默认为 high;Claude Opus 5.5 默认为 medium。

在这三个模型上,思考无法关闭,只能调低。如果任务简单,降低努力是最直接的成本节约方式。

Claude Pro 或 Max 订阅与 API 访问相同吗?

不相同。Anthropic 的支持文章明确说明:"已付费的 Claude 订阅可以增强你的聊天体验,但不包括对 Claude API 或 Console 的访问权限"(来源)。Pro 和 Max 覆盖 Claude 应用。API 调用按 token 单独计费。

在 SeedRouter 上只有按 token 计费。你在账单页充值一次,额度永不过期,每次完成的请求从余额中扣除。同一个余额可以为目录中的所有模型付费。

常见问题

100 万个 Claude token 多少钱?

取决于模型以及 token 是输入还是输出。在这三个模型上,输出费用都是输入的五倍。上面的实时表格给出了每个模型的费率,Claude Opus 5.5 行是最低的。

Claude Opus 5.5 比 Claude Fable 5.1 便宜吗?

是的,表中每一行都是。在 Anthropic 的官方价格中,Claude Opus 5.5 的输入和输出费率是 Claude Fable 5.1 的 40%,SeedRouter 的费率保持这个顺序。

Claude Opus 5.5 比 Claude Opus 5 便宜吗?

在 Anthropic 的官方价格中,是的:其输入和输出费率比 Claude Opus 5 低 20%,缓存读取低 60%。SeedRouter 不销售 Claude Opus 5。

长提示每个 token 成本更高吗?

不会。Anthropic 对这些模型的整个 1M token 上下文窗口按标准费率计费:其定价页说"一个 900k token 的请求按与 9k token 请求相同的每 token 费率计费"。长提示成本高的唯一原因是它有更多 token。

批量 API 折扣或快速模式可用吗?

在 SeedRouter 上不可用。请求通过标准的 Messages、Chat Completions 和 Responses 端点运行,按上表中的费率计费。

我在哪里可以看到一个请求花了多少钱?

在用量历史中,逐个请求。API 响应本身在 usage 中报告 token 数,但不包含金额。

发送前先算好价格

从 Claude Opus 5.5 开始,只在需要更深层推理时才切换到 Claude Fable 5.1,并缓存你发送多次的任何前缀。在大量作业前查看上面的实时表格,在账单页充值,然后参考 Claude Fable 5.1、Claude Fable 5 和 Claude Opus 5.5 页面在浏览器中试用每个模型。

相关指南