Claude Fable 5.1 和 Opus 5.5 API 定价:每百万 token 多少钱
Claude Fable 5.1、Fable 5 和 Opus 5.5 的每百万 token API 调用价格:输入 token、输出 token 和提示缓存费率,一次请求如何计费,以及 API 与 Claude 订阅的区别。
以 Markdown 阅读SeedRouter 上的 Claude Fable 5.1、Claude Fable 5 和 Claude Opus 5.5 按 token 计费,每个模型分别有输入、输出和两种提示缓存操作的费率。Claude Opus 5.5 是这三个模型中每 token 最便宜的。Claude Fable 5.1 和 Claude Fable 5 的输入和输出费率相同,但 Fable 5.1 读取缓存提示的费率是 Fable 5 的四分之一。没有订阅,失败的请求不收费。
下面的表格读取的是为你账户计费的费率表,所以它们显示的是今天的请求成本。
Claude Fable 5.1、Fable 5 和 Opus 5.5 每百万 token 多少钱?
Claude Fable 5.1
Current rates are temporarily unavailable. No price estimate is provided; unavailable rates must not be interpreted as free usage.
Claude Fable 5
Current rates are temporarily unavailable. No price estimate is provided; unavailable rates must not be interpreted as free usage.
Claude Opus 5.5
Current rates are temporarily unavailable. No price estimate is provided; unavailable rates must not be interpreted as free usage.
每个模型一张表。输入和输出是基础费率。"输出"包含模型的思考过程,因为思考 token 是输出 token。缓存栏只在使用提示缓存时适用。如果某个费率无法加载,表格会明确标出,而不是显示为零;将其视为未知,绝不要当作免费。
作为参考,以下是 Anthropic 在其官方 API 上的列表价格结构,来自 Claude 定价页面(2026 年 9 月 27 日)。每行是该模型自身输入费率的倍数:
| 模型 | 输入 | 输出 | 缓存写入 5 分钟 | 缓存写入 1 小时 | 缓存读取 |
|---|---|---|---|---|---|
| Claude Fable 5.1 | 1× | 5× | 1.25× | 2× | 0.025× |
| Claude Fable 5 | 1× | 5× | 1.25× | 2× | 0.1× |
| Claude Opus 5.5 | 1× | 5× | 1.25× | 2× | 0.05× |
在官方价格表中,Claude Fable 5.1 和 Claude Fable 5 共享一个输入费率,Claude Opus 5.5 的输入费率是其 40%。
一次 Claude 请求如何计费?
每个响应都携带一个 usage 对象,收费根据它计算,而不是你的 max_tokens:
cost = ( input_tokens × input rate
+ output_tokens × output rate
+ cache_read_input_tokens × cache-read rate
+ 5-minute cache writes × 5-minute write rate
+ 1-hour cache writes × 1-hour write rate ) / 1,000,000在 Messages 格式中,两种缓存写入分别报告在 usage.cache_creation.ephemeral_5m_input_tokens 和 usage.cache_creation.ephemeral_1h_input_tokens 中。
max_tokens 只是上限。一个 max_tokens: 32000 的请求如果只写入 900 个 token,就只为 900 个付费。
哪个 Claude 模型最便宜?
| 工作类型 | 最便宜的选择 | 原因 |
|---|---|---|
| 大多数编码和知识工作 | Claude Opus 5.5 | 最低的输入和输出费率;Anthropic 建议从这里开始 |
| 深度推理、长时间代理运行 | Claude Fable 5.1 | 与 Fable 5 相同的输入和输出费率,缓存读取更便宜 |
| 现有代码强制工具调用 | Claude Fable 5 | 这三个模型中唯一接受强制 tool_choice 的 |
| 多次发送的长共享提示 | Claude Opus 5.5 或 Fable 5.1 | 缓存读取费率为输入费率的 5% 和 2.5% |
同一个 SeedRouter key 可以调用这三个模型,所以切换只需改变 model。Claude Fable 5.1 vs Fable 5 vs Opus 5.5 对比指南介绍了它们之间的其他区别。
提示缓存能省多少钱?
当同一个长前缀(如系统提示、代码库或文档)被一遍遍发送时,缓存就很划算。第一个请求把前缀写入缓存,成本比普通输入高。之后的请求以输入费率的一小部分读取它。
在 Anthropic 的官方价格中,5 分钟写入费用是输入费率的 1.25 倍,1 小时写入是 2 倍。缓存读取费用是 Claude Fable 5.1 的输入费率的 2.5%、Claude Opus 5.5 的 5% 和 Claude Fable 5 的 10%。上面表格中的缓存栏是 SeedRouter 对这五行的自有费率。
按这些比例,5 分钟写入在第一次读回前缀时就能自己赚回成本,1 小时写入从第二次读开始赚钱。当请求间隔超过 5 分钟时使用 1 小时写入。要开启缓存,如 Claude Opus 5.5 API 参考中所述,在请求中添加 cache_control。
努力设置会改变价格吗?
不会改变费率,但会改变账单。努力(output_config.effort:low、medium、high、xhigh 或 max)决定模型思考多少,思考计作输出。同一个问题在 low 下通常比在 max 下便宜。Claude Fable 5.1 和 Claude Fable 5 默认为 high;Claude Opus 5.5 默认为 medium。
在这三个模型上,思考无法关闭,只能调低。如果任务简单,降低努力是最直接的成本节约方式。
Claude Pro 或 Max 订阅与 API 访问相同吗?
不相同。Anthropic 的支持文章明确说明:"已付费的 Claude 订阅可以增强你的聊天体验,但不包括对 Claude API 或 Console 的访问权限"(来源)。Pro 和 Max 覆盖 Claude 应用。API 调用按 token 单独计费。
在 SeedRouter 上只有按 token 计费。你在账单页充值一次,额度永不过期,每次完成的请求从余额中扣除。同一个余额可以为目录中的所有模型付费。
常见问题
100 万个 Claude token 多少钱?
取决于模型以及 token 是输入还是输出。在这三个模型上,输出费用都是输入的五倍。上面的实时表格给出了每个模型的费率,Claude Opus 5.5 行是最低的。
Claude Opus 5.5 比 Claude Fable 5.1 便宜吗?
是的,表中每一行都是。在 Anthropic 的官方价格中,Claude Opus 5.5 的输入和输出费率是 Claude Fable 5.1 的 40%,SeedRouter 的费率保持这个顺序。
Claude Opus 5.5 比 Claude Opus 5 便宜吗?
在 Anthropic 的官方价格中,是的:其输入和输出费率比 Claude Opus 5 低 20%,缓存读取低 60%。SeedRouter 不销售 Claude Opus 5。
长提示每个 token 成本更高吗?
不会。Anthropic 对这些模型的整个 1M token 上下文窗口按标准费率计费:其定价页说"一个 900k token 的请求按与 9k token 请求相同的每 token 费率计费"。长提示成本高的唯一原因是它有更多 token。
批量 API 折扣或快速模式可用吗?
在 SeedRouter 上不可用。请求通过标准的 Messages、Chat Completions 和 Responses 端点运行,按上表中的费率计费。
我在哪里可以看到一个请求花了多少钱?
在用量历史中,逐个请求。API 响应本身在 usage 中报告 token 数,但不包含金额。
发送前先算好价格
从 Claude Opus 5.5 开始,只在需要更深层推理时才切换到 Claude Fable 5.1,并缓存你发送多次的任何前缀。在大量作业前查看上面的实时表格,在账单页充值,然后参考 Claude Fable 5.1、Claude Fable 5 和 Claude Opus 5.5 页面在浏览器中试用每个模型。



