利益声明: TeamoRouter 是销售 Claude 系列模型接入的 API 网关,本文含我们自己的服务。官方价格数字全部来自 Anthropic 官方公告;比价方法和「如何排查我们自己」一节适用于包括我们在内的所有渠道——建议用你自己的调用日志核验,别信任何一家(包括我们)的口头承诺。
一句话结论
Claude Fable 5.1 定价 $10 / $50 每百万 token(输入/输出),与 Fable 5 持平;真正的变化是缓存读从 $1.00 降到 $0.25/M,降幅 75%——官方估算典型工作量总成本降约 25%、重度 agent 工作最多降约 45%。结论:标价没变,会配缓存的人账单直接打 75 折以下;不会配缓存的人一分钱都省不到。
官方价格表
| 计费项 | 价格($/M token) | 备注 |
|---|---|---|
| 输入 | $10 | 与 Fable 5 持平 |
| 输出 | $50 | 与 Fable 5 持平 |
| 缓存读 | $0.25 | 较 Fable 5 的 $1.00 降 75%,本次核心变化 |
| 缓存写 | 约 $12.50 | 以官方定价页为准 |
| 上下文 | 100 万 token | 输出上限 12.8 万 |
订阅侧:Max 档和 Team/Enterprise 高级席位包含 Fable 5.1,每周用量上限的一半可分配给它。API 侧对所有付费开发者开放,按量计费——「Fable 只能订阅用」是误传,受限的是姊妹模型 Mythos 5.1。
缓存降价为什么是全部重点
agent 类任务(Claude Code、长会话助手)每一步都重读同一段大前缀(system prompt + 工具定义 + 代码上下文)。缓存命中后这段输入按 $0.25 计费,对 $10 的 fresh input 是 40 倍价差。官方给的两个总账数字(约 25%/最多 45%)几乎全部来自这一项。
场景测算:agent 编码会话(40 步 × 每步重读 5 万 token 前缀,每步输出 2 千 token)
| 项 | Fable 5 | Fable 5.1 |
|---|---|---|
| 缓存输入 200 万 token | $2.00 | $0.50 |
| 输出 8 万 token | $4.00 | $4.00 |
| 单会话合计 | $6.00 | $4.50(−25%) |
反例:10 个问题各带 10 万 token 文档上下文、不配缓存——Fable 5 和 5.1 账单完全一样($11)。降价是你「配」出来的,不是自动到账的。
中转渠道怎么比价
中转站的报价页很多(比价平台已收录 24 家的 claude-fable-5 报价),但报价页是最不可信的信息源。可复现的比价方法:
- 只认调用日志:每个 API 响应的
usage字段里有 input / output / cache_read 三类 token 数,用你自己的充值流水除以它,算出实际有效单价; - 同题对照组:固定 100 个请求的基准任务集,同一天分别走官方价换算和中转渠道,对账单不看对宣传;
- 核缓存透传:问清(更好,是实测)中转是否按 Anthropic 原生缓存价透传——把缓存价「抹平」的中转会在 5.1 上悄悄吃掉 75% 的降价;
- 倍率要能验:靠谱供应商公布对官方价的倍率,且允许你用日志反推;报价低于官方缓存读价($0.25/M 还往下砸)的,优先怀疑降智/换模型。
中转为什么能便宜、价差从哪来,原理见 中转 Token 为什么便宜;选供应商的完整清单见 Claude 中转站评测 2026。
如何排查我们自己
按上面的方法对 TeamoRouter 同样适用:
- 用你账户的调用明细导出,自算
消费金额 ÷ usage token的有效单价,与官方价对照; - 跑同一组带
cache_control的基准请求,核对cache_read_input_tokens是否如实上报、缓存价是否按 $0.25 基准透传; - 对比不同渠道的输出 token 计数是否一致——输出数对不上就是最直接的「账单被动了手脚」信号。
数字会变,方法不会。任何渠道的价格都以你当天的日志为准。
月预算参考
按官方价 + 缓存命中良好的典型配置粗算(个人开发者,每天 4 小时 agent 编码,约 600 会话/月):
| 用量档 | 月账单量级 |
|---|---|
| 轻度(短上下文) | 约 $11–22 |
| 重度 agent(长上下文多步) | 约 $85–170 |
| 不配缓存的重度 | $150–300+(降价与你无关) |
这是官方价的算术,不是实测账单;经 TeamoRouter 等网关的阶梯折扣可再降,但请按上一节的方法自验。预算控制的核心仍是分层路由:难任务给 Fable 5.1,日常任务给便宜模型。
常见疑问
Q:Fable 5.1 比 Fable 5 便宜吗? 标价一样($10/$50),缓存读降 75%。缓存命中率高的工作量实际总成本降 25–45%;不配缓存则无变化。
Q:订阅划算还是 API 按量划算? 重度交互用户(Max 档能用满每周一半额度)订阅划算;程序化调用和用量波动的团队按量更灵活。可以订阅做日常、API 做自动化。
Q:为什么我的 Fable 5.1 账单没降?
大概率缓存没命中:system prompt 没加 cache_control,或者中转没透传原生缓存价。先查日志里的 cache_read_input_tokens。
Q:和 GPT-6 Astra 比,谁便宜? 列表价完全一样;Astra 缓存读 $1.00 是 Fable 5.1 的 4 倍,agent 场景 Fable 5.1 更省。完整对照见 Fable 5.1 vs GPT-6 Astra 怎么选。
总结
Fable 5.1 的价格故事就一句话:标价没动,缓存砍到 $0.25。把固定前缀做成可缓存、用日志核验每一家的实际单价,账单自然下来。注册 TeamoRouter 按量试用 claude-fable-5-1,并用本文的方法核我们一遍。