Claude Fable 5 的 API 成本如何计算?

作者:袖梨 2026-09-12

Claude Fable 5 的基础 API 成本按输入 token 和输出 token 分开计算:输入每百万 token 10 美元,输出每百万 token 50 美元。单次请求的基础公式是“输入 token ÷ 1,000,000 × 10,加上输出 token ÷ 1,000,000 × 50”。使用提示缓存、Batch API、特定地域推理或工具后,还要分别加入对应费用。

先确认模型版本和计费入口

本文计算的是 Claude API 中的 Claude Fable 5,模型标识为 claude-fable-5。Claude 网页、桌面端和 Claude Code 订阅中的 usage credits 虽然参考标准 API 费率,但账户最终扣款应以 Usage 页面为准。

Fable 5.1 的基础输入和输出价格与 Fable 5 相同,但缓存读取价格不同。做成本表时必须把模型版本单独记录,不能仅写“Fable”。

基础成本公式

input_cost = input_tokens / 1_000_000 * 10
output_cost = output_tokens / 1_000_000 * 50
total_cost = input_cost + output_cost

例如,一次请求使用 100,000 个普通输入 token,并生成 10,000 个输出 token,输入成本为 1 美元,输出成本为 0.5 美元,总计 1.5 美元。

输出单价是输入的五倍,因此限制无必要的长回答通常比只压缩少量提示词更有效。不过长对话会反复携带历史消息,输入成本也可能快速累积。

从 API 响应读取实际用量

不要用字符数或文件大小直接估算。应读取每次 Messages API 响应中的 usage 对象,至少记录 input_tokens 和 output_tokens;启用缓存时还要记录 cache_creation_input_tokens 与 cache_read_input_tokens。

{
  "usage": {
    "input_tokens": 100000,
    "cache_creation_input_tokens": 0,
    "cache_read_input_tokens": 0,
    "output_tokens": 10000
  }
}

实际响应字段可能随功能变化,计费程序应保留原始 usage 数据,而不是只保存最终金额。这样价格调整后仍能重新核算。

提示缓存如何计费

Fable 5 的普通输入为每百万 token 10 美元;创建 5 分钟缓存按 12.50 美元计费,创建 1 小时缓存按 20 美元计费,缓存命中或刷新按 1 美元计费。缓存写入比普通输入更贵,但后续重复读取明显更便宜。

cache_cost = cache_creation_5m_tokens / 1_000_000 * 12.5
           + cache_creation_1h_tokens / 1_000_000 * 20
           + cache_read_tokens / 1_000_000 * 1

若 100,000 token 的稳定前缀首次写入 5 分钟缓存,成本为 1.25 美元;下一次完整命中时读取成本为 0.10 美元。缓存只有在相同前缀被再次使用时才有收益。

Fable 5.1 的缓存读取差异

Fable 5.1 的 5 分钟和 1 小时缓存写入价格仍分别为 12.50 和 20 美元每百万 token,但缓存读取为 0.25 美元每百万 token,是 Fable 5 读取价格的四分之一。

如果应用从 Fable 5 升级到 Fable 5.1,基础公式不变,但必须更新 cache_read_input_tokens 的单价,否则会高估大量长会话和代理循环的成本。

完整的单次请求计算

total = input_tokens / 1_000_000 * input_rate
      + cache_creation_5m_tokens / 1_000_000 * cache_5m_rate
      + cache_creation_1h_tokens / 1_000_000 * cache_1h_rate
      + cache_read_tokens / 1_000_000 * cache_read_rate
      + output_tokens / 1_000_000 * output_rate
      + tool_charges

不同 token 分类不应重复相加。例如已经计入 cache_read_input_tokens 的部分不能再次当作普通 input_tokens 计费。应以官方 usage 定义和明细为准。

Batch API 如何影响成本

适合异步处理的任务可以使用 Batch API,Fable 5 的 Batch 输入为每百万 token 5 美元,输出为每百万 token 25 美元,相当于标准输入和输出价格的 50%。

前面的 100,000 输入加 10,000 输出示例,若全部符合 Batch 计费条件,成本为 0.5 加 0.25,共 0.75 美元。Batch 适合无需即时返回的大规模评测、分类和离线生成,不适合交互式对话。

地域推理倍率

在支持的平台上指定 US-only inference 时,Claude 4.6 及后续模型的所有 token 价格类别会乘以 1.1,包括普通输入、输出、缓存写入和缓存读取。

regional_total = token_cost * 1.1 + unaffected_tool_charges

倍率应作用于官方明确覆盖的 token 项,不要未经核验地把所有第三方平台费用也一并乘算。Bedrock、Vertex AI 或 Microsoft Foundry 的最终价格还应查看对应云平台。

思考 token 也会产生费用

Fable 5 使用始终开启的自适应思考。思考 token 按输出 token 计费,即使默认响应没有把完整思考文本返回给应用,也不能只按可见文字长度估算输出成本。

控制成本时应使用模型支持的 effort 设置,并以 response usage 为最终依据。简单地统计 text 内容长度会漏掉不可见但已计费的推理消耗。

工具和搜索费用要单独加入

网页搜索、代码执行或其他服务器工具可能有独立计费单位,工具结果还会作为上下文产生 token。完整成本等于模型 token 费用加工具调用费用,不能只看输入与输出两项。

代理任务应按整个运行汇总所有轮次。一次用户操作可能触发多次模型请求、工具调用和重试,只计算最后一条响应会严重低估成本。

回退模型怎样计费

Fable 安全分类器在生成前拦截请求并切换到 Opus 时,只按 Opus 阶段计费;如果在生成中途触发,则已完成的 Fable 输入和输出按 Fable 费率,后续部分按实际回退模型费率。

成本日志应同时保存 requested_model、served_model 和回退发生阶段。仅根据请求参数中的模型名计算,会在回退场景中得到错误结果。

用 Python 汇总基础费用

def fable5_cost(usage):
    return (
        usage.get("input_tokens", 0) * 10
        + usage.get("cache_creation_5m_input_tokens", 0) * 12.5
        + usage.get("cache_creation_1h_input_tokens", 0) * 20
        + usage.get("cache_read_input_tokens", 0) * 1
        + usage.get("output_tokens", 0) * 50
    ) / 1_000_000

这段代码展示价格乘算逻辑,不代表所有 SDK 都使用相同的细分缓存字段。接入时先打印真实响应结构,再按当前 SDK 和官方文档映射字段。

如何估算整月预算

先采集一至两周代表性任务,按请求记录 token 类别、工具费用、重试和回退。然后按任务类型计算中位数和较高分位成本,再乘以预计月度任务量。不要只用一次最短请求外推整月。

预算还应保留峰值余量,并设置月度消费上限和告警。对于能延迟处理的任务优先评估 Batch,对重复长前缀评估缓存,对普通任务评估更低成本模型。

FAQ

100 万 token 是否等于一次请求的固定价格?

不是。输入和输出分别计价,缓存、工具、地域和 Batch 也会改变单价;一次请求可能包含多个计费类别。

订阅 usage credits 能直接按同一公式预测吗?

可以用标准 API 费率作参考,但实际余额扣减和促销应以 Claude Usage 页面为准。API 与个人订阅相互独立。

为什么可见回答很短,费用仍可能较高?

请求可能包含长历史、项目文件、工具结果和不可见的思考 token。应检查完整 usage 数据,而不是只看屏幕上的文本。

总结

计算 Fable 5 API 成本要从真实 usage 字段出发,分别乘以普通输入、缓存写入、缓存读取和输出费率,再加入工具费与适用倍率。基础输入为每百万 token 10 美元,输出为 50 美元;缓存和 Batch 必须单独计算,Fable 5.1 的缓存读取价也不能与 Fable 5 混用。

相关文章

精彩推荐