跳转到主要内容

Claude Fable 5.1 和 Opus 5.5 怎么选?性能、价格与切换建议

14 分钟阅读AI 模型对比

多数代码、研究和文档任务先用 Opus 5.5;Fable 5.1 留给提高思考强度后仍做不好的任务。对比当前价格、缓存费用、官方测试与会话切换限制。

Claude Opus 5.5 与 Fable 5.1 的代码、研究和文档任务选型示意

在 Claude Fable 5.1 和 Opus 5.5 之间,建议先把 Opus 5.5 作为日常默认模型,再用实际失败的任务决定是否保留 Fable 5.1。Anthropic 当前的选型文档也采用这一路径:复杂任务从 Opus 5.5 开始;在 xhighmax 思考强度下仍达不到要求,再评估 Fable 5.1。这里的“要求”应该是代码能通过测试、报告结论有依据、文件交付可用,而不是回答更长。官方模型选择指南

价格支持这个起点,但不能替你完成判断。截至 2026 年 9 月 23 日,按 Claude 官方标准 API 单价,Opus 5.5 的普通输入和输出都比 Fable 5.1 低 60%;缓存读取只低 20%。实际任务还会产生不同的输出量、重试和工具费用,不能直接把单价差当成整单节省比例。官方价格表

本文依据当前官方文档和 Anthropic 公布的测试整理,没有进行本站付费实测。下面把可以直接比较的价格、需要保留设置的性能证据,以及你可以据此做出的选择分开说明。

先选谁:把 Fable 留给明确的能力缺口

你的主要工作建议起点何时值得改选 Fable 5.1
日常写代码、修 Bug、跨文件修改Opus 5.5,从默认思考强度开始提高思考强度后仍反复漏掉关键约束,而 Fable 在同类任务中能稳定完成
搜集资料、比较方案、整理长报告Opus 5.5,检查来源与结论的对应关系问题需要多轮推理和持续追踪证据,且 Fable 确实减少了漏项与人工返工
文档、表格、演示材料Opus 5.5,以交付文件是否可用为准Fable 能解决 Opus 反复出现的计算、结构或跨文件一致性问题
已经稳定运行的 Fable 长任务先保留现有流程,另开任务测试 Opus 5.5Opus 达到原有验收标准后迁移;若出现质量回退,则保留 Fable

这张表是基于官方选型方向给出的使用建议,并不是各类任务的实测胜率。关键区别在于:“任务很难”足以让你提高验收标准,却不足以直接证明 Fable 更适合。 Opus 5.5 本身也面向长时间运行的代码代理和知识工作。Opus 5.5 模型说明

例如,一份研究报告真正难的可能是同时保留十几项限制条件,而不是输入篇幅长。让两个模型使用同一批材料,检查是否遗漏限制、是否把推断写成事实,会比询问“哪个研究能力更强”更快得到你的答案。代码任务同理:把复现步骤、测试和允许修改的范围固定下来,才能判断额外开销是否换来了可用结果。

两者规格相近,默认思考强度不同

不要仅凭上下文长度判断谁更强。两者的标准上下文窗口都是 100 万 token,标准最大输出都是 12.8 万 token,均支持文本和图像输入、文本输出。主要使用差别之一是默认 effort:Opus 5.5 为 medium,Fable 5.1 为 high。官方相对延迟标签分别为 Moderate 和 Slower,但这不是同一任务下的秒数或提速保证。Opus 5.5 规格Fable 5.1 规格

项目Opus 5.5Fable 5.1
Claude API 模型 IDclaude-opus-5-5claude-fable-5-1
标准上下文窗口100 万 token100 万 token
标准最大输出12.8 万 token12.8 万 token
默认思考强度mediumhigh
思考方式始终启用自适应思考始终启用自适应思考

规格来源为上述两份模型文档。Opus 5.5 另有 Batch API 的 30 万 token 输出测试功能,需启用 output-300k-2026-03-24;它不等于普通请求默认可以输出 30 万 token。

如果你要比较“直接拿来用”的效果,保留各自默认设置是合理的。如果你要决定某个困难任务是否必须交给 Fable,就应该先给 Opus 更高思考强度的机会。即使两边都写 highmax,也不能据此认定它们消耗了相同算力或费用。

价格差多少:普通输入输出省 60%,缓存读取省 20%

下表为截至 2026 年 9 月 23 日的 Claude 官方标准 API 价格,单位是美元/每 100 万 token。不含工具、税费、地域选项等额外费用,也不代表第三方平台报价或 Claude 订阅额度。官方价格表

计费项目Opus 5.5Fable 5.1Opus 相对降低
未命中缓存的普通输入$4$1060%
输出$20$5060%
5 分钟缓存写入$5$12.5060%
1 小时缓存写入$8$2060%
缓存读取$0.20$0.2520%

这里最容易混淆的是 Fable 5 与 Fable 5.1。旧版 Fable 5 的缓存读取价格是 $1/百万 token,5.1 已降到 $0.25,不能把旧价格套进本次比较。Fable 5.1 的缓存读取费率虽然只占自身普通输入价格的 2.5%,比 Opus 的 5% 更低,但绝对金额仍是 Opus 的 $0.20 更便宜。缓存计费说明

Opus 5.5 与 Fable 5.1 的普通输入、输出和缓存读取单价对比

按相同用量算两笔账

以下是从上表单价推导的演算,不是实际账单。用量可视作一组请求的合计;两边采用相同计费数量,不假定模型完成同一任务时一定产生相同数量。

例一:100 万普通输入,加 10 万输出。

  • Opus 5.5:1 × 4 + 0.1 × 20 = $6
  • Fable 5.1:1 × 10 + 0.1 × 50 = $15

这笔演算确实相差 60%。但如果 Fable 用更少的尝试完成工作,或者 Opus 输出了更多内容,真实比例就会改变。

例二:10 万普通输入、90 万缓存读取,加 10 万输出。 假设缓存已创建,创建费不计入这组后续请求。

  • Opus 5.5:0.1 × 4 + 0.9 × 0.20 + 0.1 × 20 = $2.58
  • Fable 5.1:0.1 × 10 + 0.9 × 0.25 + 0.1 × 50 = $6.225

这一组合里 Opus 约便宜 58.55%。虽然大部分输入都来自缓存,输出仍占了主要费用,所以整组请求不会仅相差 20%。只有单独看 100 万缓存读取这一项,才是 $0.20 对 $0.25;它没有包含生成答案所需的其他费用。

由此可得一个实用判断:看账单中哪一项花钱最多,而不只是看缓存命中率。 如果输出和普通输入占主要费用,Opus 的价格优势更接近基础单价差;如果绝大部分费用确实来自缓存读取,两者差距才会明显缩小。还需要估算缓存生命周期时,可接着看 Fable 5.1 API 价格与缓存计费

官方测试支持先试 Opus,但没有证明它全面取代 Fable

Anthropic 在 9 月 22 日发布的结果中,Opus 5.5 在 Terminal-Bench 4.0 为 66.4%,Fable 5.1 为 55.8%;GDPval-AA v2.1 则为 1846 对 1735 Elo。前者偏向终端中的多步骤任务,后者反映知识工作评估。Elo 不是正确率,不能把分差换算成“强了百分之几”。Opus 5.5 官方发布与测试说明

这些数字应连同设置一起读:Terminal-Bench 的 Opus 使用 xhigh,标准误差为 ±2.6 个百分点;发布表其余未特别标注的 Opus 结果使用 max 自适应思考。测试启用了生产安全措施,特定网络安全任务触发干预时由 Opus 4.8 接手,生物学及前沿大模型开发任务由 Opus 5 接手。因此,这组成绩也不是所有任务都由单一模型在无干预条件下完成的证明。Anthropic 自己同时指出,实际使用中两者差距比榜单显示的更小。测试口径与限制

对选型而言,这些证据足以支持“先试更便宜的 Opus”,不足以支持“所有 Fable 工作流都应立即迁移”。尤其不要用几项公开分数替代你的失败样本:修复遗漏的业务规则、复核财务口径、追踪矛盾来源,这些具体困难未必按榜单名次排序。

另外,发布页所说的“典型任务费用下降 40%”和“输出速度提升超过 30%”,比较对象是 Opus 5,不是 Fable 5.1。不能把它们拼成这两个模型之间的普遍成本或速度结论。发布页的成本与速度比较

怎么试出该不该换:看完成任务的总成本

最有价值的对照样本,是你最近做过、知道什么结果才算合格的工作。先挑能代表实际负担的任务,例如一个有回归测试的跨文件修复,或一份需要核对原始数据的报告;不用为了测试模型临时编一套脑筋急转弯。

  1. 固定输入与验收条件。 两边使用相同资料、工具权限和起始文件。代码看功能与回归测试;研究看事实、引用和遗漏;文档看计算与交付是否可用。
  2. 先比较默认设置。 记录是否合格、用时、计费量以及你花了多少时间纠正,不只记录第一条回答看起来是否聪明。
  3. 针对 Opus 的失败提高思考强度。 如果 xhighmax 已能解决问题,就比较增加思考后的费用和等待时间;仍失败时,再让 Fable 处理同一类任务。
  4. 只为稳定减少的返工支付溢价。 Fable 偶然成功一次值得继续观察;持续满足原来达不到的要求,才是保留它的实际理由。

可以把判断写成一句简单的账:每份合格交付的成本,等于为完成它产生的所有模型调用、工具费用,再加人工修正成本。这个方法能同时避免两种误判:因为 token 便宜就容忍大量返工,或因为单次答案漂亮就忽略长期费用。

以任务验收为依据,从 Opus 默认设置到提高思考强度,再评估 Fable 的选择流程

切换时别沿用同一段对话做“公平比较”

如果使用 Claude Code,Opus 5.5 需要 2.1.280 或更新版本,可先执行 claude update。在你的账户和服务提供方支持对应模型的前提下,分别新开会话指定完整模型 ID,比仅用会随提供方变化的 opusfable 别名更容易确认比较对象:Claude Code 模型配置

bash
# 在同一项目、相同起始文件状态下,分别启动对照会话 claude --model claude-opus-5-5

另一轮独立对照使用:

bash
claude --model claude-fable-5-1

如果模型会修改文件,应先恢复同一基线或使用独立副本再跑另一轮,否则后运行的模型拿到的已经是不同任务。

对自行编排 Claude API 会话的开发者,还有一个方向性限制:Fable 5.1 可以读取 Opus 5.5 的思考块,Opus 5.5 不能读取 Fable 5.1 的思考块;不兼容块会被 API 忽略,而不一定报错。这不等于整段聊天文本被删除,但意味着在 Fable 长会话中途切到 Opus,再用表现判断模型高下,会掺入思考历史不可用的影响。保留思考与模型切换规则

普通 Claude 应用和 Claude Code 用户不需要手工改写思考块;让客户端管理请求即可。自建程序则应在独立会话中验证切换,并核对旧集成是否依赖强制工具调用等不兼容设置。两者都始终启用自适应思考,不能沿用关闭思考或 tool_choice: any/tool 的假设。Opus 5.5 兼容性说明

若你只是希望在 Claude 订阅中多用一些次数,也不要用本页 API 单价推算套餐额度。订阅限制与按 token 计费是不同问题,可查看 Opus 5.5 价格、使用限制与重置时间

对于尚未有固定偏好的用户,先用 Opus 5.5 做真实工作即可;对于已经依赖 Fable 5.1 的用户,用已有验收标准测试迁移更稳妥。最终让 Fable 留下来的理由,应当是它解决了你确实遇到、并且值得为之多付费用的问题。

#Claude#Fable 5.1#Opus 5.5#模型选型
分享文章: