在 Claude Fable 5.1 和 Opus 5.5 之间,建议先把 Opus 5.5 作为日常默认模型,再用实际失败的任务决定是否保留 Fable 5.1。Anthropic 当前的选型文档也采用这一路径:复杂任务从 Opus 5.5 开始;在 xhigh 或 max 思考强度下仍达不到要求,再评估 Fable 5.1。这里的“要求”应该是代码能通过测试、报告结论有依据、文件交付可用,而不是回答更长。官方模型选择指南
价格支持这个起点,但不能替你完成判断。截至 2026 年 9 月 23 日,按 Claude 官方标准 API 单价,Opus 5.5 的普通输入和输出都比 Fable 5.1 低 60%;缓存读取只低 20%。实际任务还会产生不同的输出量、重试和工具费用,不能直接把单价差当成整单节省比例。官方价格表
本文依据当前官方文档和 Anthropic 公布的测试整理,没有进行本站付费实测。下面把可以直接比较的价格、需要保留设置的性能证据,以及你可以据此做出的选择分开说明。
先选谁:把 Fable 留给明确的能力缺口
| 你的主要工作 | 建议起点 | 何时值得改选 Fable 5.1 |
|---|---|---|
| 日常写代码、修 Bug、跨文件修改 | Opus 5.5,从默认思考强度开始 | 提高思考强度后仍反复漏掉关键约束,而 Fable 在同类任务中能稳定完成 |
| 搜集资料、比较方案、整理长报告 | Opus 5.5,检查来源与结论的对应关系 | 问题需要多轮推理和持续追踪证据,且 Fable 确实减少了漏项与人工返工 |
| 文档、表格、演示材料 | Opus 5.5,以交付文件是否可用为准 | Fable 能解决 Opus 反复出现的计算、结构或跨文件一致性问题 |
| 已经稳定运行的 Fable 长任务 | 先保留现有流程,另开任务测试 Opus 5.5 | Opus 达到原有验收标准后迁移;若出现质量回退,则保留 Fable |
这张表是基于官方选型方向给出的使用建议,并不是各类任务的实测胜率。关键区别在于:“任务很难”足以让你提高验收标准,却不足以直接证明 Fable 更适合。 Opus 5.5 本身也面向长时间运行的代码代理和知识工作。Opus 5.5 模型说明
例如,一份研究报告真正难的可能是同时保留十几项限制条件,而不是输入篇幅长。让两个模型使用同一批材料,检查是否遗漏限制、是否把推断写成事实,会比询问“哪个研究能力更强”更快得到你的答案。代码任务同理:把复现步骤、测试和允许修改的范围固定下来,才能判断额外开销是否换来了可用结果。
两者规格相近,默认思考强度不同
不要仅凭上下文长度判断谁更强。两者的标准上下文窗口都是 100 万 token,标准最大输出都是 12.8 万 token,均支持文本和图像输入、文本输出。主要使用差别之一是默认 effort:Opus 5.5 为 medium,Fable 5.1 为 high。官方相对延迟标签分别为 Moderate 和 Slower,但这不是同一任务下的秒数或提速保证。Opus 5.5 规格、Fable 5.1 规格
| 项目 | Opus 5.5 | Fable 5.1 |
|---|---|---|
| Claude API 模型 ID | claude-opus-5-5 | claude-fable-5-1 |
| 标准上下文窗口 | 100 万 token | 100 万 token |
| 标准最大输出 | 12.8 万 token | 12.8 万 token |
| 默认思考强度 | medium | high |
| 思考方式 | 始终启用自适应思考 | 始终启用自适应思考 |
规格来源为上述两份模型文档。Opus 5.5 另有 Batch API 的 30 万 token 输出测试功能,需启用 output-300k-2026-03-24;它不等于普通请求默认可以输出 30 万 token。
如果你要比较“直接拿来用”的效果,保留各自默认设置是合理的。如果你要决定某个困难任务是否必须交给 Fable,就应该先给 Opus 更高思考强度的机会。即使两边都写 high 或 max,也不能据此认定它们消耗了相同算力或费用。
价格差多少:普通输入输出省 60%,缓存读取省 20%
下表为截至 2026 年 9 月 23 日的 Claude 官方标准 API 价格,单位是美元/每 100 万 token。不含工具、税费、地域选项等额外费用,也不代表第三方平台报价或 Claude 订阅额度。官方价格表
| 计费项目 | Opus 5.5 | Fable 5.1 | Opus 相对降低 |
|---|---|---|---|
| 未命中缓存的普通输入 | $4 | $10 | 60% |
| 输出 | $20 | $50 | 60% |
| 5 分钟缓存写入 | $5 | $12.50 | 60% |
| 1 小时缓存写入 | $8 | $20 | 60% |
| 缓存读取 | $0.20 | $0.25 | 20% |
这里最容易混淆的是 Fable 5 与 Fable 5.1。旧版 Fable 5 的缓存读取价格是 $1/百万 token,5.1 已降到 $0.25,不能把旧价格套进本次比较。Fable 5.1 的缓存读取费率虽然只占自身普通输入价格的 2.5%,比 Opus 的 5% 更低,但绝对金额仍是 Opus 的 $0.20 更便宜。缓存计费说明

按相同用量算两笔账
以下是从上表单价推导的演算,不是实际账单。用量可视作一组请求的合计;两边采用相同计费数量,不假定模型完成同一任务时一定产生相同数量。
例一:100 万普通输入,加 10 万输出。
- Opus 5.5:
1 × 4 + 0.1 × 20 = $6。 - Fable 5.1:
1 × 10 + 0.1 × 50 = $15。
这笔演算确实相差 60%。但如果 Fable 用更少的尝试完成工作,或者 Opus 输出了更多内容,真实比例就会改变。
例二:10 万普通输入、90 万缓存读取,加 10 万输出。 假设缓存已创建,创建费不计入这组后续请求。
- Opus 5.5:
0.1 × 4 + 0.9 × 0.20 + 0.1 × 20 = $2.58。 - Fable 5.1:
0.1 × 10 + 0.9 × 0.25 + 0.1 × 50 = $6.225。
这一组合里 Opus 约便宜 58.55%。虽然大部分输入都来自缓存,输出仍占了主要费用,所以整组请求不会仅相差 20%。只有单独看 100 万缓存读取这一项,才是 $0.20 对 $0.25;它没有包含生成答案所需的其他费用。
由此可得一个实用判断:看账单中哪一项花钱最多,而不只是看缓存命中率。 如果输出和普通输入占主要费用,Opus 的价格优势更接近基础单价差;如果绝大部分费用确实来自缓存读取,两者差距才会明显缩小。还需要估算缓存生命周期时,可接着看 Fable 5.1 API 价格与缓存计费。
官方测试支持先试 Opus,但没有证明它全面取代 Fable
Anthropic 在 9 月 22 日发布的结果中,Opus 5.5 在 Terminal-Bench 4.0 为 66.4%,Fable 5.1 为 55.8%;GDPval-AA v2.1 则为 1846 对 1735 Elo。前者偏向终端中的多步骤任务,后者反映知识工作评估。Elo 不是正确率,不能把分差换算成“强了百分之几”。Opus 5.5 官方发布与测试说明
这些数字应连同设置一起读:Terminal-Bench 的 Opus 使用 xhigh,标准误差为 ±2.6 个百分点;发布表其余未特别标注的 Opus 结果使用 max 自适应思考。测试启用了生产安全措施,特定网络安全任务触发干预时由 Opus 4.8 接手,生物学及前沿大模型开发任务由 Opus 5 接手。因此,这组成绩也不是所有任务都由单一模型在无干预条件下完成的证明。Anthropic 自己同时指出,实际使用中两者差距比榜单显示的更小。测试口径与限制
对选型而言,这些证据足以支持“先试更便宜的 Opus”,不足以支持“所有 Fable 工作流都应立即迁移”。尤其不要用几项公开分数替代你的失败样本:修复遗漏的业务规则、复核财务口径、追踪矛盾来源,这些具体困难未必按榜单名次排序。
另外,发布页所说的“典型任务费用下降 40%”和“输出速度提升超过 30%”,比较对象是 Opus 5,不是 Fable 5.1。不能把它们拼成这两个模型之间的普遍成本或速度结论。发布页的成本与速度比较
怎么试出该不该换:看完成任务的总成本
最有价值的对照样本,是你最近做过、知道什么结果才算合格的工作。先挑能代表实际负担的任务,例如一个有回归测试的跨文件修复,或一份需要核对原始数据的报告;不用为了测试模型临时编一套脑筋急转弯。
- 固定输入与验收条件。 两边使用相同资料、工具权限和起始文件。代码看功能与回归测试;研究看事实、引用和遗漏;文档看计算与交付是否可用。
- 先比较默认设置。 记录是否合格、用时、计费量以及你花了多少时间纠正,不只记录第一条回答看起来是否聪明。
- 针对 Opus 的失败提高思考强度。 如果
xhigh或max已能解决问题,就比较增加思考后的费用和等待时间;仍失败时,再让 Fable 处理同一类任务。 - 只为稳定减少的返工支付溢价。 Fable 偶然成功一次值得继续观察;持续满足原来达不到的要求,才是保留它的实际理由。
可以把判断写成一句简单的账:每份合格交付的成本,等于为完成它产生的所有模型调用、工具费用,再加人工修正成本。这个方法能同时避免两种误判:因为 token 便宜就容忍大量返工,或因为单次答案漂亮就忽略长期费用。

切换时别沿用同一段对话做“公平比较”
如果使用 Claude Code,Opus 5.5 需要 2.1.280 或更新版本,可先执行 claude update。在你的账户和服务提供方支持对应模型的前提下,分别新开会话指定完整模型 ID,比仅用会随提供方变化的 opus 或 fable 别名更容易确认比较对象:Claude Code 模型配置
bash# 在同一项目、相同起始文件状态下,分别启动对照会话 claude --model claude-opus-5-5
另一轮独立对照使用:
bashclaude --model claude-fable-5-1
如果模型会修改文件,应先恢复同一基线或使用独立副本再跑另一轮,否则后运行的模型拿到的已经是不同任务。
对自行编排 Claude API 会话的开发者,还有一个方向性限制:Fable 5.1 可以读取 Opus 5.5 的思考块,Opus 5.5 不能读取 Fable 5.1 的思考块;不兼容块会被 API 忽略,而不一定报错。这不等于整段聊天文本被删除,但意味着在 Fable 长会话中途切到 Opus,再用表现判断模型高下,会掺入思考历史不可用的影响。保留思考与模型切换规则
普通 Claude 应用和 Claude Code 用户不需要手工改写思考块;让客户端管理请求即可。自建程序则应在独立会话中验证切换,并核对旧集成是否依赖强制工具调用等不兼容设置。两者都始终启用自适应思考,不能沿用关闭思考或 tool_choice: any/tool 的假设。Opus 5.5 兼容性说明
若你只是希望在 Claude 订阅中多用一些次数,也不要用本页 API 单价推算套餐额度。订阅限制与按 token 计费是不同问题,可查看 Opus 5.5 价格、使用限制与重置时间。
对于尚未有固定偏好的用户,先用 Opus 5.5 做真实工作即可;对于已经依赖 Fable 5.1 的用户,用已有验收标准测试迁移更稳妥。最终让 Fable 留下来的理由,应当是它解决了你确实遇到、并且值得为之多付费用的问题。



