模型 / 对比

Claude Opus 5.5 对比 Claude Fable 5.1

两者均提供 1M 上下文与 128K 输出。Opus 5.5 标准输入输出价格低 60%,最佳选择仍取决于任务质量。

核实于 2026-09-25 · 官方 API 规格与注明来源的评测

模型规格与标准 API 价格
规格 Claude Opus 5.5Claude Fable 5.1
上下文窗口1M1M
最大输出128K128K
输入 / 百万 token$4$10
输出 / 百万 token$20$50
缓存读取 / 百万 token$0.2$0.25
推理自适应、始终开启 · 默认 medium自适应、始终开启 · 默认 high

适合评估的场景 Claude Opus 5.5

评估编程与 Agent 工作负载的起点,token 单价低于 Opus 5 和 Fable 5.1。

评测设置不同于默认 medium 强度,请用自己的工作负载测量任务完成率与总 token 消耗。

标准 API 价格。批量输入输出降低 50%;fast 模式为 $8 / $40。缓存写入每百万 token 为 $5(5 分钟)或 $8(1 小时)。

官方规格

适合评估的场景 Claude Fable 5.1

如果特定任务在 Fable 上表现良好,值得继续纳入评估。

发布时的对照表不能证明任一模型在所有任务上领先,应同时比较成功率与成本。

每百万 token 的标准输入输出价格。缓存与服务档位请查官方计费文档。

官方规格

已报告的基准成绩

Anthropic 发布时的基准评测,2026 年 9 月 22 日
基准评测 Claude Opus 5.5Claude Fable 5.1
Terminal-Bench 4.0Opus 5.5:xhigh 强度66.4%55.8%
FrontierCode v1.1Opus 5.5:max 强度54.4%50.3%
CursorBench 4.0Opus 5.5:max 强度57.8%51.8%
GDPval-AA v2.1Opus 5.5:max 强度1846 Elo1735 Elo
AutomationBenchOpus 5.5:max 强度40%31.4%
Humanity's Last Exam使用工具 · Opus 5.5:max 强度67.7%65.6%

厂商于 2026 年 9 月 22 日报告的发布评测。Opus 5.5 除 Terminal-Bench 使用 xhigh 外均使用 max。其他模型的推理强度、框架与工具设置可能不同,请查看原始方法。这不是 AI IDE List 实测,也不同于 Anthropic 的 medium 强度成本图。

评测来源与方法

用与你相关的工作测试

使用相同任务、输入、工具和成功标准,记录模型版本、推理强度、总成本、延迟与人工修正。选择前重复测试,单个演示不能证明普遍领先。