Claude Opus 5.5
探索有来源的编程项目、3D 世界、研究流程与自主 Agent。
1M 上下文 · $4 输入 / $ 20 输出,每百万 token
探索模型AI IDE List / 模型
模型规格、有来源的项目和实用提示词。从 Claude Opus 5.5 开始,或比较编程工作流背后的模型。
探索有来源的编程项目、3D 世界、研究流程与自主 Agent。
1M 上下文 · $4 输入 / $ 20 输出,每百万 token
探索模型上一代 Opus,可作为迁移至 Opus 5.5 的评估基线。
1M 上下文 · $5 输入 / $ 25 输出,每百万 token
探索模型将 Fable 的容量、API 成本和报告结果与当前 Opus 比较。
1M 上下文 · $10 输入 / $ 50 输出,每百万 token
探索模型OpenAI 面向复杂推理、编程与电脑操作的模型,与 Claude 一起进行对比。
1.05M 上下文 · $10 输入 / $ 50 输出,每百万 token
探索模型| Model | Context | 最大输出 | Input | Output | 缓存读取 |
|---|---|---|---|---|---|
| Claude Opus 5.5Anthropic | 1M | 128K | $4 | $20 | $0.2 |
| Claude Opus 5Anthropic | 1M | 128K | $5 | $25 | $0.5 |
| Claude Fable 5.1Anthropic | 1M | 128K | $10 | $50 | $0.25 |
| GPT-6 AstraOpenAI | 1.05M | 128K | $10 | $50 | $1 |
标准价格单位为美元 / 百万 token。长上下文和批量价格可能不同,各模型页面附有官方计费条件。
| 基准评测 | Claude Opus 5.5 | Claude Opus 5 | Claude Fable 5.1 | GPT-6 Astra |
|---|---|---|---|---|
| Terminal-Bench 4.0Opus 5.5:xhigh 强度 | 66.4% | 52.3% | 55.8% | 57.9% |
| FrontierCode v1.1Opus 5.5:max 强度 | 54.4% | 48% | 50.3% | 53.3% |
| CursorBench 4.0Opus 5.5:max 强度 | 57.8% | 46.6% | 51.8% | 未报告 |
| GDPval-AA v2.1Opus 5.5:max 强度 | 1846 Elo | 1708 Elo | 1735 Elo | 1542 Elo |
| AutomationBenchOpus 5.5:max 强度 | 40% | 26.9% | 31.4% | 41.4% |
| Humanity's Last Exam使用工具 · Opus 5.5:max 强度 | 67.7% | 63.6% | 65.6% | 57.2% |
厂商于 2026 年 9 月 22 日报告的发布评测。Opus 5.5 除 Terminal-Bench 使用 xhigh 外均使用 max。其他模型的推理强度、框架与工具设置可能不同,请查看原始方法。这不是 AI IDE List 实测,也不同于 Anthropic 的 medium 强度成本图。
评测来源与方法API 资料核实于 2026-09-25。各模型页均链接官方规格与计费条件。