AI IDE List / 模型

找到模型,看看它能做什么。

模型规格、有来源的项目和实用提示词。从 Claude Opus 5.5 开始,或比较编程工作流背后的模型。

Anthropic14 个案例

Claude Opus 5.5

探索有来源的编程项目、3D 世界、研究流程与自主 Agent。

1M 上下文 · $4 输入 / $ 20 输出,每百万 token

探索模型
Anthropic

Claude Opus 5

上一代 Opus,可作为迁移至 Opus 5.5 的评估基线。

1M 上下文 · $5 输入 / $ 25 输出,每百万 token

探索模型
Anthropic

Claude Fable 5.1

将 Fable 的容量、API 成本和报告结果与当前 Opus 比较。

1M 上下文 · $10 输入 / $ 50 输出,每百万 token

探索模型
OpenAI

GPT-6 Astra

OpenAI 面向复杂推理、编程与电脑操作的模型,与 Claude 一起进行对比。

1.05M 上下文 · $10 输入 / $ 50 输出,每百万 token

探索模型

规格与 API 价格

上下文、输出上限与每百万 token 的标准 API 价格
ModelContext最大输出InputOutput缓存读取
Claude Opus 5.5Anthropic1M128K$4$20$0.2
Claude Opus 5Anthropic1M128K$5$25$0.5
Claude Fable 5.1Anthropic1M128K$10$50$0.25
GPT-6 AstraOpenAI1.05M128K$10$50$1

标准价格单位为美元 / 百万 token。长上下文和批量价格可能不同,各模型页面附有官方计费条件。

发布评测

Anthropic 发布时的基准评测,2026 年 9 月 22 日
基准评测 Claude Opus 5.5Claude Opus 5Claude Fable 5.1GPT-6 Astra
Terminal-Bench 4.0Opus 5.5:xhigh 强度66.4%52.3%55.8%57.9%
FrontierCode v1.1Opus 5.5:max 强度54.4%48%50.3%53.3%
CursorBench 4.0Opus 5.5:max 强度57.8%46.6%51.8%未报告
GDPval-AA v2.1Opus 5.5:max 强度1846 Elo1708 Elo1735 Elo1542 Elo
AutomationBenchOpus 5.5:max 强度40%26.9%31.4%41.4%
Humanity's Last Exam使用工具 · Opus 5.5:max 强度67.7%63.6%65.6%57.2%

厂商于 2026 年 9 月 22 日报告的发布评测。Opus 5.5 除 Terminal-Bench 使用 xhigh 外均使用 max。其他模型的推理强度、框架与工具设置可能不同,请查看原始方法。这不是 AI IDE List 实测,也不同于 Anthropic 的 medium 强度成本图。

评测来源与方法

模型对比

API 资料核实于 2026-09-25。各模型页均链接官方规格与计费条件。