模型可替换,Harness 负责让任务持续运行
选择入口和模型,观察变化发生在哪一层。
按项目管理线程、审阅修改,并组织并行任务;执行逻辑复用同一 Harness。
模型
Responses API · 推理与工具请求
执行环境
在授权范围内行动
- Shell命令与测试
- Git / Filesystem代码、文件与差异
- Browser页面与应用操作
- MCP外部工具与数据
截至 2026.09.10 已进入符合条件的 Codex 账户;CLI 需 0.153.0+。 更换模型会改变推理能力与速度,工具和权限仍由运行框架管理。
Codex 是一套 Agent 产品与运行系统。模型负责推理,Harness 组织上下文、执行工具并处理反馈,界面让你发起、跟进和审阅任务。
Agent Loop:执行、看结果、再决定
构建失败不是终点。工具返回的错误会成为模型下一次判断的输入。
- 任务与输入目标、约束与已有记录
- 构造上下文指令、相关文件与工具定义
- 模型判断回答用户,或提出工具调用
- 权限检查审批策略与可访问范围
- 执行工具命令、文件、浏览器或 MCP
- 结果与反馈输出回到模型,继续下一轮
- 交付结果说明改动与验证结果
记录目标:完成迁移,并验证构建。
上下文是工作记忆,线程是任务记录
模型每次接收可用上下文;客户端通过线程和事件展示持续发生的工作。
上下文压缩
容量示意读取文件、查看差异和运行测试,都会增加需要处理的内容。
比例仅解释过程,不代表实际 token 上限或压缩率。
压缩后,任务如何继续?
- 保留任务方向当前目标、关键决定与待解决问题需要被带入下一段工作。
- 缩减历史负担长日志和中间过程不必每轮都以原始形式重复传入。
- 必要时重新读取压缩并非无损存档,精确代码和最新状态仍应回到文件或工具中确认。
Responses API 支持返回不透明的压缩状态项,用更少的 token 传递先前状态。它不等于页面上这份可读摘要。
Thread → Turn → Item
- 用户消息
- 工具执行与输出
- 代码差异
- Agent 消息
- 新的用户消息
- 工具执行与验证
- Agent 消息
Thread 容纳多个 Turn;每个 Turn 包含一系列 Item。持久化历史让客户端能够重连、继续或分叉会话。
模型实际接收什么?
instructions系统与开发者指令、任务约束tools可用工具的定义与参数input用户消息、项目上下文、工具调用与输出AGENTS.md 提供项目规则,例如测试命令、代码约定和目录说明。它会影响任务上下文。
API Key 模式通过 Responses API 调用模型;ChatGPT 登录使用相应的 Codex 后端。具体请求由所选 provider 和客户端配置决定。
审批决定是否询问,沙盒限制能够做什么
模型提出工具请求后,还需要经过执行策略和环境约束。
扩展系统:连接工具,也传递工作方法
MCP
通过标准协议连接外部工具和数据源,例如代码托管、数据库或业务系统。
Skills
将操作说明、资源和脚本组织成可复用的工作方法,按任务需要加载。
Plugins
组合相关应用、Skills 与工具集成,为一类岗位或流程提供完整配置。
从 TypeScript 原型,到 Rust Runtime
原生执行、终端交互、状态管理和系统隔离共同构成 CLI 的工程基础。
TypeScript + Ink
用 React 生态快速构建和迭代终端界面,当时需要 Node.js 22+。
Rust + Ratatui
转向独立可执行文件、原生安全绑定、较低内存开销和可扩展协议。
运行核心
Rust · TokioAgent 状态、异步任务与进程协调。
core / exec终端界面
Ratatui · Crossterm · Clap绘制终端界面,处理键盘输入与命令行参数。
tui / cli模型通信
Reqwest · Rustls · WebSocket发送请求、建立安全连接、接收流式响应。
http-client / backend-client客户端协议
Serde · JSON-RPC · JSONL将客户端请求和运行事件转换为结构化消息。
app-server / app-server-protocol配置与状态
TOML · SQLite · SQLx读取配置并持久化部分本地状态;线程历史另有存储机制。
config / history / rollout工具与终端
rmcp · portable-pty · Tree-sitter连接外部工具、控制终端子进程、解析命令结构。
rmcp-client / utils/pty可观测性
tracing · OpenTelemetry记录运行事件,帮助诊断调用和执行问题。
otel系统隔离
Seatbelt · bubblewrap · seccomp按平台与策略约束工具执行;Linux 仍有兼容的 Landlock 路径。
core / linux-sandbox技术项来自 Rust workspace 和 Core 文档。上面的迁移目标是团队当时的工程说明,并非性能基准;依赖与模块划分会随版本变化。
Codex 发展时间线
从 Copilot 背后的代码模型,到能够调用工具、执行任务的 Agent 系统。
19 个历史节点
- 模型
GPT-6 Astra 进入 Codex
截至 9 月 10 日,官方帮助文档确认 Astra 可用于符合条件的 Codex 账户,CLI 需要 0.153.0 或更新版本。可用性受套餐和工作区权限影响。
OpenAI Help Center · 原始资料模型继续迭代,工具与任务运行框架仍由 Codex 提供。
- 模型
GPT-5.6:Sol、Terra、Luna
Sol 面向复杂工作,Terra 平衡能力、速度与成本,Luna 面向更快、成本更低的任务。编程、研究和电脑操作进入同一模型系列。
OpenAI · 原始资料按任务选择模型,而不再只区分普通 GPT 与代码模型。
- 产品
Plugins、Sites 与知识工作
推出面向不同岗位的插件、可分享的 Sites 预览和结果批注。分析、设计、研究等工作开始成为明确的产品场景。
OpenAI · 原始资料交付物从代码扩展到报告、图表和可交互页面。
- 产品
Codex 可以操作电脑和应用
桌面应用加入后台电脑操作、内置浏览器、图片生成、记忆预览和更多插件,同时扩展自动化与 SSH 开发环境支持。
OpenAI · 原始资料任务可以跨越代码库、浏览器与桌面应用。
- 模型
GPT-5.4:编程与通用能力合流
主线 GPT 模型吸收 GPT-5.3-Codex 的编程能力,并加强电脑操作和知识工作。
OpenAI · 原始资料Codex 作为 Agent 产品,与具体模型名称进一步分离。
- 模型
Codex-Spark:实时编程路线
基于 Cerebras 硬件推出研究预览。发布时为纯文本、128K 上下文,官方报告生成速度超过 1,000 tokens/s。
OpenAI · 原始资料除长任务外,增加低延迟、快速来回修改的工作方式。
- 模型
GPT-5.3-Codex:编程与推理结合
结合 GPT-5.2-Codex 的编程能力与 GPT-5.2 的推理、专业知识,支持包含研究、工具使用和复杂执行的长任务。
OpenAI · 原始资料一次任务中的分析与实现可以由同一模型衔接。
- 工程
OpenAI 公开 App Server 架构
官方拆解共享 Harness、双向 JSON-RPC 协议与 Thread / Turn / Item 数据模型,说明本地客户端和云端如何接入同一核心。
OpenAI · 原始资料不同界面可以复用执行逻辑与任务事件。
- 产品
Codex App:管理并行任务
首先推出 macOS 应用,以项目和独立线程组织多个 Agent,提供 worktree、修改审阅、Skills 和自动化入口。
OpenAI · 原始资料从终端中的单次协作,扩展到多个任务的管理。
- 模型
GPT-5.2-Codex:长任务与上下文压缩
加强上下文压缩、可靠工具调用、大规模重构和迁移,并改善 Windows 工作表现。
OpenAI · 原始资料重点从生成一个函数,转向持续完成代码库中的复杂任务。
- 产品
- 模型
GPT-5-Codex:面向 Agent 的编程模型
针对真实软件工程任务优化,覆盖交互修改、独立长任务与代码审阅,并用于 CLI、IDE 和云端体验。
OpenAI · 原始资料训练目标更贴近读取、修改、测试真实项目的过程。
- 工程
Codex CLI 宣布改用 Rust
早期 TypeScript 与 React Ink 实现开始向 Rust 迁移,目标包括独立安装、原生安全绑定、减少内存开销和可扩展协议。
OpenAI · GitHub · 原始资料CLI 的工程重心转向原生 Agent Runtime。
- 产品
云端 Codex 与 codex-1
任务在预装代码库的隔离云端环境中运行,可读写文件、执行测试和提出 PR。codex-1 是针对软件工程优化的 o3 版本。
OpenAI · 原始资料开发者可以异步交办整项代码工作。
- 产品
Codex CLI:品牌以 Agent 形态回归
随 o3、o4-mini 发布开源终端 Agent,将模型推理与本地代码、命令执行连接起来。
OpenAI · 原始资料输入目标,Agent 可以检查项目、修改代码并验证结果。
- 模型
第一代 Codex API 模型停用
code-davinci-001/002 与 code-cushman-001/002 退出 API。这里指旧代码模型,与 2025 年后的 Codex Agent 产品不同。
OpenAI Docs · 原始资料第一代代码补全 API 结束,后来的 Codex 复用了这个名称。
- 产品
- 模型
Codex 论文与 HumanEval
论文研究在公开 GitHub 代码上微调的 GPT 模型,并发布 HumanEval。论文中的 Codex 在该评测上取得 28.8% 的 pass@1。
OpenAI · arXiv · 原始资料用可执行测试衡量生成程序是否正确。
- 产品
GitHub Copilot 技术预览
GitHub 发布由 OpenAI Codex 驱动的 Copilot 技术预览,将代码建议带进编辑器。
GitHub · 原始资料许多开发者第一次在 IDE 中使用 Codex。
2021 的基本单位一段代码
现代 Codex 的工作单位一个任务
资料来源
历史节点引用发布时资料;架构和模型可用性核对至 2026 年 9 月 10 日。