# Codex 上下文与长任务预算运行手册

核验日期：2026-07-21

## 开始前

```md
### 最终目标

### 本轮只完成

### 明确不做

### 允许读取与修改范围

### 必须保留的用户改动

### 质量门禁

### 停止并升级条件

### 检查点频率
```

## 执行策略

1. 先做只读调查，把事实写入短摘要，不反复读取全仓库。
2. 将任务拆为可独立验证的阶段，每阶段只保留必要上下文。
3. 大段研究结果写入文档或结构化数据，不依赖聊天记忆。
4. 每个检查点记录 git 状态、已运行命令、失败和下一步。
5. 使用子代理时给出窄任务、独立文件范围与明确返回格式。
6. 工具输出过长时提取结论、文件和错误，不整段重复粘贴。
7. 发现范围扩大、破坏性操作或生产风险时停止并升级。

## 检查点

```md
### Checkpoint N
- 已完成：
- 证据：
- 新发现：
- 当前风险：
- 剩余范围：
- 下一步：
- 是否仍符合原目标：是 / 否
```

## 收尾

- [ ] 所有必须命令已完成且结果可复核。
- [ ] 未完成项、未验证项和已知问题分开记录。
- [ ] 没有仍在运行的必要进程。
- [ ] 交接摘要可以让新会话直接继续。

## 任务预算样例

```md
阶段 1 调查：只读，输出相关文件与风险，最多 30 分钟。
阶段 2 实施：只改指定模块，不改共享设计系统。
阶段 3 验证：运行相关测试和完整质量门禁。
阶段 4 收尾：阅读 diff、记录未验证项、生成交接。
```

## 常见失控信号

- 同一文件被重复读取却没有形成结论。
- 发现新问题后不断扩大范围，没有回到原目标。
- 为通过测试删除功能、跳过错误或伪造结果。
- 多个代理修改相同文件或共享分支。
- 生产命令、数据删除和密钥操作没有人工门槛。

出现任一信号时先暂停，把当前事实写入检查点，再决定缩小范围、拆分新任务或请求确认。

官方来源：

- https://learn.chatgpt.com/docs/codex/long-running-work
- https://learn.chatgpt.com/docs/codex/projects-and-chats
