跳到主要内容

如何检查 Codex 的结果:验收与安全收尾

Codex 零基础路线 · 第 5 / 5 步

💡 一句话理解: Codex 显示“完成”,只代表这一轮执行结束;是否能真正使用,要由你检查文件和内容。

1. 用四个角度检查结果

1.1 范围:有没有碰不该碰的文件?

检查:

  • 是否只处理指定目录;
  • 是否只处理批准的文件;
  • 是否读取了无关资料;
  • 是否删除、移动或覆盖原文件;
  • 是否出现任务外操作。

1.2 数量:前后是否对得上?

例如:

原始文件:5 个
成功复制:4 个
待确认:1 个
失败:0 个

如果数字对不上,不要让 AI 用一句“可能漏掉了”带过。要求它列出具体文件名。

1.3 内容:事实有没有依据?

重点检查:

  • 产品参数有没有来源;
  • 型号有没有写错;
  • 是否把推测写成事实;
  • 是否漏掉重要字段;
  • 是否产生看起来专业但无法验证的内容。

对于认证、价格、交期、公司信息和客户信息,没有来源时必须标记为待核实。

1.4 操作记录:到底改了什么?

要求 Codex 给出:

请生成本轮交付报告,列出:

1. 读取的文件;
2. 新建的文件;
3. 修改的文件;
4. 复制或移动的文件;
5. 跳过的文件;
6. 失败项;
7. 仍需人工确认的内容。

不要只接受“已完成整理”这种无法核对的总结。

Windows Codex 的产品资料交付报告,报告列出读取、新建、修改、复制、跳过和待确认事项,并用橙色说明边界、绿色提示人工仍需复核

1.5 用两层证据验收

第一层是看 AI 的交付报告,第二层是离开聊天界面,打开文件资源管理器或访达独立检查。

AI 交付报告
→ 人工打开输出目录
→ 核对数量、名称、修改时间和原文件
→ 两边一致,才算本轮可接受

Windows 文件资源管理器中的样例输出目录,显示原文件副本和 sample.md 两个文件,用于独立核对文件数量、名称和修改时间

人工至少检查:

  • 输出文件数量和交付报告是否一致;
  • 文件名、所在目录和修改时间是否合理;
  • 原文件是否仍在原位置;
  • 是否出现任务之外的额外文件;
  • “待确认”内容有没有被写成正式事实;
  • 回收站中是否出现本轮资料。
AI 自报不是磁盘层证明

聊天中写着“没有修改”“没有删除”,只是 AI 对本轮操作的说明。它可以帮助你定位检查范围,但不能代替资源管理器、访达、Git 或 before / after 清单等独立证据。

截图说明

截图来自 Windows 11 已安装环境,通过 CC Switch 的“来发AI”配置完成单文件小样参考实测。资源管理器独立确认了 2 个输出文件与交付报告一致;由于本次没有生成完整的 before / after manifest,因此结论仍是窄范围参考,不是整台电脑“没有任何变化”的证明。

1.6 进阶验收:任务前后各做一份清单

当文件变多时,仅凭肉眼容易漏项。更严格的做法是在任务前后分别记录:相对路径、文件大小、修改时间和 SHA-256,再自动比较新增、修改、覆盖与删除。

文件差异检查公开教学图,列出一到四个输入的新增输出数量、同名不覆盖、原文件哈希不变和人工复核要求,并醒目标注真实 Codex 端到端仍未验证

这张公开教学图根据 2026 年 8 月 3 日的机器文件清单整理,不包含内部 run 或仓库版本标识。文件层观察结果是:1、2、3 个输入对应相同数量的新增输出;4 个输入只观察到 3 个新增输出;已有同名输出未覆盖;原始输入 SHA 没有变化。

图中的文件层结果不等于整条教程通过

完整 run 仍然是 partial:没有证明真实 Codex UI 触发了每一次写盘,没有中文逐 case 交互证据,也没有证明 01-原始资料 从未被读取或测试根目录外没有访问。正确读法是:文件差异这一层通过,端到端因果与读取边界仍待复测。

普通小白不必第一次就学会写 manifest 脚本,但要掌握底层原则:AI 的回答是一层证据,磁盘上的独立检查是另一层证据;风险越高,第二层就要越严格。

2. 发现错误后怎么改?

不要只说:

做得不对,重新做。

应该指出:

我检查后发现三处问题:

1. A100 的两张图片被放进了 B200;
2. README 中的产品用途没有资料来源;
3. 原文件不应该被重命名。

请先说明问题原因和准备修改的文件。
只修改这三处,不要重新处理其他已经确认的内容。
修改后重新输出变更清单。

核心是:

指出具体问题,缩小返工范围,再检查一次。

3. 哪些任务适合继续练习?

完成基础路线后,可以继续尝试:

  • 整理产品资料副本;
  • 汇总 Markdown、TXT 或少量 CSV;
  • 比较两个文档版本;
  • 生成文件清单;
  • 检查资料是否缺失;
  • 为网站文章准备草稿;
  • 将图片按已有规则复制分类;
  • 生成待确认问题清单。

仍然遵守:先小样、再确认、再扩大范围。

4. 哪些动作必须停下来确认?

文件高风险动作

  • 删除文件;
  • 覆盖原文件;
  • 批量移动或重命名;
  • 清理整个电脑;
  • 修改系统设置。

对外高风险动作

  • 发送邮件或消息;
  • 上传资料;
  • 发布网站;
  • 提交表单;
  • 创建、修改或删除业务数据。

账号和费用相关动作

  • 输入或修改 API Key;
  • 切换付费服务;
  • 充值;
  • 修改账号权限;
  • 执行可能产生费用的批量任务。

这些动作不能因为 AI “看起来很确定”就自动放行。

5. Codex 做错了怎么办?

按顺序处理:

  1. 立即停止当前任务,不要继续扩大范围;
  2. 查看交付报告和文件修改;
  3. 核对原始资料是否还在;
  4. 从副本或版本记录恢复;
  5. 找出是任务不清、范围太大还是执行错误;
  6. 缩小范围重新做小样;
  7. 不确定时先人工接管。

不要在结果不明时连续发送“再试一次”,否则可能重复修改。

6. 基础路线完成检查

如果下面内容都能做到,你已经完成 Codex 零基础入门:

  • 能从官方渠道安装并登录 Codex;
  • 能创建专用工作目录;
  • 不会一开始选择整个桌面或硬盘;
  • 能写清任务目标、范围、步骤和红线;
  • 会要求 AI 先盘点和复述;
  • 会先做少量小样;
  • 会检查范围、数量、内容和操作记录;
  • 知道删除、发送、上传和发布前必须确认;
  • 知道结果不确定时应该停止,而不是盲目重试。

7. 需要交流时怎样提问?

如果你卡在工作目录、任务单、结果验收或安全边界,可以扫码添加微信。加微信后发送 “Codex”,并附上:

  1. 你正在学习第几步;
  2. 你想完成什么任务;
  3. 卡住时看到的完整提示;
  4. 已经尝试过什么。

请先遮住账号、API Key、客户隐私和其他敏感信息,再发送截图。

来发信 AI 工具交流群微信二维码,用于添加微信并发送 Codex 申请入群交流工作目录、任务单与结果验收问题

8. 完成基础路线后怎么选?

你不需要按照固定编号继续学所有内容,可以根据真实工作选择。

只想继续处理文件和文档

回到 AI 工具学习路线,后续选择日常工作场景。

需要管理多套 API 配置

选修:CC Switch 安装与 Codex 配置指南

想学习客户开发或网站内容

来发信、AllinCMS 和 SEO 会作为独立进阶路线逐步增加,不会塞进基础必修课。

返回第 4 步:整理产品资料实战