历史 Dig · 2026 年 7 月—8 月

AI 说“完成了”,我怎么在交付前确认?

AI 的完成说明只是一个提示。交付前,还要回到原文件、测试或目标页面,看结果是否真的发生、是不是将要交出去的那一份。

首次记录 · 最后一次公开修订 · 修订 4
交付前确认可打开的结果停止与回退

WORKFLOW 001 · 节点定位

当前节点 04共 7 个节点

回到结果核对是否完成

  1. 00主题契约 · 已整理
  2. 01入口 · 历史记录
  3. 02控制 · 历史记录
  4. 03运行边界 · 历史记录
  5. 04交付检查 · 历史记录
  6. 05恢复 · 历史记录
  7. 06编辑焦点 · 产品实验

它和 Workflow 001 的关系

与当前主题的关系

它不是第四个问题,而是三个问题共用的交付门槛。

工具跑在哪里、装了哪些扩展、几天后能否找回现场,最后都要落回同一个动作:亲自打开结果,确认它与原要求相符。旧 Dig 记录了这一步;Workflow 001 用它检查“任务完成”,Q01 用它看目标环境,Q02 用它看扩展是否真的改变结果,Q03 用它看恢复的是不是正确现场。

当时的记录状态

  • 工作与交付
  • 可核对的工作结果
  • 深入指南
  • 继续调查
  • 历史 E2 · 1 个社区个案 + 2 个方法参考 · 未做跨任务实测

当时的建议

当时的判断

先打开要交付的那一份,再决定是不是完成。

展开完整判断与退回规则
只挑一条最影响交付的完成说法,回到原文件、测试或目标页面核对:它是否真的发生、是否属于当前版本、出错时能否退回。任何一步看不到,就保留为“未确认”。
适合谁
已经用 AI 修改文档、网页或代码,并准备把结果交给同事、客户或真实环境的人
为什么当时值得看
展开说明

真正的风险不是总结写得不够漂亮,而是把候选结果误当成交付物,随后发送、发布、付款或合并。

这份判断到哪里为止
展开说明

这条历史 Dig 只有方法来源和一个已关闭的社区个案,没有 BitShovel 跨任务实测或独立用户复现。它不证明所有 AI 都会虚假完成,也不证明 DevHub 或任何工具有效。

读之前先对一下

是否适用

先确认你手上已经有一个可以亲自打开的交付物。

这条记录可能帮得上

  • 你手上已经有一份准备交付的文件、页面、代码改动或真实目标状态。
  • 你能先用只读方式打开原要求、当前结果和必要的测试或目标页面。

这些情况先不要照着做

  • 还没有具体交付物,只是在发散想法;此时先定义结果,不必套核验步骤。
  • 核对必须进入无授权的真实账号、敏感数据或不可撤销动作。
  • 你需要本站证明某个模型、Open Code Review 或 DevHub 的普遍可靠性——这条记录没有这种证据。

当时留下的检查办法 · 不是本站实测

当时的试法

未执行、未冻结的历史建议:只核一条最影响交付的完成说法。

大概用时
10–20 分钟
可能花费
通常不新增费用
权限边界
先只读;核验前不发送、发布、付款、删除或合并
  1. 01

    先做什么

    展开这一步

    从结果中挑一条会影响交付的关键说法,回到原文件、测试或目标页面核对。

  2. 02

    手里应该多出什么

    展开这一步

    一条简短记录,写清这条说法、依据、还缺什么和下一步。

  3. 03

    如果执行,怎样才算确认

    展开这一步

    你能亲自打开依据,并说清哪些已经确认、哪些还不知道。

  4. 04

    遇到什么就停

    展开这一步

    证据要求进入真实账号、敏感数据或不可撤销动作,而你没有授权。

  5. 05

    怎么恢复原状

    展开这一步

    保留原文件或分支;不通过就撤销改动,把未证实项退回待办。

项目方演示 · 非本站运行

方法与界面

终端可以显示意见落在哪一行,但不能替你证明意见正确。

展开方法边界

这一张 Open Code Review 固定版本终端图只展示审查输出怎样定位到文件和行号。它不是本站运行、正确性证明、第二人验收或项目方背书。

Open Code Review 固定版本终端演示项目方演示 · 非本站运行
Open Code Review 固定版本项目方终端演示,显示扫描五个文件、生成三条评论并把一条建议定位到文件和行号

这张固定来源的终端区域只说明审查意见可以定位到文件和行号;它不证明建议正确、工具已由本站运行或结果经过第二人验收。

图片来源与说明

Alibaba / Open Code Review contributors · Apache-2.0。BitShovel 从固定源图裁出完整终端区域并转为无元数据 WebP,未改写、隐藏、重排或翻译终端内容。项目方未参与、批准或背书 BitShovel。

打开来源页面查看使用与署名规范

依据和来源

依据和来源

截至 2026-08-15,可核对的是一个已关闭的社区个案和两种方法参考;没有失败率、跨任务实测或独立用户复现。

展开证据边界

2026-08-15 复核后,三条来源仍可打开:一条已关闭的用户报告、Git 的版本历史说明和 RTINGS 的公开测试方法。它们帮助定义防范与核对方式,不提供失败率或本站实测结果。

  1. 01
    已关闭的社区个案 · 来源复核

    一位 Codex 用户报告过声称完成但没有执行的情况

    展开来源边界

    该 issue 现已关闭,且专门描述报告者当时的 GPT-5.4 使用情况。它只用于选择需要防范的失败场景,不是 OpenAI 官方结论、独立复现或普遍失败率。

    打开原始来源
  2. 02
    官方方法说明 · 来源复核

    Git 用快照和提交保留可比较历史

    展开来源边界

    GitHub 文档支持回看、比较和恢复版本这一机制;Git 本身不证明 AI 输出正确。

    打开原始来源
  3. 03
    跨领域方法类比 · 来源复核

    RTINGS 公开标准测试、原始测量与复测方法

    展开来源边界

    这份一手说明帮助区分产品说法、测试结果和后续修订;本站没有把 RTINGS 方法跨任务复现为 AI 核验结果。

    打开原始来源

修订记录

修订记录

R2 到 R4 都保留:方法怎样收窄,视觉怎样改口,也不能静默消失。

展开 3 次修订
  1. 第 2 次

    把调查进度与依据充分程度分开,判断只看实际结果。

  2. 第 3 次

    补上可打开的实做笔记,帮助读者对照结果和检查步骤。

  3. 第 4 次

    撤下以营销大字为主的 Open Code Review 整页图,改用同一固定源图中可核对的终端审查区域。

    更正前的说法
    把带营销标题的完整项目页面当作主要视觉。
    更正后的判断
    只保留完整终端面板,并明确它是项目方演示,不是本站运行、正确性证明或第二人验收。

这条记录留下什么

这条记录留下什么

完成说明只能触发检查,不能替代检查。

当前 Workflow 继续用实际结果、目标环境、扩展成本和项目现场判断主工作流;这条历史记录只保留交付前最后一道共同门槛。

回到 Dig 索引