← 首页
痛点专题 · 03
人与AI协作
方法 →
WHY YOU NEVER VERIFY

为什么做完了
不等于做对了?

AI 自信地说「搞定了」,你欢天喜地拿去用——
然后发现一堆问题。不是它故意坑你,是你跳过了最后一步:验证
下面这个实验你可以亲手点一下——一眼看出差别。
这些场景,你是不是很熟?
于是很多人得出结论:"AI 做的东西不能直接信任"
但真相常常是——AI 最擅长生成,最不擅长自我纠错。你把"最后一关"扔掉了,自然没人替你把关。
这跟「AI总在瞎编」和「越改越乱」是同一链路——前面没说清、边界没画好、最后还不检查,三环全断,翻车是必然。
🔑 第一次验证
同一份交付,两种收尾方式
看看你收完 AI 的交付后,做一个"不验证直接接受"和"要求它自检+给你验收清单"——
两种做法的后果差别有多大。
不验证
AI 交付后,你说:
"好的,谢谢!"
实际后果:
你上线三天后发现:装备脱下属性没还原(边界没覆盖)、空值崩了页面(漏了异常处理)、默认值写错导致新手拿神装(配置没复核)。 AI 不是坏了——它每一步都"做到了",只是每一层都有你没注意到的坑。它不会替你踩。
⚠️ "做完了"和"做对了"之间,差了一次检查
带验证交付(用基本法⑤)
AI 交付后,你说:
"做完了先自己跑一遍完整测试,把通过的截图给我。然后列一张清单给我:哪些是你确认没问题的、哪些是需要我来核的。我只验收清单上的项目。"
AI 的自检交付(来自本站实验五真实流程):
// AI 自检报告 ✅ 装备穿上:属性叠加正确(attack:30 加到角色) ✅ 装备脱下:属性还原正确(attack:30 移除) ✅ 空装备槽:不报错、不显示乱码 ✅ 配置默认值:已逐条复核 equipment.json // 验收清单(你来核的项目) ⚠️ 请人核:不同装备叠加顺序以你期望为准 ⚠️ 请人核:属性上限是否需要设天花板
✓ 它已自检的你不必重做,只核它标出来需要你判的
✨ 你刚刚感觉到的差别,就是"不验证"的全部秘密

左边不是"AI 做错了",是你让它自己同时当运动员和裁判——没人复核,没人踩坑,坑留给你踩。右边你只多了一个动作:让它先自检,再把"人需要判的"列清楚

AI 最擅长生成、最不擅长自我纠错。把"检查"从你的工作里删掉,等于把质量闸门拆了。反过来,把检查作为交付的前置条件,它立刻从"交差了事"变成"对你负责"。

你不需要亲自测每一行。你需要的是让它知道"不交检查报告就不算交"。这正是本站游戏逻辑实验的流程纪律——本地校验→HTTP冒烟→B=C→人工复测,一个都不能少。

为什么会「做完了不等于做对了」?三句话讲透

1 · AI 不会替你踩坑,它只会替你产出
AI 的默认模式是"生成完 = 任务结束"。它不会主动去想"这个边界情况我测过没有""那个默认值会不会出问题"。把检查交给它自己,等于把守门员换成了前锋。
研究佐证:arXiv 2407.00107 "The Illusion of Safety" 指出,用户对 AI 输出的信任往往高于其实际可靠性——你越不检查,越容易忽视隐藏的问题。
2 · "做完了"和"做对了"之间还有一整道工序
写代码、配数据、做页面只是上半场——检查是和写代码平级的工序,不是"有空再做"的可选项。在本站的协作方法里,部署前的检查漏斗(本地校验→HTTP冒烟→B=C→外网联通→人工复测)是写死在流程里的,从未跳过。
看不懂"HTTP冒烟→B=C"没关系——你记住一点就够了:每多一道检查,就少一个线上事故。这套流程的完整规格见跨AI工作流衔接(含三包模型定义)。
3 · 你管验收标准,它管自证
最省力的分工:人定"做到什么算合格、哪些必须人判",AI 先把能自证的先自证,把需要人判的列清楚。这不是技术活,是"把验收标准说出来"的活。
研究佐证:arXiv 2507.02778 "Self-Correction Bench" 评测显示,AI 自我纠错有明确边界——它擅长发现"格式/语法"类错误,但对"逻辑/意图"类错误几乎失明。所以验收标准必须由人来定。
📋 拿走就能用:验收清单模板
每次 AI 交活后,把这段发过去。把橙色的地方换成你的内容即可。
你做完了吧?先别急着交。做三件事: 1. 自己跑一遍 〔相关测试 / 关键流程〕,把通过的截图贴过来。 2. 列一份验收清单给我: - ✅ 你自己确认没问题的(已自检通过的项目) - ⚠️ 需要我来核的(〔你拿不准的边界情况 / 我才能判断的业务逻辑〕) 3. 我只验收清单上的 ⚠️ 项,✅ 项你自己负责。
🔑 瞎编  |  🧱 过度工程  |  🎮 证据  |  🧭 方法总览  |  📋 基本法
🔑
看专题 01 · 为什么AI总在瞎编?
需求没说清是万恶之源
🧱
看专题 02 · 为什么AI越改越乱?
改动没有边界,bug 自己膨胀
📦
新手引导 · 三步让AI开始靠谱地干活
不会写代码也能用——30分钟上手
🧩
看专题 05 · 为什么AI总是答非所问?
层混一起——AI 被迫猜坐标系
🎮
看证据:这些游戏就是这么造的
规则先定义好,加内容只花几分钟
🧭
看完整方法:协作基本法七条
从"说清楚"到管住安全、让成果被记住
📋
把这套规则打包带走
一键复制 / 下载,粘进你自己的 AI 就能用