通用方法 · 熟练

AI 写的东西,查得出来吗?

水印与检测器都靠不住,那就别靠它们
「这段是不是 AI 写的」,检测器答不了。OpenAI 在 2026-10-05 公开了一个很直白的数字:把一段 400 token 的文字里 25% 的词换成同义词,它的文本水印检出率从约 92% 掉到 17%。第三方 AI 检测器的处境一样 —— 它们测的是「像不像模型习惯的输出」,不是「谁写的」,而一个肯花十分钟改措辞的人就能把这道差抹平。这一页不教怎么破解检测,讲的是真的需要证明「这篇是人写的」时,该留下来的是什么:三类可举证的痕迹 + 一句成本最低的验真提问,最后把判据写进发布清单。
方法 · 一图看懂
1
先认下水印的边界 — 25% 同义替换就把它打到检出率 17% ⇒ 它证明不了「不是 AI 写的」
2
把判据从「像不像」换成「留没留痕」 — 检测器测的是风格分布,你要的是过程
3
三类可举证的痕迹 — 版本历史 / 草稿与批注 / 能当面复述的思路,三者都不依赖任何工具
4
一句最低成本的验真提问 — 「把工具关掉,你讲一遍这段是怎么来的」
5
写进发布清单 — 「谁读过、改了什么」落成一行记录,而不是出事后争辩
原理 · 为什么有效
水印与检测器在这一题上失效是结构性的,不是精度不够。它们测的是分布特征,而你要的是来源 —— 同义替换、句式调整、翻译再回译,任何一步都能让分布变样,而文本「像什么」和它「谁写的」从来不是同一个属性。更麻烦的是中间地带:人搭框架 + 模型扩写 + 人删改,这种人机协作的每一档都连续分布,不存在一条能把它们切开的线。所以判据必须从「文本像什么」移到「过程留下了什么」:草稿、版本历史、批注、以及当事人能不能把内容讲一遍。这几样都不需要任何工具去判定,也不怕被改写绕过 —— 它们本身就是事实,而不是关于事实的推测。
适用场景
适用:需要为内容的来源负责的人 —— 编辑与审稿 · 教师与家长 · 需要交原创内容的学生与研究者 · 要为自己发布的东西背书的个人作者。
⛔ 不适用:只是自己写着玩、不需要向任何人举证的人 —— 那就不必增加这道工序。
⚠️ 前提:你至少有一个「过程」可以被留下来。若全程只在对话框里来回,请先做第一件事:把成稿落到一个带版本历史的文件里。
自测 · 5 问
我最近一次被怀疑「这是不是 AI 写的」,我手上能拿出来的证据是什么?
我的成稿是落在一个带版本历史的文件里,还是只存在于对话框里?
我能不能不看稿子、把这篇的三段主线讲一遍?
我的发布清单里,有没有一行是写「谁读过、改了什么」的?
我有没有一次是拿检测器的分数当结论的?那次结论对吗?
怎么上手 · 验证步骤
第一件事只做一样:把下一次的稿子从对话框挪进一个带版本历史的文件(本地 Git、云端文档的历史记录、或任何能回看的编辑历史都行),并在发布前把「谁读过、改了什么」写成一行。第二件事:用一句提问替掉一次检测 —— 找一个人(同事 / 家人 / 隔一天的自己)把工具关掉,让他复述这篇在说什么;讲得出来说明内容真在你们脑子里,讲不出来说明它只是被搬过来。第三件事:把这两样写进发布清单的固定位置,之后每次发布都过一遍,不再问检测器。
自检动作:挑一篇你最近发出去的内容,关掉所有工具,用三句话把它讲给一个人听,然后写下一句「哪一句我讲不出来」。那一句就是最该补痕迹的地方 —— 是缺草稿,还是缺一次真正的重写,答案会在你补的过程中自己出来。
[C级]OpenAI 文本水印实验(2026-10-05 公开:把 400 token 段落里 25% 的词换成同义词,水印检出率从约 92% 降到 17%;该功能当日起向全球 API 客户开放选择性加入) [C级]AICoderScope《Claude Code Agent Skills in 2026》(同一形态的另一面:格式与元数据能带出信息,但它只能证明来源,不能证明原创) [C级]Successful Study Skills 4 Students《What Good AI Use Actually Looks Like, Grade by Grade》(给出家庭与课堂都在用的低成本验真动作:把工具关掉,让对方复述昨天那个概念 —— 学到的能讲,借来的讲不出) 同类:AI 做的内容,标识该谁负责? · 一眼看出是 AI 写的,改哪几处? · AI 搜索说的那句话,是谁放进去的
继续往下读
同级:AI 做的内容,标识该谁负责? 随机一篇