Dekita

为什么 AI 写的文字一眼就能看出来?我把它拆成了六条能跑的自检

中文长文存档 AI 提效

先说结论:被平台判定 AI 味重的文字,问题基本不在内容深浅,而在六处可以数出来的写法习惯。把它们做成自检清单,每次发布前跑一遍,我第一次跑就抓出 17 处。

2026 年 9 月 20 日,我在知乎发第一篇文章,平台的内容检测给了 17 处标红。我当时以为是内容太水,逐条看下来发现不对,命中的全是格式,包括用中文弯引号给名词加强调、满屏加粗、把文章写成标签化的四段式。内容本身一句没被说。

这件事让我把 AI 味从审美问题换成了特征问题。是特征,就能数。

一、AI 味到底是什么

大模型会在几处留下稳定的指纹,它们是从训练语料里统计出来的高频写法。

第一个是中文弯引号。人写中文,引号大多用键盘直接打出来的直引号,或者在正式排版里用书名号。模型倾向于把名词用弯引号括起来加强调,因为它见过太多这样的排版。这个特征稳定到可以当指纹用。

第二个是加粗。模型喜欢把每一段开头的词组加粗,模拟一种我在强调重点的观感。真人写作里,一篇短文出现三次以上加粗的情况很少。

第三个是破折号。中文写作里破折号本来就少,一篇一千字的文章出现三次以上,基本可以怀疑。

第四个是先否定后转折的对比句,也就是前面先否掉一件事,后面用一个转折词再立起另一件。它在中文里念起来很顺,但它是一个模板,模型对它的偏好远超真人。这一点不是我猜的,平台的内容检测会把这一类逐条列成优化建议。

这四个是可数的。另外两个要用眼睛。

第五个是段落节奏。真人的段落长短不齐,模型喜欢把每一段都写到差不多的长度,读起来像节拍器。

第六个是收尾方式。真人写东西经常在没结论的地方停下,或者给一个很具体的小动作;模型的收尾高频落在抽象的总结上。

六条列完,你会发现它们全都跟内容质量无关。一篇文章可以很有信息量,同时把六条全犯。

二、我把它们做成了两层的自检

第一层是机械项,用脚本数。

我写了一个脚本,扫四件事:弯引号和直角引号的出现次数、加粗的处数、破折号的个数、否定对比句的条数。阈值定得很紧,引号零次,加粗不超过两处,破折号不超过两个,否定对比句不超过一条。它不判断写得好不好,只报数字。

第二层是说人话,靠一张规则表。

机械项查完,还有一类问题查不出来,就是句子太长、同一个意思换着词说三遍、段落写到十几行不分。这一类我列成六条规则,阈值写进一份文档,脚本照文档判。比如单句超过多少字算长句、同一个名词在一段里出现几次就该删掉同义替换。

两层加起来,发布前跑一条命令,出两份报告。第一次跑,机械项在上一版稿子里抓出十七处,说人话那份在另一篇稿子里抓出十九处。

这里有一个取舍值得说:阈值全部写成文档里的数字,脚本不内置。原因是任何一个数都可能定错,写在外面才能被质疑、被改。写在代码里的阈值,最后会变成没人敢动的东西。

三、我踩过的三个坑

坑一,检查器报通过,其实一个字都没检查到。

有一次我把正文写进了一个代码块里,跑检查器显示命中零、完全通过。我当时觉得奇怪,因为报告的句数明显少于我的估计。把同一段文字另存成纯文本再跑,立刻暴露出三处问题,两处长句加一处相对时间词没锚定。原因是检查器会把代码块整段跳过,设计初衷是别去扫代码和命令,但它分不清代码块和写在代码块里的文章。

修法不只是改逻辑,更要加一条覆盖率护栏:被跳过的代码块里如果汉字超过八十个,报告末尾打一行警告,说明这次通过不算数。这条护栏比修任何一处判据都重要,因为它防的是假通过。

坑二,对外发布的内容里写了相对时间词。

有一次快讯卡的标题写的是算力昨天出了三件事。这句话对当天看到的读者是对的,但内容会在网上留很久,隔几天再有人看到,昨天就变成了错的。修法是把规则收紧:对外发布的内容里,昨天今天这类词必须就近带上完整日期,否则一律算错。对内文档放宽到四十个字符窗口,对外收到二十个字符。

坑三,报红灯时先怀疑检查器本身。

有一次自检脚本抓出两条逾期,我看着那两条查了很久,最后发现它们都是引用残留,被引用的日期早就更新过了,只是措辞里还留着旧值。检查器没有误报,但它报的根本不是我以为的那件事。这件事的教训是方向性的:误报比漏报更费时间,因为漏报你至少知道自己在赌,误报会让你去改一个根本没错的东西。

我的判断

第一,AI 味可以被拆解成具体特征,不是玄学。能被数出来的东西,就能被改掉。反过来,如果你只在心里觉得这段写得有点假,就永远改不干净,因为你不知道该动哪里。

第二,机器能查的是格式,人得查的是判断。上面六条里,四条能自动化,两条必须自己读一遍。把六条全交给脚本,等于用工具替换掉自己的判断力,代价是你会慢慢看不出问题在哪。

第三,这套自检省下的是重发的成本。一篇被平台判成 AI 生成而降权的文章,代价远不止改几个词,还有这篇文章本身的曝光。发布前花两分钟跑一遍,比事后补救便宜得多。

给一个今天就能用的动作:把你最近写过的一段文字复制出来,只做两件事。数一下里面有几个中文弯引号,数一下有几处加粗。这两项归零,读起来就会顺很多。剩下四条不用急着做,先让这两项变成习惯。


数据与来源:知乎内容检测实测结果(2026-09-20,本人账号后台截图留档)|中文弯引号与加粗的判定阈值(本项目写作规范文档,2026-09-20 建立)|说人话六条规则与阈值(本项目写作规范文档,2026-09-29 建立)|四类机械项的计数口径与覆盖率护栏(本项目自检脚本,2026-09-27 与 2026-09-29 两次修订)|阈值外置的做法参照技术写作领域的既有共识(ASD-STE100 简化技术英语标准与美国政府《Plain Writing Act》官方页面,2026 年 9 月核)。

本内容为效率方法与工具使用经验分享,不构成任何投资或买卖建议。