AI 降重工具(humanizer)为什么用几个月就失效?机制在这里
一个 humanizer 上学期还能帮你的分降下来,现在不行了。不是工具变笨——是检测器在按一份公开的时间线变宽。本文讲清楚这个机制、为什么失效日期无法提前预知、以及为什么手写基线比任何工具都持久。
HumanPen 团队
· 5 分钟
短答案
一个曾经好用的 humanizer,几个月后可能就失灵。不是工具变笨了——是检测器变宽了。Turnitin 自己的发布历史记录着检测范围一步步扩展到改写过的、被 bypass 的 AI 文本,而且官方拒绝公开它检测哪些工具。所以没有人——包括工具厂商自己——能提前告诉你工具哪天失效。失效只有发生后你才会知道。
这篇文章讲的是这个机制,不是帮你找一个能用一辈子的工具。不存在这种东西,谁承诺它,谁就是在卖一件官方故意不让你知道的东西。
"失效"到底指什么
"失效"不是一件事。三种不同的体验都叫这个名字,而它们是三个不同的问题。
第一种:分降不下来了。曾经跑完就低的文本,现在回到原来的水平,甚至更高。
第二种:分不降反升。把被标记的文本再跑一遍工具,数字可能往反方向走——因为检测器现在找的,正是这类改写留下的统计指纹。
第三种:文本回来了、被标记也还在,而且看起来不像你写的东西了。工具改得太狠,结果读起来像通用机器文——而这恰恰是检测器训练来抓的形状。
三种都真实存在,三种是同一个底层故事:检测目标移动了。
为什么会这样:检测器变宽了
这个机制有官方记录,不是传闻。Turnitin 自己的发布说明记录着检测范围两步扩展。
2023 年 12 月,官方记录了一次扩展:疑似 AI 生成的文本,即使事后被另一个工具改写过,也仍在检测范围内。这是有据可查的第一次变宽。
2025 年 8 月,官方说 AI 写作报告里的"仅 AI 生成"类目,现在会包含"可能被 AI bypasser 工具改写过的 AI 生成文本"的占比。第二条路径——那些号称"生成后再人形化"的工具——也被关上。
前后两份公告,同一个方向:"被工具处理过的文本"这个类别,一直在被并入检测器的视野。 而 humanizer 的产出,按定义就是"被工具处理过的文本"——正是检测器正在训练去抓的那个类别。
为什么没人能预测失效日期
既然检测器在变宽,自然的问题是:我的工具哪天失效?诚实的答案是:没人能提前知道,而官方是故意让这一点保持不可知的。
Turnitin 说它训练并测试了检测器,能识别领先的 paraphraser 和 bypasser 工具——但它不能公开这些工具的名字,因为公开名单会让绕过变得更容易。紧接的一句是:产品团队在不断扩展检测能力。
两个推论。第一,被检测的工具集合按设计保密——所以没有任何厂商能验证自己的工具当前不在名单上。第二,"不断扩展"意味着边界按厂商的时间表移动,不按你的。一个工具早上还好好的,下一次模型更新后可能就被抓。没人预见到,因为名单本来就不允许任何人看。
这也是"保证"在结构上不可能的根源:一个承诺"永远能过"的厂商,是在承诺一件依赖于一份它自己都看不到的、秘密的、移动中的名单的事。
失效不等于判决:分数不是唯一依据
工具失效让人沮丧,但值得把"工具失效"和"分数的含义"分开。
Turnitin 自己的文档说:AI 写作指标上的百分比,不应被教师用作采取行动的唯一依据,也不应作为最终的评分标准。如果你的文本在工具失效后被标记,那个标记是文本形状的统计信号——不是对你的判决。分高,恰恰是官方口径说"不应单独当成判决"的那种情况。
这个区别重要,因为它改变你下一步做什么:与其去追下一个工具,不如读报告、找到是哪些段落扛着这个分,然后自己去改那些段落——用你自己的改写,不是另一个工具。
什么才是持久的
如果工具按设计会过期,那什么不会?
不看那份秘密名单也能成立的部分:先读报告、亲手改写最高的段落、在结构与内容上做出属于你自己的变化。这些动作,无论有没有任何工具碰过这份文档,都一样成立。
还有一件工具替你做不了的事:补充它没有的信息——你的领域、你的数据、你的论证。humanizer 只是把你给它的文本重排;它不能加入你没告诉它的细节。带着你自己具体内容的文本,读起来就是不一样——而这种差异,不是一次检测更新能追走的,因为它是真实内容,不是统计形状。
这篇文章不承诺"手写永远不会被标记"。它说的是:手写基线是唯一一种持久性不依赖于检测器秘密名单的做法——这是与工具可靠性不同的一种可靠性。
一句话总结
humanizer 会失效,因为检测器在按一份公开的时间线变宽、对着一份故意保密的名单。没人能预测失效日期——你不能,厂商也不能。失效不是判决:官方口径说分数不应被当作唯一依据。而真正持久的是不依赖任何工具的做法:先读报告、亲手改写被标记的段落、让文本带着只有你知道的东西。
继续阅读