降 AI 工具和改述工具到底差在哪
Turnitin 自己的文档把「改述工具」和「humanizer」写进了同一句话里,所以靠名字分不出来。能分出来的是四个问题,任何一个产品的 FAQ 页上两分钟就能查完。
HumanPen 团队
· 21 分钟
先说结论
这两类东西在手法上几乎完全重叠,差别在处理单位。改述工具收的是你粘进框里的一段话,还给你一段文字,它要满足的是一个人读完之后同意「意思一样、话不一样」。文件级的改写工具收的是文件,还给你文件,它对着的是 Turnitin 在互相重叠的多句片段上算出来的那个分,而不是逐句算出来的分。把一个词换成另一个词是再正常不过的编辑动作,两类工具都在做,在这个轴上排座次是条死路。真正把它们分开的,是它做决定的那一刻眼前摊着多少文字,以及东西回到你手上之后,你还得干多少活才交得出去。
以上都不是在比效果。「哪种更有效」这句话,Turnitin 之外没人能说成一个你能核的形状,为什么,下面「两类工具都答不了的问题」那节会讲。
这两个名字不是术语
先把「名字里有技术区分」这个念头放下。Turnitin 的能力 FAQ 把三个名字塞进了同一句:
"Furthermore, it can also identify instances where AI-generated text may have been modified by AI paraphraser or bypasser (also called humanizers) tools to evade detection."(此外,它还能识别出 AI 生成的文本被 AI 改述工具或绕过工具——也叫 humanizer——修改以规避检测的情形。)
括号是 Turnitin 自己加的。一句话,三个产品名,中间没画任何界线。同一页还写明不打算公布训练时针对过哪些工具:"to safeguard the integrity of our solution and its effectiveness in maintaining academic honesty, we're unable to disclose the names of these tools."(为了保护我们方案的完整性及其在维护学术诚信上的有效性,我们无法披露这些工具的名称。)
所以检测方的文档不会替你把这些产品分类,营销文案更不会——公司只会挑一个它认为大家在搜的词写上去。同一个产品完全可以两边都占:首页一个粘贴框,往里点两下有个文件上传。这也是另一个「看页面别看标签」的理由。
剩下能看的,是可以观察的那部分。四个问题,在产品自己的 FAQ 页上两分钟能查完。
把两类分开的四个问题
| 问题 | 文本框类 | 文件类 |
|---|---|---|
| 你交给它什么? | 粘进去的一段话。顺手在页面上找一下单次上限 | 文档本身 |
| 回来的是什么? | 纯文字,你自己粘回文件里 | 一份文档,还是文档 |
| 谁决定改哪些词? | 你粘进去的全部。它只有一个入口,进去的东西一视同仁 | 你圈的范围,或者一份点名了具体片段的检测报告 |
| 它能动的最小单位是什么? | 一句,甚至更小 | 通常是段落。值得专门查,因为它同时决定效果和价钱 |
第三行是最容易跳过、事后最后悔的一行。只有一个入口的框,分不出哪句是报告标过的、哪句是它旁边那句,因为压根没人告诉过它有报告这回事。这是入口形态的性质,不是改写本身的毛病。同一套手法,你从表格的哪一端买进来,剩给你的那一下午是完全不同的。
第四行值得追问,因为它一般不会是定价页上的大字。我们自己把它写在计费那条 FAQ 里:"A paragraph is the smallest unit a rewrite can touch, so a selection is expanded to full paragraphs before it is counted."(段落是一次改写能触及的最小单位,因此选中的片段会先补齐为完整段落再计费。)不管某一页写的是什么,信数字,别信形容词。同一个习惯也适用于排版保留的承诺,我们把它写成了一套可以自己跑的测试:怎么核一个降 AI 工具的「保留排版」声称。
那趟来回要付的代价
上面那张表的第二行,藏着没人给你算进预算的那部分活,而且跟改写质量一点关系没有。文字以字符的形态进框,以字符的形态出来。你文档里凡是不是字符的东西,都得靠重打或者覆盖粘贴活下来。
按踩中的频率排,常见的伤亡是这些:
- 脚注和尾注的标号,看起来是上标数字,其实不是
- 文献管理软件插进去的引用域,一旦变成纯文字就不再更新
- 交叉引用和目录,它们是会重算的指令,不是待在那儿的文字
- 修订痕迹和批注锚点,它们根本没有纯文本形态
- 表格的单元格边界,出来要么变成制表符,要么什么都不剩
域的机制我们单写过一篇:纯文本来回一趟会对一篇学位论文做什么;参考文献和公式那一侧的坏法在引用、表格和公式会怎么样。
上面这些一条都不沾的时候,它同样是支持用框的理由。三页纸,没有域、没有参考文献表、没有格式要求,来回一趟什么都不损失,这时候走文件又慢又重,换不回任何东西。其余那些「文件类工具是错的选择」的情形,在什么时候不该用文件级改写工具里。
做决定的那一刻,眼前有多少文字
Turnitin 自己是这样描述它那条流水线的:
"When a paper is submitted to Turnitin, sentences from the submission are extracted and segmented into overlapping sections for prediction analysis. Each segment is classified by the AI detection model and given a value between 0 and 1, denoting the probability of the text being likely human or AI-generated. Each qualifying sentence within these segments inherits the segment's score."(论文提交后,其中的句子被抽出来,切分成互相重叠的片段用于预测分析。每个片段由 AI 检测模型分类,得到一个 0 到 1 之间的值,表示该文本更可能是人写还是 AI 生成的概率。片段中的每一个合格句子,继承该片段的分数。)
把它当成一句关于范围的话来读,别读出别的。它说被打分的东西是一组句子,说这些组是互相重叠的,所以同一个句子可以同时待在好几组里,每一组都给它一个分。它没有给编辑动作排座次,我们也不排:把一个词换成更合适的词是对句子做的正常事,两类工具都在做,我们自己也在做,下面的话没有一句是在反对它。
这段描述真正推出来的是另一件事:有些改法,眼前只摆着一句话的时候根本做不出来。把两句并成一句、把一句拆开、删掉这段已经说过一遍的分句、把一个论断挪进另一段、补上你自己数据里的那个数。手里只攥着一句粘贴文本的工具够不到这些,不是因为它改得差,是因为这段的其余部分不在场。同一份清单的手工版在不用工具手工降 AI 率。
两条诚实的边界。Turnitin 把这两步都点了名,却一步的规则都没有公布,所以上面这些换算不成任何一个能递到你手上的数。还有,如果你打算先拿一小段文字试试这两类工具中的哪一种,厂商已经先劝退过了:几百词的短文档里 "the prediction will be mostly 'all or nothing' because we're predicting on a single segment without the opportunity to overlap"(预测会基本上是全有或全无,因为我们是在单个片段上预测,没有重叠的机会),后果是 AI 内容与原创内容混在一起的文字,可能被整体判成 AI 生成。
什么时候该用框,什么时候两个都不该用
框赢的场合,比文件类厂商愿意写下来的多:
- 你手上是散落的一段,不是一份文件
- 这段文字没有域、没有参考文献表、没有要保住的格式要求
- 你要调语域,往更口语或者更朴素的方向调。把改写锁死在学术语域的文件类工具不让你调,我们自己就是这样
- 文档不是英文。Turnitin 说只有它的英文检测器带 AI 改述与绕过工具检测;我们自己的文件级改写也只支持英文。这种情况下,应该选明确支持该语种的工具,而不是选我们
- 你在做笔记,把一份来源用自己的话重述一遍——这是个带引注的理解任务,整条链路上没有检测器
还有三种情形,两类都不是答案。那段是你必须原样复现的直接引语时,改写它本身就是错误,不是修补。学术诚信程序已经启动时,提交上去的文件和那些报告是证据,改动它们等于抹掉对你有利的时间线。以及,被标的那段确实在重复、确实是空的时候,报告找到的是一个写作缺陷,把写作修好,评分那边是实打实的收益,跟 AI 那个数字动没动无关。
两类工具都答不了的问题
四件事。任何一个产品页看起来能给你其中一件,那它给的都是它没有的东西。
- 一个预测分数。 汇总这一步有名字,但它按什么规则算没有公布。卖这两类工具的没有一家拿得到,包括我们。
- 检测器认得哪些工具。 Turnitin 说它不会公布这份名单,理由是公布了会让规避变容易。所以任何「能过某个检测器」的说法,你没法核,我们没法核,写它的人自己也没法核。
- 你自己的前后对比。 0% 以上、20% 以下的分数,Turnitin 只显示一个星号、不给数字;而多数配置下,指标和报告是教师和管理员能看、学生看不到的,不过教师可以下载 PDF 版分享给学生。真降下去了和完全没动,从你坐的位置上看是一模一样的。
- 你要不要声明。 这个由你所在机构定,跟工具做了什么是两个问题,我们在改写会不会改变你要声明的东西里拆过。
第一条旁边值得放着 Turnitin 自己的那句话:模型 "may not always be accurate (it may misidentify human-written, AI-generated, and AI-paraphrased text), so it should not be used as the sole basis for adverse actions against a student"(未必总是准确,它可能误判人写的、AI 生成的和 AI 改述过的文本,因此不应作为对学生采取不利行动的唯一依据),而认定是否存在学术不端 "takes further scrutiny and human judgment in conjunction with an organization's application of its specific academic policies"(需要进一步审查和人的判断,并结合机构对其具体学术政策的适用)。
我们站在哪一边,直说
这篇是一家卖文件类工具的公司发的。上一节里「谁都给不了」的那四件事,先按在我们自己头上,再按到别人头上。
按那四个问题说清楚 HumanPen 是什么。你上传文档,它以进去时的那个格式回来。范围来自你自己圈的片段,或者来自你连同文件一起上传的 AI 检测报告。走报告这条路时,报告里标出来的片段会先映射回你的文档摆给你看,那时候什么都还没跑、什么都还没扣。它能动的最小一块是段落,所以一处标记只压住半段,整段都会跟着走。计费跟着同一个单位走:每 1000 词消耗 100 积分,只按实际改写的词数计费,圈了四段就按四段算。文档页数不设上限。符合条件时可以免费继续降 AI。
我们没有在声称手法上的优势。我们并没有用某种改述工具做不到的方式换词,就算有,我们也拿不出能给你看的证据。我们卖的差别是单位和流程:给的是文件不是剪贴板,范围在付钱之前就能看见。这两样值不值钱,全看你文档里装的是什么,所以这一页有一半篇幅在讲它什么时候不值。
常见问题
改述工具和 humanizer 是一回事吗? 在 Turnitin 的文档里它们待在同一句话里,中间没画界线,所以从检测方那一侧没有边界可指。从买东西的人这一侧,上面表格里的四行分得很干净,而且这四行在任何产品页上都能查。
一个自称「改述工具」、页面上没出现 humanizer 这个词的产品,是不是更安全? 不是。Turnitin FAQ 里那一句把两个名字都罩住了,同一页还写着不会披露训练时针对过哪些工具。你所在机构允许什么,由机构定,跟某个产品给首页挑了哪个词无关。
能不能一章一章地把学位论文粘进框里跑? 能,也有人这么干。先把两笔代价算上。上面「来回一趟」那五条里的每一样,每粘一次都得手工重建一遍;而且整份文档回来之后,都是你没有以现在这个样子读过的文字,包括没有任何人标过的那些部分。
哪一类能过 Turnitin? 这个问题没有你能验证的答案,因为检测器训练时针对过哪些工具是刻意不公开的,而且模型在变。这个说法我们也没有往自己产品上安。
我只要改三段被标的话,走文件这条路还有意义吗? 只有当这份文件里有值得保住的东西,或者你想在开跑前把范围记录下来时才有。一篇干净文档里的三段,手改或者用框都更快。至于为什么要照着报告改而不是整篇重跑,理由在只改报告标出来的那几段。
来源:Turnitin 的 [AI writing detection capabilities FAQs](https://guides.turnitin.com/hc/en-us/articles/28477544839821-Turnitin-s-AI-writing-detection-capabilities-FAQs) 与 [Using the AI Writing Report](https://guides.turnitin.com/hc/en-us/articles/22774058814093-Using-the-AI-Writing-Report),引文于 2026 年 8 月 14 日对页核过。关于 HumanPen 的支持格式、计费、段落粒度、不设页数上限和免费后续处理,已于 2026 年 8 月 18 日对产品页与账号流程核过。
继续阅读