先用别的 AI 检测器测一遍,能知道 Turnitin 会给几分吗?
如果你正准备先拿别的检测器跑一遍,猜猜 Turnitin 会给多少,那么一家检测器公司刚好用自己的产品测过这个问题,并公开了结果。下面把它的数字重新算一遍,讲清楚 96.3% 这个标题数字为什么不是「预告」,以及交稿前你实际能弄清楚什么。
HumanPen 团队
· 11 分钟
先用别的 AI 检测器测,能知道 Turnitin 会给几分吗?
靠不住。一家专门测过这件事的检测器公司,在自己的帮助页上也是这么说的。2026 年 8 月,Originality.ai 发布了一项研究:它最接近 Turnitin 的设置叫 40% AI Allowance,在 300 篇作文上与 Turnitin 做出相同「人写还是 AI」判定的比例是 69.7%。帮助页紧接着写道:"The 40% AI Allowance setting does not predict or reproduce a Turnitin result, and the scores from the two tools should not be compared directly."(40% AI Allowance 设置不能预测或复现 Turnitin 的结果,两款工具的分数不应直接比较。)研究里另一个标题数字 96.3%,听起来像是预测准确率,其实主要反映的是:对人写的作文,Turnitin 本来就很少越过这项研究划的 50% 那条线。
动手找「第二意见」之前,还有两件事值得先知道。Turnitin 的 AI 结果根本不对学生显示,不过老师可以把报告导出成 PDF 发给你。另外,至少有一所大学明确告诉学生不要用检测网站,也有学校不许教职工把学生作业上传进去。这两点后面都会讲到。
Originality.ai 测了什么
这项研究题为《What AI Detector Is Most Similar to Turnitin? We Tested 300 Student Essays》(哪款 AI 检测器最像 Turnitin?我们测了 300 篇学生作文),2026 年 8 月 20 日发在 Originality.ai 的博客上,署名是公司创始人兼 CEO Jonathan Gillham。帮助中心另有一篇摘要文章,页面标注 "Updated on: 19/08/2026"(更新于 2026 年 8 月 19 日)。
要记住这是谁做的研究。被比较的检测器就是 Originality.ai 自己在卖的产品,文章结尾还邀请读者 "Check your work with Originality.ai"(用 Originality.ai 检查你的作业),而且这是一篇公司博客文章,不是经过同行评审的论文。页面上写明 Originality.ai "is not affiliated with or endorsed by Turnitin."(与 Turnitin 没有隶属关系,也未获其认可。)
测试是这样做的:
- 300 篇英文作文,取自 GEDE。这是一个用来测试教育场景下 AI 检测的公开研究数据集,随 Lukas Gehring 和 Benjamin Paaßen 2025 年的一篇论文发布。其中 100 篇完全人写,100 篇是人写后用 AI 润色过的,100 篇完全由 AI 生成。
- 每篇扫六次。 Turnitin 扫一次,Originality.ai 的 AI Allowance 模式按 0%、5%、15%、25%、40% 五个设置各扫一次。
- 每个结果都折算成「是或否」。 Turnitin 的分数达到 50% 或以上算 AI。研究自己也说明,这条线 "is not an official Turnitin Human/AI threshold"(不是 Turnitin 官方的人写/AI 分界线)。
- 有些信息页面上没有。 页面没说扫描是什么时候做的,也没说用的是哪个版本的 Turnitin 模型。它提到逐篇数据放在一份 "supporting Google Sheet"(配套的 Google 表格)里,但我们 2026 年 10 月 2 日读这个页面时,上面没有这份表格的链接。
69.7% 是什么意思
意思是 300 篇里有 209 篇,40% 设置和 Turnitin 落在那条「是或否」线的同一侧。这是五个设置里最高的。25% 设置的一致率是 55.3%,最严的三个设置都不到一半(45.3% 到 46.7%,见研究的图 1)。
两款工具在哪里分歧,比总数更能说明问题。意见不一致的 91 篇里,有 76 篇是完全由 AI 生成的:40% 设置把这 100 篇全部标为 Likely AI(可能是 AI),Turnitin 把其中 24 篇打到 50% 或以上。至于另外 76 篇落在 50% 以下的什么位置,页面没说,所以这不等于 76 个零分。剩下 15 篇分歧出在 AI 润色过的作文上。对 100 篇完全人写的作文,两款工具都没有判出任何一篇是 AI。
研究自己对这个标题数字的评价很直白:"69.7% is not close enough to call the tools substitutes"(69.7% 还没有接近到可以把两款工具互相替代的程度)。可同一句话接着又说,对学生而言这个设置是 "an excellent option"(一个极好的选择)。
关于这个设置本身,还有一个细节。Originality.ai 介绍 AI Allowance 的页面把 40% 标为 "Generous"(宽松),说明是 "Hybrid AI writing is permitted (but not fully AI-generated content)"(允许人机混合写作,但不允许完全由 AI 生成的内容)。而同一页给学生的建议是另一回事:"Check assignment or school policies (typically 0% AI or 5% AI)"(查看作业或学校的政策,通常是 0% AI 或 5% AI)。在这次测试里,恰恰是这两个设置和 Turnitin 最不一致。两个页面回答的是不同的问题(一个是你的课程允许多少,一个是哪个设置最像 Turnitin)。不过结果就是:因为「最像 Turnitin」而被挑出来的设置,正是这家公司自己形容为允许人机混合写作的那一档。
96.3% 是什么意思,为什么它不是「预告」
这是研究放在最前面的数字。40% 设置判为 Original(原创)的作文,Turnitin 有 182/189 篇打在 50% 以下,也就是 96.3%。页面开头把它说成 "96.3% chance of also being treated as human by Turnitin."(有 96.3% 的概率同样被 Turnitin 当作人写。)
这句话少了一层背景,而页面其他部分其实给了算出它所需的数字:对人写的作文,Turnitin 很少超过 50%。100 篇完全人写加 100 篇 AI 润色,它一共只有 10 篇超过 50%。也就是说,对这两组作文,不跑任何第二个检测器,直接猜「Turnitin 会在 50% 以下」,200 篇里能猜对 190 篇。
| 人写的 200 篇(100 篇完全人写,100 篇 AI 润色) | Turnitin 在 50% 以下 |
|---|---|
| 全部 200 篇,不做第二次检测 | 190/200(95%) |
| 40% 设置判为 Original 的 189 篇 | 182/189(96.3%) |
| 40% 设置判为 Likely AI 的 11 篇 | 8/11 |
这几行是我们根据研究页面上的计数算出来的。189 个 Original 判定全部出自这 200 篇,因为完全由 AI 生成的作文都被这个设置标成了 Likely AI,所以三行说的是同一组作文。拿到一个 Original 结果,把概率从 95% 挪到了 96.3%。
反过来看,这才是一个担心的学生真正关心的方向。Turnitin 把 10 篇润色过的作文打到了 50% 或以上,其中 7 篇,40% 设置给出的都是 Original。10 篇实在太少,得不出任何规律,但这正是预先检测本该拦住的情况,而它只拦住了 3 篇。研究给学生的建议里自己也写得很明白:"Use the 40% AI Allowance as a comparison point, not a Turnitin preview."(把 40% AI Allowance 当作一个参照点,而不是 Turnitin 的预览。)
如果你自己去读这项研究,会看到开头有一行把 96.3% 说成是人写作文上的一致率。下面的详细拆分其实是用 40% 设置判为 Original 的全部 189 篇算的,人写和润色的混在一起。单看那 100 篇完全人写的作文,两款工具篇篇一致。
50% 这条线是研究自己划的,不是 Turnitin 的
就算在 50% 这条线上完全吻合,也说明不了老师那边看到的是什么。Turnitin 的 FAQ 讲了量表低端的显示规则:"no score or highlights are attributed for AI detection scores in the 1% to 19% range"(AI 检测分数在 1% 到 19% 之间时,不给分数,也不做高亮),改为显示一个星号。从 20% 起,报告上就会显示百分比。所以一篇被 Turnitin 打了 30% 或 45% 的作文,在这项研究里算 "treated as human"(被当作人写),而老师的报告上显示的是一个具体数字。低分段的详细情况见 Turnitin AI 率上的星号(*%)是什么意思?。
研究自己也承认这一点:"A score below 50% can still contain text Turnitin marked as likely AI; a score above 50% is not proof of misconduct."(低于 50% 的分数里仍可能有 Turnitin 标为可能是 AI 的文字;高于 50% 也不能证明有不端行为。)它没有报告的,是有多少篇落在 20% 到 49% 之间。对一个想猜「到底会不会出现数字」的学生来说,缺的正是这个数。
把草稿上传到任何地方之前
在一些大学,要不要把草稿放进检测网站,已经写进了规定。我们之前那篇自己的稿子能不能贴进 AI 检测网站?三所大学写下的规定,整理了其中三所在 2026 年 9 月 18 日的规定。简单说:
- 利兹大学的《Academic Integrity and Assistance Policy》(学术诚信与协助政策,2026 年 7 月 8 日批准,2026/27 学年起实施)写道,它的 Turnitin 教程会讲清楚 "why students should not use AI detector or plagiarism detector websites"(为什么学生不应使用 AI 检测或抄袭检测网站)。这一条是写给学生的。
- 利兹大学给教职工的指引列了不用在线检测工具的三个理由:这些工具 "insufficiently accurate for the University to use them as evidence"(准确性不足以让大学拿来当证据),上传 "may represent a data security breach"(可能构成数据安全违规),以及 "the document being checked becomes available as training data for other AI tools"(被检测的文件会成为其他 AI 工具的训练数据)。这是针对教职工检查别人作业写的,第三个理由也是泛泛而论,没有点名任何一家服务。
- 雷丁大学告诉设计和批改考核的教职工:"Student work must not be uploaded into GenAI tools or AI detection tools under the current interim approach."(在现行临时做法下,学生作业不得上传到生成式 AI 工具或 AI 检测工具。)得克萨斯大学奥斯汀分校规定除非签了学校合同,否则不得拿第三方 AI 检测软件来评判学生作业,并把学生对自己作品的版权列为理由之一。它的指引是写给教学和批改的人看的,不过这条禁令本身没有说适用于谁。
这三所都没有说检查自己的作业算不端行为。但在一所写了利兹那种规定的大学,预先检测有可能违反书面指引,换来的却是一个对判断 Turnitin 帮助有限的分数。粘贴任何内容之前,先去查你自己学校当前的页面。Originality.ai 说用它扫描不会把你的论文送进 Turnitin。至于任何检测网站之后怎么处理你的文字,要看它自己的条款。
交稿前你实际能弄清楚什么
- 先知道你看不到什么。 Turnitin 的 FAQ 写着:"The AI writing detection indicator and report are not visible to students."(AI 写作检测指示器和报告对学生不可见。)同一处随后给了一条变通办法:"However, with the PDF download feature, instructors can download and share the AI report with students."(不过,借助 PDF 下载功能,教师可以下载 AI 报告并分享给学生。)两边各能看到什么,见学生能看到 Turnitin AI 率吗?学生端与教师端权限对照。
- 问老师两件事。 这份作业开没开 AI 指示器?在这门课上它拿来做什么用?这个答案决定了任何分数到底有多重要。还该问谁、按什么顺序问,见提交 Turnitin 前,学生能自己检查什么?。
- 如果还是要用别的检测器,就按它自己的刻度读。 Originality.ai 用一个例子解释自家结果:在 15% 设置下看到 "Likely Original"(可能是原创),"should be read as"(应理解为)AI 使用量 "appears to be 15% or less"(看起来在 15% 或以下)。按同样的读法套到 40% 设置上,得到的是「40% 或以下」,这对一份不允许用 AI 的作业几乎说明不了什么。它也没法告诉你 Turnitin 到底会不会显示一个数字。
- 留好真正能回答问题的记录。 两家公司指向的是同一样东西。Originality.ai 的帮助页说:"AI detection results should always be considered alongside other evidence of authorship, such as drafts, notes, sources, and document history."(AI 检测结果应始终与其他能证明作者身份的证据一起考虑,比如草稿、笔记、资料来源和文档历史。)Turnitin 的 FAQ 说它的百分比 "should not be used as the sole basis for action"(不应作为采取行动的唯一依据)。草稿和版本历史掌握在你自己手里,不受别人的设置左右。
- 如果交稿后有人拿分数说事,要报告本身。 完整的 AI Writing Report PDF 会显示结果,以及被高亮的段落(如果有)。别的检测器给的数字,不管高低,都代替不了它。
常见问题
用 Originality.ai 扫描,会把我的作文放进 Turnitin 的数据库吗? Originality.ai 说不会:"Running an Originality.ai scan does not submit the paper to Turnitin."(用 Originality.ai 扫描不会把论文提交给 Turnitin。)它还说自己 "is not affiliated with Turnitin"(与 Turnitin 没有隶属关系),只能生成自家的报告。Originality.ai 自己会保留什么,要看它自己的条款。
我用的检测器显示 Likely AI,是不是说明 Turnitin 也会标出我? 不一定。在这项研究里,40% 设置把 11 篇 AI 润色过的作文标为 Likely AI,Turnitin 只把其中 3 篇打到 50% 或以上。
设置调得更严,会不会更接近 Turnitin? 这次测试里不会。0%、5% 和 15% 三个设置把 92% 到 95% 的 AI 润色作文标了出来,而 Turnitin 在 50% 线上只标出了 10%;这三个设置在全部 300 篇上与 Turnitin 的一致率都不到一半。
这能说明哪款检测器更准吗? 不能,研究自己也这么说:它 "estimates behavioural similarity. It does not establish which detector is more accurate."(估计的是行为上的相似度,并不能说明哪款检测器更准确。)两家公司各自在文档里怎么描述自己的工具,见 Originality.ai vs Turnitin AI 检测:文档实际说了什么。
参考来源
- Originality.ai,What AI Detector Is Most Similar to Turnitin? We Tested 300 Student Essays,Jonathan Gillham,2026 年 8 月 20 日;2026 年 10 月 2 日读取(正文及图 1 至图 4)。
- Originality.ai 帮助中心,Which Originality.ai AI Detector Is Most Similar to Turnitin?,2026 年 8 月 19 日更新;2026 年 10 月 2 日读取。
- Originality.ai,Introducing AI Allowance;2026 年 10 月 2 日读取。
- Lukas Gehring、Benjamin Paaßen,Limits of LLM Text Detectors in Education,arXiv 2508.08096,即发布 GEDE 数据集的论文(第一版 2025 年 8 月)。
- Turnitin,AI writing detection capabilities FAQs 与 Using the AI Writing Report;2026 年 10 月 2 日读取。
- 利兹大学,Academic Integrity and Assistance Policy 与给教职工的人工智能使用指引,引文据我们 2026 年 9 月 18 日的文章。
- 雷丁大学,assessment and feedback guidance;得克萨斯大学奥斯汀分校教务长办公室,AI detection software guidance;2026 年 10 月 2 日读取。
继续阅读