先用别的 AI 检测器测一遍,能知道 Turnitin 会给几分吗?

如果你正准备先拿别的检测器跑一遍,猜猜 Turnitin 会给多少,那么一家检测器公司刚好用自己的产品测过这个问题,并公开了结果。下面把它的数字重新算一遍,讲清楚 96.3% 这个标题数字为什么不是「预告」,以及交稿前你实际能弄清楚什么。

HumanPen 团队

· 11 分钟

先用别的 AI 检测器测,能知道 Turnitin 会给几分吗?

靠不住。一家专门测过这件事的检测器公司,在自己的帮助页上也是这么说的。2026 年 8 月,Originality.ai 发布了一项研究:它最接近 Turnitin 的设置叫 40% AI Allowance,在 300 篇作文上与 Turnitin 做出相同「人写还是 AI」判定的比例是 69.7%。帮助页紧接着写道:"The 40% AI Allowance setting does not predict or reproduce a Turnitin result, and the scores from the two tools should not be compared directly."(40% AI Allowance 设置不能预测或复现 Turnitin 的结果,两款工具的分数不应直接比较。)研究里另一个标题数字 96.3%,听起来像是预测准确率,其实主要反映的是:对人写的作文,Turnitin 本来就很少越过这项研究划的 50% 那条线。

动手找「第二意见」之前,还有两件事值得先知道。Turnitin 的 AI 结果根本不对学生显示,不过老师可以把报告导出成 PDF 发给你。另外,至少有一所大学明确告诉学生不要用检测网站,也有学校不许教职工把学生作业上传进去。这两点后面都会讲到。

Originality.ai 测了什么

这项研究题为《What AI Detector Is Most Similar to Turnitin? We Tested 300 Student Essays》(哪款 AI 检测器最像 Turnitin?我们测了 300 篇学生作文),2026 年 8 月 20 日发在 Originality.ai 的博客上,署名是公司创始人兼 CEO Jonathan Gillham。帮助中心另有一篇摘要文章,页面标注 "Updated on: 19/08/2026"(更新于 2026 年 8 月 19 日)。

要记住这是谁做的研究。被比较的检测器就是 Originality.ai 自己在卖的产品,文章结尾还邀请读者 "Check your work with Originality.ai"(用 Originality.ai 检查你的作业),而且这是一篇公司博客文章,不是经过同行评审的论文。页面上写明 Originality.ai "is not affiliated with or endorsed by Turnitin."(与 Turnitin 没有隶属关系,也未获其认可。)

测试是这样做的:

  • 300 篇英文作文,取自 GEDE。这是一个用来测试教育场景下 AI 检测的公开研究数据集,随 Lukas Gehring 和 Benjamin Paaßen 2025 年的一篇论文发布。其中 100 篇完全人写,100 篇是人写后用 AI 润色过的,100 篇完全由 AI 生成。
  • 每篇扫六次。 Turnitin 扫一次,Originality.ai 的 AI Allowance 模式按 0%、5%、15%、25%、40% 五个设置各扫一次。
  • 每个结果都折算成「是或否」。 Turnitin 的分数达到 50% 或以上算 AI。研究自己也说明,这条线 "is not an official Turnitin Human/AI threshold"(不是 Turnitin 官方的人写/AI 分界线)。
  • 有些信息页面上没有。 页面没说扫描是什么时候做的,也没说用的是哪个版本的 Turnitin 模型。它提到逐篇数据放在一份 "supporting Google Sheet"(配套的 Google 表格)里,但我们 2026 年 10 月 2 日读这个页面时,上面没有这份表格的链接。

69.7% 是什么意思

意思是 300 篇里有 209 篇,40% 设置和 Turnitin 落在那条「是或否」线的同一侧。这是五个设置里最高的。25% 设置的一致率是 55.3%,最严的三个设置都不到一半(45.3% 到 46.7%,见研究的图 1)。

两款工具在哪里分歧,比总数更能说明问题。意见不一致的 91 篇里,有 76 篇是完全由 AI 生成的:40% 设置把这 100 篇全部标为 Likely AI(可能是 AI),Turnitin 把其中 24 篇打到 50% 或以上。至于另外 76 篇落在 50% 以下的什么位置,页面没说,所以这不等于 76 个零分。剩下 15 篇分歧出在 AI 润色过的作文上。对 100 篇完全人写的作文,两款工具都没有判出任何一篇是 AI。

研究自己对这个标题数字的评价很直白:"69.7% is not close enough to call the tools substitutes"(69.7% 还没有接近到可以把两款工具互相替代的程度)。可同一句话接着又说,对学生而言这个设置是 "an excellent option"(一个极好的选择)。

关于这个设置本身,还有一个细节。Originality.ai 介绍 AI Allowance 的页面把 40% 标为 "Generous"(宽松),说明是 "Hybrid AI writing is permitted (but not fully AI-generated content)"(允许人机混合写作,但不允许完全由 AI 生成的内容)。而同一页给学生的建议是另一回事:"Check assignment or school policies (typically 0% AI or 5% AI)"(查看作业或学校的政策,通常是 0% AI 或 5% AI)。在这次测试里,恰恰是这两个设置和 Turnitin 最不一致。两个页面回答的是不同的问题(一个是你的课程允许多少,一个是哪个设置最像 Turnitin)。不过结果就是:因为「最像 Turnitin」而被挑出来的设置,正是这家公司自己形容为允许人机混合写作的那一档。

96.3% 是什么意思,为什么它不是「预告」

这是研究放在最前面的数字。40% 设置判为 Original(原创)的作文,Turnitin 有 182/189 篇打在 50% 以下,也就是 96.3%。页面开头把它说成 "96.3% chance of also being treated as human by Turnitin."(有 96.3% 的概率同样被 Turnitin 当作人写。)

这句话少了一层背景,而页面其他部分其实给了算出它所需的数字:对人写的作文,Turnitin 很少超过 50%。100 篇完全人写加 100 篇 AI 润色,它一共只有 10 篇超过 50%。也就是说,对这两组作文,不跑任何第二个检测器,直接猜「Turnitin 会在 50% 以下」,200 篇里能猜对 190 篇。

人写的 200 篇(100 篇完全人写,100 篇 AI 润色)Turnitin 在 50% 以下
全部 200 篇,不做第二次检测190/200(95%)
40% 设置判为 Original 的 189 篇182/189(96.3%)
40% 设置判为 Likely AI 的 11 篇8/11

这几行是我们根据研究页面上的计数算出来的。189 个 Original 判定全部出自这 200 篇,因为完全由 AI 生成的作文都被这个设置标成了 Likely AI,所以三行说的是同一组作文。拿到一个 Original 结果,把概率从 95% 挪到了 96.3%。

反过来看,这才是一个担心的学生真正关心的方向。Turnitin 把 10 篇润色过的作文打到了 50% 或以上,其中 7 篇,40% 设置给出的都是 Original。10 篇实在太少,得不出任何规律,但这正是预先检测本该拦住的情况,而它只拦住了 3 篇。研究给学生的建议里自己也写得很明白:"Use the 40% AI Allowance as a comparison point, not a Turnitin preview."(把 40% AI Allowance 当作一个参照点,而不是 Turnitin 的预览。)

如果你自己去读这项研究,会看到开头有一行把 96.3% 说成是人写作文上的一致率。下面的详细拆分其实是用 40% 设置判为 Original 的全部 189 篇算的,人写和润色的混在一起。单看那 100 篇完全人写的作文,两款工具篇篇一致。

50% 这条线是研究自己划的,不是 Turnitin 的

就算在 50% 这条线上完全吻合,也说明不了老师那边看到的是什么。Turnitin 的 FAQ 讲了量表低端的显示规则:"no score or highlights are attributed for AI detection scores in the 1% to 19% range"(AI 检测分数在 1% 到 19% 之间时,不给分数,也不做高亮),改为显示一个星号。从 20% 起,报告上就会显示百分比。所以一篇被 Turnitin 打了 30% 或 45% 的作文,在这项研究里算 "treated as human"(被当作人写),而老师的报告上显示的是一个具体数字。低分段的详细情况见 Turnitin AI 率上的星号(*%)是什么意思?。

研究自己也承认这一点:"A score below 50% can still contain text Turnitin marked as likely AI; a score above 50% is not proof of misconduct."(低于 50% 的分数里仍可能有 Turnitin 标为可能是 AI 的文字;高于 50% 也不能证明有不端行为。)它没有报告的,是有多少篇落在 20% 到 49% 之间。对一个想猜「到底会不会出现数字」的学生来说,缺的正是这个数。

把草稿上传到任何地方之前

在一些大学,要不要把草稿放进检测网站,已经写进了规定。我们之前那篇自己的稿子能不能贴进 AI 检测网站?三所大学写下的规定,整理了其中三所在 2026 年 9 月 18 日的规定。简单说:

  • 利兹大学的《Academic Integrity and Assistance Policy》(学术诚信与协助政策,2026 年 7 月 8 日批准,2026/27 学年起实施)写道,它的 Turnitin 教程会讲清楚 "why students should not use AI detector or plagiarism detector websites"(为什么学生不应使用 AI 检测或抄袭检测网站)。这一条是写给学生的。
  • 利兹大学给教职工的指引列了不用在线检测工具的三个理由:这些工具 "insufficiently accurate for the University to use them as evidence"(准确性不足以让大学拿来当证据),上传 "may represent a data security breach"(可能构成数据安全违规),以及 "the document being checked becomes available as training data for other AI tools"(被检测的文件会成为其他 AI 工具的训练数据)。这是针对教职工检查别人作业写的,第三个理由也是泛泛而论,没有点名任何一家服务。
  • 雷丁大学告诉设计和批改考核的教职工:"Student work must not be uploaded into GenAI tools or AI detection tools under the current interim approach."(在现行临时做法下,学生作业不得上传到生成式 AI 工具或 AI 检测工具。)得克萨斯大学奥斯汀分校规定除非签了学校合同,否则不得拿第三方 AI 检测软件来评判学生作业,并把学生对自己作品的版权列为理由之一。它的指引是写给教学和批改的人看的,不过这条禁令本身没有说适用于谁。

这三所都没有说检查自己的作业算不端行为。但在一所写了利兹那种规定的大学,预先检测有可能违反书面指引,换来的却是一个对判断 Turnitin 帮助有限的分数。粘贴任何内容之前,先去查你自己学校当前的页面。Originality.ai 说用它扫描不会把你的论文送进 Turnitin。至于任何检测网站之后怎么处理你的文字,要看它自己的条款。

交稿前你实际能弄清楚什么

  1. 先知道你看不到什么。 Turnitin 的 FAQ 写着:"The AI writing detection indicator and report are not visible to students."(AI 写作检测指示器和报告对学生不可见。)同一处随后给了一条变通办法:"However, with the PDF download feature, instructors can download and share the AI report with students."(不过,借助 PDF 下载功能,教师可以下载 AI 报告并分享给学生。)两边各能看到什么,见学生能看到 Turnitin AI 率吗?学生端与教师端权限对照。
  2. 问老师两件事。 这份作业开没开 AI 指示器?在这门课上它拿来做什么用?这个答案决定了任何分数到底有多重要。还该问谁、按什么顺序问,见提交 Turnitin 前,学生能自己检查什么?。
  3. 如果还是要用别的检测器,就按它自己的刻度读。 Originality.ai 用一个例子解释自家结果:在 15% 设置下看到 "Likely Original"(可能是原创),"should be read as"(应理解为)AI 使用量 "appears to be 15% or less"(看起来在 15% 或以下)。按同样的读法套到 40% 设置上,得到的是「40% 或以下」,这对一份不允许用 AI 的作业几乎说明不了什么。它也没法告诉你 Turnitin 到底会不会显示一个数字。
  4. 留好真正能回答问题的记录。 两家公司指向的是同一样东西。Originality.ai 的帮助页说:"AI detection results should always be considered alongside other evidence of authorship, such as drafts, notes, sources, and document history."(AI 检测结果应始终与其他能证明作者身份的证据一起考虑,比如草稿、笔记、资料来源和文档历史。)Turnitin 的 FAQ 说它的百分比 "should not be used as the sole basis for action"(不应作为采取行动的唯一依据)。草稿和版本历史掌握在你自己手里,不受别人的设置左右。
  5. 如果交稿后有人拿分数说事,要报告本身。 完整的 AI Writing Report PDF 会显示结果,以及被高亮的段落(如果有)。别的检测器给的数字,不管高低,都代替不了它。

常见问题

用 Originality.ai 扫描,会把我的作文放进 Turnitin 的数据库吗? Originality.ai 说不会:"Running an Originality.ai scan does not submit the paper to Turnitin."(用 Originality.ai 扫描不会把论文提交给 Turnitin。)它还说自己 "is not affiliated with Turnitin"(与 Turnitin 没有隶属关系),只能生成自家的报告。Originality.ai 自己会保留什么,要看它自己的条款。

我用的检测器显示 Likely AI,是不是说明 Turnitin 也会标出我? 不一定。在这项研究里,40% 设置把 11 篇 AI 润色过的作文标为 Likely AI,Turnitin 只把其中 3 篇打到 50% 或以上。

设置调得更严,会不会更接近 Turnitin? 这次测试里不会。0%、5% 和 15% 三个设置把 92% 到 95% 的 AI 润色作文标了出来,而 Turnitin 在 50% 线上只标出了 10%;这三个设置在全部 300 篇上与 Turnitin 的一致率都不到一半。

这能说明哪款检测器更准吗? 不能,研究自己也这么说:它 "estimates behavioural similarity. It does not establish which detector is more accurate."(估计的是行为上的相似度,并不能说明哪款检测器更准确。)两家公司各自在文档里怎么描述自己的工具,见 Originality.ai vs Turnitin AI 检测:文档实际说了什么。

参考来源

继续阅读