怎么读一份 Turnitin AI 检测报告
那个百分比不是"你的文档里有多少比例是 AI"。它是文档中某个特定子集的比例——搞清楚是哪个子集,这类报告里大部分看起来不对劲的地方就解释得通了。
HumanPen 团队
· 8 分钟
那个百分比不是你文档的百分比
这是报告里最常被读错的数字。Turnitin 自己的定义是合格文本(qualifying text)所占的比例,而合格文本指的是长文格式中的散文句子:出现在段落里、组成一篇完整文章的那些句子——essay、学位论文、期刊文章都算。
其余一切都不参与计算。Turnitin 声明该模型在非散文文本上无法可靠检测,并明确点名了诗歌、脚本、代码,以及短文本或非常规写作:项目符号、表格、注释书目。
一篇有一半是表格和列表的论文得了 30%,这不是"你论文的 30%"。这是 Turnitin 愿意评估的那部分散文中的 30%,而那部分可能只占你提交内容的三分之一。
还有一个下限:提交的内容必须包含至少 300 词的长文格式散文,才会生成报告。低于这个量,不是给你一个低分,而是根本没有百分比。另一头也有上限:AI 报告最多处理 30,000 词,所以一篇完整的学位论文拿不到一份覆盖全文的报告。
为什么高亮和数字对不上
读者经常发现高亮的段落加起来根本凑不出那个百分比,于是认为哪里坏了。没有坏。Turnitin 直接说了:包含多种写作类型的文档必然会出现百分比与高亮不一致的情况。
百分比是在合格文本上算的。而高亮标注在整篇文档上,文档里还包含不参与计算的部分。两者的分母不同,所以肉眼对不上是必然的,拿一个去核对另一个是白费功夫。
高亮真正有用的地方是分布。标记落在哪里,比标记有多少更能说明问题。
两种分类,以及第二种意味着什么
报告把百分比拆成两种检测类型。
- 仅 AI 生成 —— 模型判断很可能来自大语言模型的文本,也可能之后又被绕检测工具改动过。
- AI 生成后又经 AI 改写 —— 判断为很可能是 AI 生成、随后又被 AI 改写工具或同义词替换器处理过的文本。Turnitin 的文档里点名了 QuillBot 作为例子。
第二个分类值得停下来想想。改写这一步瞒不过模型:把 AI 文本过一遍改写器,恰恰是检测器专门训练过来抓的模式,而不是绕过它的方法。如果你疑惑过为什么改写之后分数没降,这就是有文档依据的答案。
很多人对改写工具的失望,根源也在这里。同义词替换保留了句子的骨架,而模型读的正是那个骨架——这一点可以对照检测器实际在测什么一起看。
如果你看到的是星号而不是数字
从 2024 年 7 月 8 日起,当模型检测到的 AI 比例低于 20% 时,报告显示星号,不给出百分比,也不给高亮。
Turnitin 给出的理由是:测试发现 0–19 这个区间的误判率更高。与其发布一个自己都不信的数字,不如发布一个星号。
这是厂商在拒绝为自家产品的低分区间背书——在把一个小数字当回事之前,值得知道这一点。如果你的报告早于 2024 年 7 月,可能仍会看到旧规则下生成的数字。
这份报告不是什么
Turnitin 明确声明:它不判定学术不端;它提供数据,由教师依据本机构的政策做出判断。这个数字是供人做判断用的参考,这是厂商自己说的。
如果这样一份报告正压在你头上,这也是最有用的一条。该问的不是"怎么把这个数字降下去",而是"这个数字被拿来做什么用,我们学校的政策规定它意味着什么"。
如果你想确切看到哪些段落被标记而不是靠推断,把报告连同文档一起导入会把它们定位出来,其余部分一个字不动。
继续阅读