为什么截止日期后你的 Turnitin 相似度变了——重生成机制

你提交时相似度 8%,现在变成了 25%。Turnitin 的文档和大学 FAQ 描述了原因:你提交时看到的报告不含同班同学之间的匹配;截止日期过后,报告会为整个作业重新生成,加入同学间匹配。没有人在改你的论文——报告现在是另一份更完整的视图。机制如下。

HumanPen 团队

· 5 分钟

短回答

你的相似度分数可能在截止后变化,因为 Turnitin 实际上是跑了两次比对。提交时,报告把你的论文与已有提交库、期刊和互联网来源比对——但不比对同班的其他同学。截止后,Turnitin 为整个作业重新生成报告,加入同学间的匹配。大学 FAQ 把它描述为:截止后相似度报告「为作业里的所有论文完整地、自动地重新生成」。这就是为什么分数可以从提交时的 8% 变成之后的 25%——不是有人改了你的论文,而是后来的报告包含了第一份没有的一类匹配。

为什么会这样:报告跑两次

Portsmouth 大学的指南用一句话总结了机制:

「Turnitin reports run twice. Once upon submission. Once when the dropbox closes.」(Turnitin 报告跑两次:一次在提交时,一次在收件箱关闭时。)

第一次跑回答「我的论文有多少匹配现有来源?」第二次跑回答「有多少匹配现有来源加上同学?」UCL 学生 FAQ 直接说明了第一次跑:

「The similarity report that is immediately generated and provided to the student, before the assignment Due Date does NOT include matches to other student papers in the same assignment. Before the assignment Due Date passes, the similarity report only includes matches to existing student papers within the Turnitin database, journals and publications, and other internet sources.」(截止日期前立即生成并提供给学生的相似度报告,不包含同作业里其他学生论文的匹配。截止日期前,报告只包含与 Turnitin 数据库里已有学生论文、期刊与出版物、以及其他互联网来源的匹配。)

所以提交时的低分不是错误——它是设计上不完整的视图。完整视图稍后才到。

截止时发生了什么

截止时,第二次跑发生在每个人身上。UCL 的 FAQ 接着说:

「After the Due Date has passed, the similarity report is completely and automatically re-generated for ALL papers in the assignment, thus also comparing papers between students in the same assignment. This may result in the similarity percentage that is displayed after the Due Date differing from the result displayed at the time of submission.」(截止日期过后,该作业里所有论文的相似度报告会被完整地、自动地重新生成,因此也会比较同一作业里学生之间的论文。这可能导致截止后显示的相似度百分比与提交时显示的结果不同。)

Turnitin 官方学生指南从串通检测的角度描述了同一次最终检查:

「Turnitin can identify that collusion has taken place in this scenario by running a final similarity check against all submitted assignments after the due date. This ensures that every student is subject to the same level of scrutiny, regardless of when they submitted their assignments.」(Turnitin 通过在某截止日期后对所有已提交作业运行最终相似度检查,可以识别出这种场景下的串通。这确保每个学生都受到同等程度的审查,无论他们何时提交作业。)

关键词:完整地(completely)自动地(automatically)所有论文(for ALL papers)。重新生成不是针对你个人的,也不是手动操作。作业里的每个人都会得到同一次最终检查。

为什么全班可能一起涨

分数在截止时跳涨最常见的原因不是抄袭,而是共同文本。西悉尼大学的 FAQ 指名了这个场景:

「Students may notice an increase in similarity after the due date if an assignment template has been used. In a situation where students have used template text such as table headers or report sections, these sections of text will only show as matches within the class group after the due date has passed.」(如果使用了作业模板,学生可能会注意到截止后相似度上升。如果学生使用了表格表头或报告章节这类模板文字,这些文字段只有在截止后才会显示为班级内的匹配。)

想想这是怎么发生的:说明页上的模板文字、表头、固定的章节——每个学生都在用同一段文字。提交时,这段文字不会匹配同学,因为同学不在比对范围内。截止后,全班被放进同一比对,共享的模板文字在每个人的论文间互相匹配,于是全班的分数可能一起上涨。当两个或更多学生独立地包含同一段引用或同一来源材料时也会这样——截止时班级内的比对面变大了。

什么不会变

有两件事是固定的,这两件都值得知道,因为它们常是焦虑的来源:

  • 晚交不会触发别人报告重新生成。 UCL:「仅仅因为一个学生晚交,作业不会为已交论文重新生成报告。」如果有同学在截止后提交,按时提交的论文的报告不会为了包含这份晚交而重算。西悉尼大学说得一样:按时论文的报告「不会考虑或包含晚交」。
  • 提交时的报告是真实的。 你提交时看到的 8%,是「对班级之外来源的匹配」这一件事的准确报告。它没有谎称没有匹配;它报告的是那一刻存在的比对。

这对你意味着什么

读懂这个机制会改变你面对分数变化时的反应:

  1. 不要假设被动了手脚。 重新生成是自动的、全班性的。如果你的分数动了,是机制动了——没有人在编辑你的论文。
  2. 知道两个数字含义不同。 提交时分数 = 与外部数据库的匹配。截止后分数 = 外部匹配加同学匹配。它们都是真实的;它们是不同的问题。
  3. 如果你和别人共享可见文本,预期会涨。 如果你们班用了模板,或者你和别人引用了同一段话,截止时上涨是机制,不是判决。
  4. 如果你觉得有哪里不对,去问老师。 报告是老师的调查工具;他们可以打开你的报告、解释什么变了、为什么变——而且他们才是解读它的人。

结论

截止后相似度分数变化是这个工具被文档化的行为,不是谜团,也不是被动手脚。报告跑两次:提交时(只查外部来源,不含同学)和截止时(为所有论文重新生成,包含同学)。常见的共享文本——模板、标题、引用段落——正是让全班分数一起上涨的东西。晚交不会给按时论文触发新的重跑。两个数字是你的论文的两个视图,各自对它比对的内容都是准确的。如果你看到分数在截止后动了,现在你知道发生了什么——如果它还是让你担心,就让老师带你过一遍你的报告。

继续阅读