Turnitin 怎么检测串通作弊(collusion)?截止日互查机制与 Eric & Jane 示例

你的相似度分数截止日前是 18%,截止两天后变成 72%——报告里还出现了和同学论文的匹配。先别慌着认定自己被标记,先弄清到底发生了什么:Turnitin 在截止日后跑一次最终的同学互查,所以学期中互不匹配的论文会在截止后突然互相暴露。Turnitin 官方文档描述了这套机制、说明「为什么抄的人分数反而低」的 Eric & Jane 场景、以及决定你学校到底跑不跑互查的设置。本文讲机制、讲它制造的那些困惑、也讲分数一夜之间变了该怎么应对。

HumanPen 团队

· 7 分钟

简短回答

Turnitin 通过把同一作业的提交互相比对来识别 collusion——对多数作业来说,这种同学互查在截止日之后自动运行。Turnitin 官方学生指南把 collusion 定义为「学生的作业与同一作业里另一名学生的提交、或与之前提交过的论文匹配时被发现」,帮助中心补充说这种比对「通常只在作业截止日期过后自动发生」。截止日后分数跳升,往往是这个检查在按设计工作,而不是你被追加了什么新指控。

collusion 检测到底是什么

官方学生指南(Understanding the similarity score for students)以定义开头:

"Collusion is typically identified when a student's work matches with another student's submission on the same assignment or to previously submitted papers."(当学生的作品与另一名学生在同一作业中的提交内容或先前提交的论文相匹配时,通常会识别出共谋。)

注意两点。第一,匹配对象是另一名学生的提交——不是网站。第二,它也覆盖「之前提交过的论文」(包括你自己在别的课上交过的旧稿,这滑向自抄袭,下文展开)。collusion 检查不是独立的 AI 检测器;它是相似度数据库在做「论文对论文」的比对。

Eric & Jane 场景

Turnitin 官方指南用两个学生演示机制如何运转:

"Consider the following scenario: Eric acquired a copy of his classmate Jane's paper. Eric submits Jane's paper as his own and receives a similarity score of 25%. Jane, who originally wrote the paper, submits her work a few days later and receives a 100% similarity score."(考虑以下场景:Eric获取了同学Jane的论文副本。Eric将Jane的论文作为自己的提交,并获得了25%的相似度评分。最初撰写该论文的Jane几天后提交了她的作品,并获得了100%的相似度评分。)

指南接着解释时机:

"Turnitin can identify that collusion has taken place in this scenario by running a final similarity check against all submitted assignments after the due date."(Turnitin可以通过在截止日期后对所有提交的作业进行最终的相似度检查,来识别在此场景下是否发生了串通。)

仔细读这段话,因为它颠覆了常见假设:Eric(抄的人)得了 25%,Jane(原作者)得了 100%。如果检查在截止日前跑,Eric 的论文只匹配到互联网——那时还没有别人提交。截止日后,最终互查把 Jane 的论文与所有提交比对,包括 Eric 那份拷贝,所以她的分数跳到 100%。抄的人分数低不是清白的证据,作者分数高也不是有罪的证据——数字反映的是提交顺序,不是作者身份。

为什么互查在截止日后跑

Turnitin 帮助中心用专文「Why are papers submitted to the same Turnitin assignment not matching to each other?」解释了原因:

"Papers submitted to the same Turnitin assignment do not match against each other immediately upon submission."(提交到同一个Turnitin作业的论文在提交时不会立即相互匹配。)
"To prevent students from matching against their own drafts, peer-to-peer comparison (known as collusion checking) typically happens automatically only after the assignment due date has passed."(为了防止学生与自己的草稿匹配,点对点比较(称为串通检查)通常仅在作业截止日期过后才会自动进行。)
"If your Standard (Classic) Assignment is set to allow resubmissions, all Similarity Reports are automatically regenerated within one hour after the assignment due date and time."(如果您的Standard (Classic) Assignment设置为允许重新提交,所有Similarity Report将在作业截止日期和时间后的一小时内自动重新生成。)

截止日时机服务于两个目的:不管学生什么时候提交,每个人都受到同等程度的检查;同时学生自己的早期草稿被排除,重交不会反过来算到自己头上。截止日前,报告只查外部来源(互联网、期刊、资料库)——同学之间根本不在比对范围内。

为什么截止日后我的分数变了

同一帮助中心页描述了可见的后果:

"Similarity Reports generated before the due date only check submissions against external sources... meaning student papers will not match against one another until the deadline passes."(在截止日期之前生成的Similarity Report仅根据外部来源检查提交的作业……这意味着学生论文在截止日期过去之前不会相互匹配。)

所以周一 18%、周四 72% 的报告,最可能的原因就是互查把报告重新生成了——与同学论文的匹配一直都在,只是到最终一轮才显现。这正是我们「截止日后分数为什么变」一文背后的机制:那篇讲现象,这篇讲机制。

Turnitin 关于 collusion 的官方博客补充了让检查成为可能的设置:

"The standard and institutional paper repository must be selected to compare student work against previous submissions. If 'no repository' is selected, a collusion check cannot take place."(必须选择标准和机构论文存储库,才能将学生作业与以前的提交进行比较。如果选择了“no repository”,则无法进行串通检查。)

如果你的学校没启用资料库,互查根本跑不了——「匹配到同学」也完全可能有别的解释。

collusion 与自抄袭的区别

两种不同的模式都会显示成「与另一名学生论文匹配」,Turnitin 文档把它们分开。官方博客(Effective solutions)用了 Celine:

"Celine has submitted the same paper to multiple classes... She's checked her Similarity Report, which shows a match against another student in her institution... This is an example of self-plagiarism."(Celine将同一篇论文提交给了多个班级……她检查了她的Similarity Report,显示与她所在机构的另一名学生匹配……这是自我抄袭的一个例子。)

教师端解读指南补充了相反情形:

"A student may have used Turnitin to submit drafts of the same paper, meaning their final draft has resulted in a score of 100%... the instructor can rectify this issue by excluding the student's previous submissions from the Similarity Report."(学生可能使用Turnitin提交了同一篇论文的草稿,这意味着他们的最终草稿导致了100%的分数……教师可以通过从Similarity Report中排除该学生以前的提交来纠正此问题。)

collusion 博客还划了边界:

"Turnitin automatically excludes papers submitted by the same student to the same assignment, preventing previous drafts from skewing similarity scores."(Turnitin 会自动排除同一学生提交至同一作业的论文,防止之前的草稿影响相似度得分。)

所以:同一个学生、同一作业 → 草稿自动排除;同一个学生、不同班级 → 自抄袭以匹配形式出现;不同学生、同一份作业 → collusion 场景。如果你的匹配对象是你自己在别处提交过的论文,那不是 collusion 检查——那是自抄袭,需要另一种对话(解法也不同:老师可以把你之前的提交排除掉)。

同学匹配意味着什么、不意味着什么

Turnitin 博客很谨慎地说明匹配能证明什么:

"A high similarity score does not always suggest that a piece of writing has been plagiarized, just as a low similarity score does not always indicate that no plagiarism has occurred."(高相似度得分并不总是表明一篇文章存在抄袭,正如低相似度得分并不总是表明没有发生抄袭一样。)

它的 collusion 检查文章还提醒不要凭推断信号下结论:

"Sometimes roommates using the same Wi-Fi router take the class together so this isn't necessarily a sign of collusion. However, if two or more students normally log in with different IP addresses, but suddenly are using the same IP address and starting exams at nearly the same time, it suggests [unauthorized] collaboration."(有时使用同一 Wi-Fi 路由器的室友会一起上课,因此这不一定表示存在共谋。但是,如果两名或更多学生通常使用不同的 IP 地址登录,却突然使用相同的 IP 地址并在几乎相同的时间开始考试,则表明存在[未经授权的]合作。)

共享 Wi-Fi 或相近措辞只是调查线索,不是判决。报告标记或排除匹配文本;由人(你的老师)决定它意味着什么,而你的回应应该是一场以草稿和修改历史为支撑的对话——与我们申诉指南和版本历史指南同一套证据打法。不该做的是:把「匹配到同学」当成无法回应的定罪,或者为了让提交躲过互查去改稿——逃避最终比对的改动,恰恰是这个检查要抓的行为。

你的作业里互查什么时候跑

帮助中心把时机与作业配置绑定:

"If your Standard (Classic) Assignment is set to allow resubmissions, all Similarity Reports are automatically regenerated within one hour after the assignment due date and time... If your assignment is configured to generate reports immediately but treats the first submission as final, Turnitin will not automatically regenerate reports on the due date."(如果您的 Standard (Classic) Assignment 设置为允许重新提交,所有 Similarity Report 将在作业截止日期和时间后的一小时内自动重新生成……如果您的作业配置为立即生成报告,但将首次提交视为最终提交,Turnitin 将不会在截止日期自动重新生成报告。)

在较新的 Standard 作业里,互查还可以提前强制触发——帮助中心描述了一个 Refresh Reports 按钮,可以按需把所有论文交叉比对。对学生的实际意义:截止日后你的报告会不会变,由作业怎么配置决定,跟你做了什么无关。如果分数确实动了,collusion 互查是最可能的原因。

底线

Turnitin 的 collusion 检测是同一作业提交之间的同学互查,多数作业在截止日之后自动运行。这正是 Eric & Jane 场景里原作者得 100%、抄的人得 25% 的原因——数字跟随提交顺序,不跟随作者身份。截止日后分数跳升通常是最终互查在重新生成你的报告;匹配到同学是对话的起点,不是判决。如果匹配到的是你自己在别的班交过的论文,那是自抄袭,老师可以排除。如果资料库没开,互查根本不会发生。匹配出现时,用证据和讨论回应——不要用逃避。

继续阅读