Turnitin 说我自己抄袭了自己?——这份报告到底在说什么
你的相似度报告显示:匹配来源是你自己——报告把你以前提交的论文列为你论文某段文字的来源。这篇讲清楚机制、官方场景,以及「自我匹配是报告事件,不是判决」。
HumanPen 团队
· 6 分钟
短答案
相似度报告完全可能拿你现在的提交去匹配你自己以前的作品——你的姓名、你的旧草稿、或你以前交过的论文。报告并不是在说「你抄袭了自己」。Turnitin 自己的措辞对此说得很精确:它不在查抄袭,它报告的是「与一个包含此前提交论文的数据库」的文本匹配百分比。
匹配是一个报告事件。重复使用自己的文字在你这门课上是否要紧,是另一件事,它属于你的老师和你学校的政策——不属于那个百分比。
你看到的是什么
「我在抄袭我自己」的场景有三种形态,在报告上长得不一样。
第一种是你的姓名本身。如果一份过去的提交带过你的名字,那个名字可能在之后的相似度报告里被标为匹配。Turnitin 官方指南描述的正是这个情形:学生可能过去提交过一篇论文,如果那份提交上有他的名字,那么——如果没有排除小匹配——他的名字完全可能在后来的报告里被高亮。
第二种是同一篇论文的更早草稿。Turnitin 对比的是它的数据库,而此前提交是数据库的一部分。如果你用 Turnitin 提交过同一篇论文的草稿,终稿回来时就会和更早的版本匹配上。
第三种是一篇有重叠文字的旧论文。你为以前某次作业写过的一段——无论引用还是改写——都可能作为来源出现在当前的报告里。
三种形态是同一个底层情况:数据库里有你写的东西,而当前的提交与它匹配。
你自己的论文为什么会作为来源出现
机制是数据库比对,不是对你这个人下判断。
Turnitin 的学生指南把数据库描述为:互联网上当前和归档的内容、数以千计的期刊与出版物,以及此前提交给 Turnitin 的论文。所以你的早期作品完全可能在对比集合里——但注意它底下的条件:只有当机构的设置把论文放进资料库,论文才会入库。例如 collusion(相互比对)检查,就要求论文被加入标准论文资料库或你所在机构的论文资料库,并且相似度报告设置为立即生成。
所以「数据库里有我的旧论文」还有后半句:你的旧论文在不在里面,取决于你学校做了怎样的配置。如果报告显示了自我匹配,那么这个配置就是把此前提交纳入对比的那一种。
而当当前文本与数据库里的某样东西相似时,它就会被高亮——因为这个系统会高亮任何匹配文本,引用和参考文献也不例外。这正是这个产品的用途:把匹配浮现出来,交给人工审查者看。
官方场景
Turnitin 自己的文档给了三个「学生自己的作品变成匹配来源」的场景。值得按原文读一遍,因为每一个场景的官方解法都紧跟在后一句。
场景一——你的姓名。 学生可能过去提交过论文;如果那份提交上有他的名字,那么——如果没有排除小匹配——他的名字完全可能在相似度报告里被高亮。紧随其后的官方解法是:教师可以通过排除词数来纠正,多数情况下排除 10 个词就能安全地把学生姓名从高亮中排除。
场景二——重复提交草稿。 学生可能用 Turnitin 提交过同一篇论文的草稿,导致终稿拿到 100% 的分数。解法同样在教师侧:他们可以把学生的此前提交从相似度报告中排除掉。
场景三——collusion 检查。 学生作品与同一作业中另一名学生的提交、或与此前提交匹配,通常就是这样被识别出来。这是「与学生的匹配」进入不当行为流程的唯一情形——而且即便如此,也只在资料库与报告设置都开启时才运行。
三个场景的共同模式:官方文本把自我匹配当作一种正常的报告结果,并附带文档化的解决方法,而不是把它当作学生作弊的证据。
这算抄袭吗
这里必须把机制与政策分开,因为把两者混在一起,恰好会产生这份报告引发的恐慌。
机制层面:Turnitin 不查抄袭。它实际做的是把你的提交与它的数据库比对,并高亮匹配的文本。抄袭是使用报告的人做出的判断——指南里说,这份报告是供你在审查流程中使用、以便自行判断是否存在学术不端的工具。
政策层面:未经允许重复使用自己以前提交的作品,在一些学校确实可能是真实的学术诚信问题。这与机制是两回事。报告上的自我匹配既不证明你做错了什么——也不证明你没做错。它是数据。判断属于你的老师;你的学校如何看待重复使用自己的作品,由学校的政策决定,不由百分比决定。
还有一条官方细节值得一提:Turnitin 的学生指南说,你的提交很可能与数据库的某些内容匹配,而且即使你正确使用了引用和参考文献,那些文字仍会被高亮为匹配。匹配不是异常,而是几乎每一份提交的默认状态。
接下来实际会怎样
如果报告显示了自我匹配,现实中的顺序是这样的。
第一步,看清楚匹配到底是什么。打开报告,看被高亮的文字和它的来源。「来源是我姓名出现在页眉」与「来源是我以前的论文、有一段文字重叠」是两件差别巨大的事。上面列的官方场景就是检查清单:姓名、重复草稿、旧论文。
第二步,明白解法是文档化的、且是教师侧的。排除小匹配处理姓名;排除此前提交处理重复草稿;排除引用与参考文献处理被引材料。这些都不是学生侧能做或应该做的事——你不负责配置报告。
第三步,拿着机制去和老师谈。有用的话不是「这是系统错误」,而是「报告比对的是数据库,我的早期提交在里面——这是被高亮的文字」。老师随后可以排除那份此前提交,而这是一个文档化的一步式解法。
结论
「Turnitin 觉得我在抄袭自己」是一种误读,而且官方文档把它解释得很清楚:报告把你的提交与一个可能包含你自己早期作品的数据库比对,高亮任何匹配——你的姓名、你的草稿、你的旧论文——并且不在查抄袭。自我匹配是一个带文档化教师侧解法的报告事件,不是判决。重复使用自己的文字在你这门课上能不能接受,是你老师要按政策判断的问题;报告是这段对话的起点,不是结论。
继续阅读