Turnitin 会用你的论文训练 AI 吗?官方 FAQ 原文怎么说

「Turnitin 拿着我的论文——他们会拿去训练 AI 吗?我能要求他们删掉吗?」这是学生里很常见的担心。官方 FAQ 对这两个问题都没有给出简单的「是」或「否」:训练数据被描述为「代表性样本」加「内部语料库」,但没有排除学生提交;删除则只有机构级整批删除一条路。这篇带你逐句读官方原文,看它承诺了什么、没承诺什么,以及一个学生想让自己的文章离开系统时,实际能走哪条路。

HumanPen 团队

· 4 分钟

短答案

Turnitin 的 FAQ 没说你的提交论文会用于训练它的 AI 检测模型——也没说会被排除。官方原文说模型是用「AI 生成与真实学术写作的代表性样本」训练的,还说 Turnitin 的模型「也在我们庞大的内部学术数据语料库上训练」。

你能实际着手的是删除:FAQ 说机构可以请求整批删除提交数据,且不支持部分删除。FAQ 把它写成机构层面的请求,没有描述任何学生个人移除自己论文的通道。至于你在数据保护法(如 GDPR)下是否另有个人删除权,那是法律问题,这份 FAQ 不涉及。

官方对「训练」的原话

Turnitin 的 AI 检测 FAQ 对「How was Turnitin's model trained?」(模型是怎么训练的)的回答是:

我们的模型是在一段时间内、涵盖不同地域和学科领域的代表性样本上训练的,样本里既有 AI 生成内容,也有真实的学术写作。

另一个 FAQ 回答(检测模型基于什么)说得更进一层:

更重要的是,我们的模型也在我们庞大的内部学术数据语料库上训练。

这两句都没有把「学生提交」点名为训练数据的一部分,也都没有把它排除。「真实学术写作」和「内部学术数据语料库」是官方文本里最接近「这些词从哪来」的描述——而两种说法都把「你的论文到底在不在里面」这个问题留着没回答。

这就是「训练」部分的全部真相:FAQ 既没有否认提交内容可能进入训练,也没有确认。

官方对「删除」的原话

FAQ 里关于数据删除的问题,是从客户——也就是机构——的角度回答的:

可以,客户可以请求整批删除他们的提交;我们无法支持只删除提交数据中 AI 写作检测这一部分的部分删除请求。

这里有两层意思。

第一,删除原则上存在,但请求者是机构。一所大学如果想清掉自己名下的提交数据,可以提出整批删除。第二,你不能只删 AI 检测那一部分——没有「删掉 AI 分、保留论文」这个选项,FAQ 里也没有任何学生个人删除的通道。

所以「我能请求把文章移除吗」这个问题,就这份 FAQ 所描述的而言,答案很直接:走这份 FAQ 不行,它只给出了机构层面的通道。你本人是否直接享有某种权利,取决于你所在法域的数据保护法,而不是这份文件。

FAQ 里关于资料库的那句话

同一份 FAQ 里有学生其实最想找的那句话,它回答的是另一个相邻的担心:

不会。AI 写作检测没有独立的资料库,客户保留选择是否把学生论文加入资料库的权利。

这句话覆盖的是「AI 检测资料库」——也就是「Turnitin 把你的论文归档到一个专门的 AI 检测数据库里」这个想象。FAQ 说:AI 检测没有独立资料库,是否把论文加入相似度资料库由机构决定。

「训练」这个词没有出现在这个回答里。AI 检测资料库和训练数据是两件不同的事,FAQ 把它俩分得很开:检测没有独立库——关于训练,则没有任何声明。

这对你意味着什么

如果你是一个提交过论文、现在担心它去向的学生,把话说透就是:

  • 官方 FAQ 没有确认你的论文在训练模型,也没有承诺它不在。
  • 最接近的官方表述是「真实学术写作」和「内部语料库」——两者都没有排除学生提交。
  • 删除存在,但是机构级整批删除,不是学生级移除;部分删除不支持。
  • 「没有独立资料库」那一句说的是 AI 检测存储,不是训练。

拿着这些信息你能做什么:如果你的担心落在「自己论文的 AI 检测结果」上,实际问题是怎么读分数、怎么重查,而不是数据归属。如果你的担心是机构层面的,通道是你的大学 Turnitin 管理员——FAQ 说「客户可以请求删除」时,说的就是他们。

一句话总结

Turnitin 的 FAQ 既没有确认也没有否认提交论文会训练它的 AI 模型。官方文本把训练数据描述成「真实学术写作的代表性样本」加「庞大的内部语料库」,没有任何一句排除学生提交。删除方面,唯一的官方路径是机构级整批删除请求——没有学生个人删除通道。想知道你的学校到底签了什么,该问的人是你们大学的 Turnitin 管理员,不是直接找 Turnitin 客服。

继续阅读