用了 Grammarly,Turnitin 会把它判成 AI 写作吗?

这是这个话题里少有的、厂商用大段文字正面回答过、而且任何人都能打开原页去看的问题。也是流传最广的那版摘要,恰好把最吃重的那个限定词丢掉了的问题。

HumanPen 团队

· 6 分钟

先说结论

拼写、语法、标点这类修改:Turnitin 说它自己做的测试里,「in most cases」(多数情况下)没有被标红。Grammarly 的生成类功能是另一回事,而且 Turnitin 是在同一段里说的——用起草生成、改写、摘要「and other features」(以及其它功能)产出的内容,会「likely be flagged as AI-generated by our detector」(很可能被我们的检测器判为 AI 生成)。这条线划在「把你写的句子改对」和「让工具替你写出一句你没写过的话」之间。

要看整段,不能只看前半句

下面是 Turnitin AI 检测能力 FAQ 上那条回答的全文。之所以全文照抄,是因为这段里的每一个从句,都能在某个地方找到被引错的版本:

「No. Our detector is not tuned to target Grammarly-generated spelling, grammar, and punctuation modifications to content but rather, other AI content written by LLMs such as GPT-3.5. Based on tests we conducted on human-written documents with no AI-generated content in them, in most cases, changes made by Grammarly (free & premium) and/or other grammar-checking tools were not flagged as AI-written by our detector. Please note that this excludes content generated by Grammarly's generative AI-powered features, including draft generation, paraphrasing, summarizing, and other features. Content produced using these features will likely be flagged as AI-generated by our detector.」

有三处,短摘要通常留不下来。

「in most cases」是一个真的限定词,不是修饰语。Turnitin 描述的是它在「不含任何 AI 内容的文档」上跑出来的自家测试结果,即便如此,它也没有不加限定地说「不会被标红」。

那份排除清单的结尾是「and other features」,这是开放式的。一个功能如果是在替你写文字、而不是在改你写的文字,就当它落在生成那一侧,不管这个月界面上管它叫什么名字。

而「will likely be flagged」已经是检测厂商能说到的最直接的程度了。这不是一句风险提示,这是一个预测。

这条线到底划在哪儿

不是按产品分,是按动作分。把你那句话里的一处标点改对,句子还是你的;让工具「把这段写得更清楚一点」,回来的是工具组织出来的一段话。这两件事在同一个订阅里,这正是这个问题反复被问的原因。

难办的是中间那一档:改写建议被做成一个按钮,上面写着一句听起来很友好的话。如果你在讨论部分里一路接受了十几处这样的建议,你交上去的文字就有一部分是模型组织的——不管你当时的体感是不是「我在编辑」。

只改了语法,为什么还是可能被标红

上面那段回答讲的是「检测器被调校成针对什么」,它不是对你这份文档的担保。同一份 FAQ 里,Turnitin 点名了自家误报常见于哪几种文本特征:

「Sometimes false positives (incorrectly flagging human-written text as AI-generated), can include content without a lot of structural variation, text that literally repeats itself, or text that has been paraphrased without developing new ideas.」(结构变化不大的内容、字面上自我重复的文本、改写过但没有产生新观点的文本。)

紧接着的下一句几乎没人引:「If our indicator shows a higher amount of AI writing in such text, we advise you to take that into consideration when looking at the percentage indicated.」——厂商在这里是让教师,在这类文本上看到偏高的分数时,把这一点考虑进去。这句话值得随手存着。

把这两条事实放到一起看。大量的句子级修改——不管来自哪个工具,还是来自一个很细心的人——都倾向于把稿子里的结构变化抹平。这是我们的解读,不是 Turnitin 的说法;但它能解释一篇语法干净的论文为什么回来时带着一个数字,也指向一种你真的做得出来的辩护:把更早、更粗糙的那几版草稿拿出来。

Authorship 检查问的完全是另一个问题

如果你的学校同时开了 Authorship 这类功能,不要把它的结果当成对 AI 的第二意见。Turnitin 的 FAQ 是这样描述它自家 Authorship 产品的:它「uses metadata as well as forensic language analysis to detect if the submitted assignment was written by someone other than the student」(用元数据加语言取证分析,判断提交的作业是不是由学生本人以外的人所写),并且「it will not be able to indicate if it was AI written; only that the content is not the student's own work」(它无法指出是否为 AI 所写,只能指出内容不是学生本人的)。

「这份文件是怎么来的」和「这段文字有多大概率是 AI」,是关于你文档的两种不同主张。任何能记录一份文件如何形成的东西,回答的正是检测器答不了的那个问题——下面那份写作记录之所以比看上去值钱,也是这个道理。

如果你用得很多、而且确实担心

别因为害怕就改掉自己的写作习惯,把写作记录留下来就行。版本历史、带日期的文件、那份留着你后来删掉的段落的凌乱二稿。这类证据站在「百分比到底意味着什么」这场争论之外,所以它扛得住(在 Word、Google 文档和 Overleaf 里怎么留)。

如果已经被标红了,第一步是把报告读明白,而不是先去改论文(确实是你自己写的该怎么办)。

常见问题

交稿前该不该把 Grammarly 关掉? Turnitin 公开的立场是,它的检测器没有被调校成针对拼写、语法、标点这类修改。真正对得上 FAQ 原文的做法,是把生成类功能关掉。

这个结论对其它语法检查工具也成立吗? 原文写的是「Grammarly (free & premium) and/or other grammar-checking tools」,所以被测试的这个说法比单一产品要宽。生成类的那条排除也是同一个逻辑:一个替你写文字的功能,不算语法检查工具。

学校说用 Grammarly 没问题,那是不是就不会被标红? 不是,这两件事值得分开看。规定管的是「允不允许」,检测结果是一个统计量。你完全可以既没违反任何规定,手上又拿着一份带数字的报告。

检测器知道我这份文件被哪个工具动过吗? 它不会报出来。Turnitin 对模型的描述是:按「这段文字更可能是人写的还是更可能由 AI 生成」的概率给片段分类(这个测量到底是什么)。

继续阅读