网课讨论帖被说是 AI 写的:先搞清楚那个数字是谁给的

一学期十几周,每周同一个形状的题,两百词一条,还要再回两条同学的帖。整个学位里没有第二种作业提交得这么频繁、单篇又这么短,而这两点各自都在改变问题的性质。

HumanPen 团队

· 12 分钟

先说结论

Turnitin 公布的 AI 写作报告文件要求里有一条:文件必须包含至少 300 词、以长文形式呈现的散文。它对「合格文本」的定义是「individual sentences contained in paragraphs that make up a longer piece of written work, such as an essay, a dissertation, or an article」——构成一篇更长作品(论文、学位论文、文章之类)的段落里的句子。一条 220 词的周更讨论帖在这条线以下,而它接受的文件类型是 .docx / .pdf / .txt / .rtf,课程网站上那个输入框不是其中任何一种。所以当一个数字落到讨论帖上时,中间一定发生过别的事。先把那件事弄清楚,因为三种常见答案对应三种完全不同的应对。

后半篇讲的是这个作业形态独有的另一件事:写到第九周,你在跟自己前八周的帖子较劲。

文件要求原文,整条列完

出自 Turnitin 关于 AI 写作报告的指南,「File requirements」小节下的完整清单:

  • File size must be less than 100 MB
  • File must have at least 300 words of prose text in a long-form writing format
  • File must not exceed 30,000 words
  • File must be written in a supported language: English, Spanish, Japanese, Arabic
  • Accepted file types: .docx, .pdf, .txt, .rtf

这里有两行常被跳过。

300 词那行是「有没有报告」的门槛,不是「分数准不准」的提示。同一份指南列了指标可能显示的几种状态,其中一种叫 "File didn't meet the requirements",解释是:「The submission does not meet the file requirements needed to successfully process it for AI writing detection.」这跟拿到一个低分是两回事,它压根不是百分比。关于 300 词,厂商还有第二句话,读它的时候要把日期一起读上。Turnitin 发布说明里 2023 年 12 月 15 日那一条记的是一次 bug 修复:这个 bug 「allowed submissions that did not meet the file requirements (less than 300 words) to be processed and given an AI writing detection score」(让不满足文件要求、不到 300 词的提交也被处理、并拿到了 AI 分),同一条写明「this issue has now been resolved」。谈到 12 月 6 日到 15 日之间、bug 还在时已经出来的那批报告,它接着写:「submissions that contain less than 300 words may result in an AI writing score that is likely less accurate.」(不到 300 词的提交,给出的分数可能不那么准。)两句都是官方的,各说一种局面:正常情况下不到 300 词没有报告;而在确实出了报告的场合,厂商自己认为那个分数更不准。分数准不准这一半,Turnitin 对短文档的 AI 分数有多准里拆得更细。

文件类型那行说的是你自己这门课的情况。课程网站里敲进去的一段字不是 .docx 也不是 .pdf。要被这份报告评上,它得先变成一个文件。是谁、用什么方式把它变成文件的,决定了最后那个数字到底在描述什么。

语言那一行,对中文读者是另一件事

支持语言那行印的是 English、Spanish、Japanese、Arabic 四种。阿拉伯语是 2026 年 8 月 18 日才加进来的,此前是三种。中文不在里面。

所以如果你的课程要求用中文发讨论帖,这份报告本身就不覆盖它——不是「查得不准」,是不在范围内。真给出了一个数,那个数不是这份报告给的。至于其他语种提交在 Turnitin 那边是什么处理方式,Turnitin AI 检测支持哪些语言,中文论文会被查吗非英语的提交,Turnitin 能查出 AI 吗分别讲了。

还有一条只写在英文指南里、但对用改写工具的人很要紧:「Please note that only our English AI detector includes AI paraphrasing and AI bypasser detection capabilities.」(只有英文检测器包含对 AI 改写和 AI 绕过工具的检测能力。)这是厂商自己写下的能力范围声明。我们不对任何工具的效果下结论,也不建议你把它当成攻略来读——它的用处只是让你知道,厂商公开声称自己在检测什么。

最后一条对中文读者最实用:很多人写讨论帖的流程是先用中文把想法理顺、再翻成英文交上去。那条路自己会留痕迹,跟 AI 无关,中翻英会被 Turnitin 判为 AI 生成吗机翻会被 Turnitin 判成 AI 吗讲的就是这个。

那个数字常见的来源有三个

发生了什么你看到的样子该问什么
你好几周的帖子被导出、合成一份文件一起提交一个覆盖整学期的百分比,却被当成是在说某一条帖文件里装了哪几周,能不能看到那个文件
跑的不是 Turnitin 的 AI 写作报告,是别的检测器一个数字,背后没有 Turnitin 报告,有时来自某个插件或另一套集成是哪个工具出的
有人读了这条帖,觉得像生成的根本没有数字,只有一条消息没什么可问的。这是一次谈话,不是一份报告

第一行最容易被忽略,而它彻底改变应对方式。如果十一周的帖子被打包成一个文件,那这个分数说的是十一周的写作被混在一起之后的结果,纠结第九周第二段就是在跟错误的对象较劲。

有一个干净的办法判断自己在哪一行。Turnitin 的 FAQ 写着「The AI writing detection indicator and report are not visible to students」,另一处写「only instructors and administrators are able to see the indicator」;同时也写了:「However, with the PDF download feature, instructors can download and share the AI report with students.」所以「能不能给我一份报告的 PDF」是一个有明确机制支撑的合理请求,而回答会把你分到某一行去。拿得出 Turnitin AI 写作报告的 PDF,你在第一行,或者你的提交比你以为的长。谁都拿不出,你在第二或第三行。

落在第二行的话,为什么同一段文字在不同检测器上分数差很多讲了同一段话在两个工具那儿为什么会有两个答案。

这个作业形态独有的麻烦:你在跟自己的旧帖较劲

下面这部分跟长度没关系。

一门课的讨论区连续十几周问你同一个形状的问题。读章节、回应题干、再回两位同学。你是个稳定的人,处理一份阅读材料的方式也稳定,所以到第九周,你的帖子共享同一个开场动作、同样的段落数、同样的切入方式和同样的收尾方式。

Turnitin 的 FAQ 把这个侧写写了出来:

"Sometimes false positives (incorrectly flagging human-written text as AI-generated), can include content without a lot of structural variation, text that literally repeats itself, or text that has been paraphrased without developing new ideas."

紧接着那句是给读分数的人看的:

"If our indicator shows a higher amount of AI writing in such text, we advise you to take that into consideration when looking at the percentage indicated."

一篇论文只写一次。周更讨论区是整个学位里唯一一种要求你按时间表持续产出结构相似文本的作业,而这种相似性是作业设计带来的,不是你决定的。

对策很小,而且不是写作技巧。每周记一行:你这次是用什么动作切进去的。不是记内容,是记那个切入动作。几个彼此真的不同的动作:

  • 一个读完材料仍然答不上来的疑问
  • 指定读物里某一句原话或某个数字,带页码
  • 两份指定读物互相打架的地方
  • 你自己工作、实习或实验里跟读物对不上的事
  • 某个术语,你觉得作者前后用了两个意思

然后四周之内不重复同一个动作。一周花不到一分钟,完全在你自己手上,而且副作用是帖子本身变好了——那才是老师真正在看的东西。

重复自己,是另一份报告的事

这两件事经常被混在一起,然后改错地方。

如果你把第三周的一段搬进了第九周的帖子,那是重复文本的问题。Turnitin 说得很直接:

"The Similarity score and the AI writing detection percentage are completely independent and do not influence each other."

所以跨周重复自己是相似度那一侧的问题;而你自己更早的帖子有没有进入比对范围,取决于你学校有没有把提交内容加入比对库,这是学校的设置,不是 Turnitin 的固有行为。Turnitin 会存储你的论文吗讲了比对库这件事,Turnitin AI 写作报告和相似度报告有什么区别讲了两份报告各自在测什么。

落到操作上:为了让 AI 那个数字下来而去重写一段重复内容,是在瞄错报告。

这个形态有一个优势,几乎没人用

说点好消息,而且是真的好。

讨论区是唯一一种会替你逐周攒出写作样本的作业形态。到第九周,有八篇带日期的你自己的文字,躺在一个不归你控制的系统里,写于任何争议发生之前,时间点由别人定。

这比大多数人能为一篇期末论文拿出来的记录都好。微软自己的文档写着,版本历史「only works for files stored in OneDrive or SharePoint in Microsoft 365」——一份在你笔记本上躺了六周、从没上过云的 .docx,根本没有版本历史。各个工具的记录到底存在哪里,我们在怎么在 Word、Google Docs 和 Overleaf 里留住版本历史里逐个列过。讨论区是无意中绕开了这整个问题。

有一件事现在就该做,别拖到第十一周:每周把自己的帖子连同日期复制进同一份文档。一周十秒。如果你学校在学期结束后关掉课程访问权限,那批语料就跟着没了,而你真正需要它的时刻,通常在课程结束之后。

这个形态的形状就是这么拧巴:同一串帖子,一边让你的写作看起来重复,一边又是你这一年里能攒下的、关于自己怎么写字的最好证据。

如果你真要改一条

先说两句实在话。

第一,一条 200 词的帖子里没什么可圈的范围。这种时候有用的是一个人加十分钟,不是软件。

第二,这里没有任何关于分数的承诺,两个方向都没有。Turnitin 自己说模型「may not always be accurate (it may misidentify human-written, AI-generated, and AI-paraphrased text), so it should not be used as the sole basis for adverse actions against a student.」

软件真正开始值钱的是打包那种局面:十一周的帖子装在一份文件里,大部分没事,被标出来的只有四段。HumanPen 就是为这个形状做的。不进范围的东西不动,而范围由你定:手动圈,或者丢一份 Turnitin / iThenticate 的 AI 报告进去,让被标的那些自己填进清单。第二周和第五周还是你敲下去时的样子。计量单位是段,覆盖了半段就整段拉进来,并先回显给你看。收费按被改写的字数走,不按整份文件走。DOCX、PPTX、TXT 都收得进去,TXT 会保住换行和缩进——讨论帖本来就长这样。回来仍被标出的部分,在满足条件时可以再走一轮,不另外收费。

它的 FAQ 说复杂文档下载之后要过一遍。放在讨论区,这一遍有一个很确定的目标:帖子是一次对话里的一轮发言。改完之后如果它不再回答题干,或者接不上你当时在回的那个同学,那么任何数字都换不回你刚才丢掉的东西。

常见问题

我的帖子只有 180 词,Turnitin 能给它 AI 分吗? 公布的要求是至少 300 词、长文形式的散文。低于这条线,指南描述的是 "File didn't meet the requirements" 这个状态,而不是一个百分比。至于你学校的系统在把讨论帖送到任何检测器之前做了什么,那是要问任课老师的,不是一篇通用文章能回答的。

每周要回的那两条同学帖呢? 五十词的回复单独看远在门槛之下。它有没有被算进去,取决于提交是怎么拼出来的,跟上一题是同一个问题。值得问,因为一条引用了同学原话的回复,会把别人的文字一起带进被检测的内容里。

300 词这条线对相似度报告也成立吗? 不成立。这里引的是 AI 写作报告的文件要求,只针对这一份报告。相似度那边是另一份报告、另一套行为,Turnitin AI 写作报告和相似度报告有什么区别里有。

那我是不是不该每周都像自己? 不是,而且你想改也改不掉。要变的是切入阅读材料的方式,不是你的语感。Turnitin 那份清单说的是结构上的雷同和字面上的重复,不是「有辨识度的文风」。到底该不该为了躲检测而改变自己的写法,为了不被标红,要不要改自己的写法在辩这件事。

分数回来是个星号,没有数字。 那是显示规则,不是结果。高于 0%、低于 20% 阈值的分数只显示星号,不给百分比也不给高亮,Turnitin AI 报告上的星号 (*%) 是什么意思解释了这一条。

检测器给我的帖子打了个低分,能说明什么吗? 两个方向都说明不了。厂商自己的说法是模型可能误判人写的、AI 生成的和 AI 改写过的文本,不应作为对学生采取不利行动的唯一依据。没有任何工具能确定一份文件的作者是谁。

继续阅读