英文综述 AI 率高怎么办?原因和应对

文献综述改写几十个来源,每段结构相似,句子层面没有新观点。这恰好匹配 Turnitin FAQ 中误判易发文本的描述。理解你的综述为什么拿高分是处理它的第一步。

HumanPen 团队

· 10 分钟

简短回答

文献综述在结构上就容易拿高 AI 分,原因根植于这个体裁本身。综述需要概括和综合已有研究,这意味着它在大量改写。每段都在复述其他研究者的发现,句子结构往往相似,因为来源材料遵循相似模式。Turnitin 的 FAQ 把"content without a lot of structural variation"(结构变化少的文本)和"text that has been paraphrased without developing new ideas"(只改写没产生新想法的文本)列为容易误判的特征。文献综述天然可能同时匹配这两条描述而完全不涉及 AI。高分可能反映的是文本的统计特征而不是来源。理解这一点不会让分数消失,但它解释了为什么完全人写的综述可以拿到高 AI 百分比。

为什么综述匹配误判特征

Turnitin 的 FAQ 声明:

"Sometimes false positives (incorrectly flagging human-written text as AI-generated), can include content without a lot of structural variation, text that literally repeats itself, or text that has been paraphrased without developing new ideas."

下一句:"If our indicator shows a higher amount of AI writing in such text, we advise you to take that into consideration when looking at the percentage indicated."

这三条描述中三条都天然适用于文献综述。"Content without a lot of structural variation"描述的是每段都遵循相同模式的章节:研究者 X 发现 Y,研究者 Z 发现 W,研究者 A 确认 B。"Text that literally repeats itself"描述的是连接摘要的重复措辞:"Similarly"、"In contrast"、"Building on"、"Consistent with"。"Text that has been paraphrased without developing new ideas"描述的正是文献综述在句子层面做的事。你在复述发现,不是在大多数文本中生成原创论点。FAQ 在说这类文本恰恰是可能产生误判的类型。而 Turnitin 建议教师在读分数时把这种情况考虑进去。

散文密度问题

还有一个结构性原因让综述比其他章节产出更高百分比。Turnitin 只分析"qualifying text"——FAQ 定义为"prose sentences, meaning that we only analyze blocks of text that are written in standard grammatical sentences"。FAQ 接着说:"This percentage is not necessarily the percentage of the entire submission."

结果部分可能包含表、图、公式,这些被排除在分析之外。方法部分可能包含列表和项目符号。但文献综述几乎全是散文。每段都是 qualifying text。这意味着被评分的文档比例更高,更多片段在产生概率值并汇入总分。一篇同样长度的综述和结果部分可能产出不同的 AI 百分比,部分原因就是综述有更多被检测器评估的 qualifying text。同一套密度的道理,也是Turnitin 把我整章方法都标红了这种抱怨为什么这么常见。

引言和结论部分

Turnitin 2023 年 5 月的 release note 描述了一个和文献综述相关的模式:

"Since launch, we have observed a higher incidence of false positive detection in the first few or last few sentences of a document. Many times these sentences consist of introduction or conclusion content written in a generic way. As a result, we have changed our detection logic to help reduce these false positives."

下一句:"We also worked on making our segment boundaries detection more precise which could lead in some rare cases to change of boundaries compared with a previous version."

这是 2023 年的一项改进,不是现行缺陷。但它描述的模式,泛化的引言和结论内容,正是文献综述开头和结尾段落常见的。如果你的综述以"Research on X has grown significantly in recent years"开头,以"In summary, the literature suggests that..."结尾,这就是历史上和误判关联的泛化措辞。检测逻辑已更新以减少这种情况,但底层模式在许多综述中仍然存在。

AI 分和相似度分是独立的

还有一点需要理解。Turnitin 的 FAQ 声明:"The Similarity score and the AI writing detection percentage are completely independent and do not influence each other."

文献综述通常有中到高的相似度分数,因为它引用和引述已有研究。这是预期的,不是问题。但有些同学以为相似度分高意味着 AI 分也会高,或者降相似度分就能降 AI 分。两者都不对。这两个测量是独立的。你的综述可以同时有 30% 的相似度分(来自正确引用的来源)和低 AI 分,也可以有 5% 的相似度分和高 AI 分。在其中一个上下功夫不影响另一个;出错最多的地方就是两种分数不要混着看

拿到高分怎么办

总结一下我们讲的内容:

  • 文献综述匹配 Turnitin 的误判易发特征:结构变化少、重复、只改写不加新想法。
  • 综述几乎全是散文,意味着有更多 qualifying text 被检测器评分。
  • 泛化的引言和结论内容历史上与误判关联(已在 2023 年更新中处理)。
  • AI 分和相似度分独立。降低一个不影响另一个。
  • Turnitin 建议教师在读到这类内容上的高 AI 分时把文本类型考虑进去。

如果你有 Turnitin 报告显示综述中哪些段落被标记了,可以导入报告专门处理那些段落。综述的其余部分原样保留。这一点要紧,因为大范围改写时最容易出事的正是改写文献综述时,怎样避免观点和引用错位。符合条件时可以免费继续降 AI。

继续阅读