相似度 2% 但 AI 分 21%?这份组合报告怎么读

报告拿回来了:相似度 2%,AI 分 21%。第一个数字说你的文本几乎没撞上任何已发表内容;第二个说模型觉得你的文本有一部分像机器写的。两个同时成立——因为它们量的不是一回事。本文读这份组合,解释为什么 21% 是第一个真正显示出来的数字,并给你跟老师沟通时能用的原话。

HumanPen 团队

· 5 分钟

短答案

相似度 2% 和 AI 分 21% 并不矛盾,因为它们量的是不同的东西。相似度问:你的文本撞没撞上别人的已发表文本?AI 分问:你的文本在统计上读起来像不像机器写的散文?

两个答案可以同时为真:你的文本几乎没撞任何东西(所以相似度 2%),你的文本有些段落读起来像机器文(所以 AI 分显示 21%)。相似度低不能洗清 AI 分——两个系统是独立的。

而 21% 有它的意义,但不是人们以为的那个。它是第一个真正显示成数字、而不是星号的分数。那是显示规则,不是判决。

这份组合报告实际长什么样

两份报告回答两个不同的问题,你手上这份组合,正是"自己写的、但文风被模型读成机器味"的学生报告的标准形状。

相似度报告把你的提交文本和 Turnitin 的已发表内容库做比对。2% 意味着你的文本几乎没撞上库里任何东西——既不是抄袭的证据,也不是 AI 的证据。

AI 写作报告估的是你的文本有多少读起来像机器写的散文,依据是写作的统计特征。21% 意味着模型判定你大约五分之一的合格文本可能是 AI 写的。

两个独立的问题,两个独立的答案。这不是 bug,也不是矛盾。

为什么相似度低不能洗清你

最容易让人误解的思路是:"我相似度只有 2%,明显没抄任何东西——那 AI 分为什么这么高?"答案是:这两个分数互不说话。

Turnitin 自己的文档把 AI 分描述为与相似度独立。相似度系统找的是撞上已发表内容的文本;AI 系统看的是你的用词方式——散文的统计形状。一段 100% 原创(哪里都撞不上)的文本,完全可能在统计上和机器写作相似。"没抄"意义上的原创性和"像不像 AI"意义上的统计相似,是两根不同的轴。

所以相似度低不是"没写 AI"的证明。它是"没抄"的证明。两个都有用,谁也替不了谁。

21% 到底意味着什么

21% 是第一个真正显示出来的数字。原因比数字本身更重要。

Turnitin 的显示规则:为了避免误报,1% 到 19% 区间的 AI 检测分不显示分数、不给高亮。低于 20% 阈值时,报告里以星号(*%)标示,不显示具体百分比。过了这条显示线,报告才显示数字和高亮。

所以 21% 不是判决,它是第一个可见的数字。14% 会隐形——显示成星号——而 21% 显示成"21%"。从星号跳成数字,是显示规则,不是罪责翻倍。

官方对误报的表述也值得一起知道:Turnitin 说它努力把"AI 写作超过 20% 的文档"的误报率控制在 1% 以下——换句话说,每一百份完全由人写的文档里,可能有一份被标成 AI。就算在数字真正显示出来的这个区间,官方的口径也是"约百分之一的全人写文档可能被误标"。21% 正在这个区间里,所以它是一个值得去看的信号,不是一个判决。

21% 到底从哪来

21% 不是均匀分布在整篇文档上的。它来自特定的段落。

Turnitin 描述的机制:提交的句子被提取、切成互相重叠的片段做预测分析,每个片段得到一个 0 到 1 之间的概率;每句合格句子继承它所在片段的分。因为片段重叠,有些句子会背多个分,这些分被池化,汇总成文档百分比。

两个实际推论。第一,扛着分数的段落是可以被定位的——如果老师分享报告,高亮会精确标出模型判定"可能 AI"的段落。第二,改稿的力气应该花在这些段落上,而不是全篇撒单字改动。

短文还有一个注意点:如果你的提交只有几百词,预测基本是"全有或全无"——模型在单个片段上预测、没有重叠机会,混合了 AI 与原创内容的文本可能被整体判成 AI。对短文来说,21% 需要比长文打更大的折扣。

怎么跟老师谈这件事

当你能指着官方原话说话时,这场对话就不一样了。

Turnitin 自己的文档说:AI 写作指标上的百分比,不应被教师用作采取行动的唯一依据,也不应作为最终的评分标准。这句话你可以直接引用,它不是钻空子——它是厂商自己的立场。

带进对话的东西:数字(21%)、它意味着什么(星号带之上第一个可见的数字,不是判决)、位置(被高亮的段落,如果你能拿到报告 PDF)、机制(分数来自特定片段,不是来自整篇)。你要解释的组合是:我的文本对任何已发表内容只有 2% 相似,21% 是统计轴上的"像机器"程度——一份原创的、认真写的、用了正式学术措辞的论文,两者可以同时为真。

先要报告,再争论。学生自己看不到 AI 指标——只有教师和管理员能看——但教师可以把报告下载成 PDF 分享。报告能把一场含糊的指控,变成一份你可以逐段处理的高亮清单。

一句话总结

相似度 2% 和 AI 分 21% 不是矛盾:一个量的是"抄没抄",一个量的是"统计上像不像 AI"。相似度低不能洗清你,21% 也不是判决——它是星号带之上第一个显示出来的数字,落在官方声称误报率低于 1% 的区间。分数来自特定段落,官方指引说它不应被用作采取行动的唯一依据。这就是你要带给老师的东西:两个独立的数字、一个可解释的机制、以及厂商自己的原话站在你这边。

继续阅读