怎么证明没用 AI:Word 和 Google Docs 的版本历史

如果你在 Word 或 Google Docs 里写的,那个文件本身一直在留一份带时间戳的记录。这份记录是只有你才有的证据。

HumanPen 团队

· 32 分钟

先说结论

如果 Turnitin 标了你写在 Word 或 Google Docs 里的东西,文件里自带的版本历史是你能带进谈话的最强时间线证据。它显示这份文件是在几天或几周里的多次编辑中长出来的,不是一次性粘贴进来的。它不能证明「任何阶段都没用到 AI」。它能证明文件有一段写作历史,而 AI 分看不到这段历史,因为分数只看最终文本。这篇文章剩下部分讲的是怎么导出它、标注什么、以及该一起带上什么。

在做这些之前还有一件事要先知道。造工具的那家公司白纸黑字地在三份帮助文档里写过:AI 分不应作为对学生采取不利行动的唯一依据。这不是你的辩词,是他们的。我们会回到这一点,因为它改变了版本历史是做什么用的。你不是带着它去证明一个否命题。你带着它,是为了让那次谈话围绕证据展开,而不是围绕一个孤立的数字。

版本历史能证明什么、不能证明什么

版本历史是一份带时间戳的文件修改记录。Word 通过 OneDrive 自动保存和「跟踪更改」保留它。Google Docs 原生保留。Overleaf 保留一份 Git 风格的页面历史。三种都记录编辑发生的时间和大致改动量。

能显示的:

  • 文件在多个不同日期的编辑会话里被修改过。
  • 有的改动小(一段、一句),有的改动大。
  • 文件在更早的状态里存在过,有时是提交前几周。
  • 编辑集中在反馈事件、导师意见、或你自己的修改轮次附近。

不能显示的:

  • 每一句都是人写的。
  • 任何阶段都没有用到 AI 工具。
  • 最终文本与中间草稿逐行一致。

这是大多数人搞错的地方。你不是用版本历史去证明一个否命题。你是用它显示文件有一段「随时间被写出来」的历史,而这段历史是分数看不到的。分数看最终文本,版本历史看最终文本是怎么到那里的。

这个区分之所以要紧,是因为 Turnitin 自己对它的分数说过什么。AI 写作报告使用指南 写着:

「Our AI writing detection model may not always be accurate (it may misidentify human-written, AI-generated, and AI-paraphrased text), so it should not be used as the sole basis for adverse actions against a student.」(我们的 AI 写作检测模型可能并不总是准确的,它可能误判人类写作、AI 生成和 AI 改写的文本,因此不应作为对学生采取不利行动的唯一依据。)

紧跟在后面的那句话每次被引用时都会被丢掉:

「It takes further scrutiny and human judgment in conjunction with an organization's application of its specific academic policies to determine whether academic misconduct has occurred.」(需要进一步的审查和人的判断,并结合机构适用其具体学术政策,才能认定是否发生了学术不端。)

两句连起来读。第一句说不要只凭这个数字。第二句说应该怎么办:进一步审查、人的判断、以及机构自己的政策。这是造工具的公司在告诉拿着数字的人:下结论之前还有事要做。你的版本历史就是让「进一步审查」成为可能的东西。

另外有一页标题叫 How should I review the AI Writing report?,换了个说法:

「It is not meant to provide definitive answers in isolation. More important than any tool is the educator who sees the score and makes decisions balancing this information with their personal knowledge of their students, their work, and institutional policy.」(它不是为了孤立地给出确定性答案。比任何工具都重要的是看到分数的教育者,他们结合对自己学生及其作业的个人了解以及机构政策来做决定。)

下一句补完了它:

「When educators look at the AI writing score and utilize it as a single data point rather than a definitive response, then it is being used as intended.」(当教育者把 AI 写作分数作为一个单一数据点而非确定性回答来看待时,它才被以设计初衷的方式使用。)

这是造工具的公司把自己的分数叫做 a single data point(一个单一数据点)。不是定论。不是确定性回答。如果谈话从一个数字开始、在一个数字上结束,那么主持谈话的那个人正在以造工具的公司说不应被使用的方式使用它。关于那个分数到底告诉你什么、不告诉你什么,我们在怎么读一份 Turnitin AI 写作报告里写了更多。

Word:跟踪更改、自动保存、版本历史窗格

Word 保留两种记录,它们不是一回事。

跟踪更改(Track Changes) 是文档内的功能,在正文里标记插入、删除和格式修改。如果你写的时候开了它,文档本身就带一条可见的编辑记录。如果没开,这条记录不存在,事后没有任何设置能把它找回来。

版本历史 是文件级的记录,由 OneDrive 在开启自动保存时保留。它按间隔存储文件快照,可以恢复或查看早期版本。访问方式:在桌面端 Word 打开文件(已同步 OneDrive),进 文件 > 信息 > 版本历史;或在网页端 Word 进 File > Version history。右侧会弹出一个窗格,按日期和时间列出已保存的版本。

要做的:

  1. 打开版本历史窗格,滚到最早的版本。 记下日期。如果文件有好几个月大、有几十个版本,这本身就在讲故事。
  2. 导出或截图版本列表。 要的是日期和作者标签。网页版 Word 可以用只读视图打开每个版本。
  3. 沿时间线挑三四个版本,记下每个改了什么。 不需要每个版本。第一稿、一轮修改后的版本、导师反馈后的版本、最终版本。每个版本一句话够了。
  4. 如果你用过跟踪更改,留一份标记还可见的副本。 不要在谈话前接受所有更改。带标记的那份才是能显示编辑过程的。

如果自动保存没开、没有版本历史,你还有别的。早期草稿的文件修改日期、发给导师的邮件附件、任何云同步的备份文件夹都带时间戳。它们不如版本历史窗格干净,但一个装着带日期草稿的文件夹讲的是同一个故事。

Google Docs:带命名版本的版本历史

Google Docs 原生保留版本历史,是三种里最好导出的。

访问方式:打开文档,进 文件 > 版本历史 > 查看版本历史。右侧弹出一个窗格,纵向列出修订,每条带时间戳和编辑者名字。Google 还允许给版本命名,这在你写作时没命名的情况下现在也有用。你可以现在补。

要做的:

  1. 打开版本历史窗格,找到最早的修订。 Google 会把小编辑压缩成较大的块,所以列表通常不会太长。
  2. 给关键版本命名。 「第一稿完整版」「导师反馈后」「方法论修改」「提交前最终打磨」。命名给时间线一个审查者三十秒内能看懂的叙事。
  3. 截图或导出列表。 Google Docs 没有一键导出版本列表的功能,所以把带日期可见的窗格截下来。如果需要一份文档,把截图贴进同一页并标注。
  4. 打开两三个版本做对比。 Google 用高亮删除和插入显示每个修订改了什么。记下每个修订的规模。在讨论部分加了三段的那个版本,跟改了一个错别字的那个版本,长得不一样。

Google Docs 在这件事上的优势是:历史默认开启,用户关不掉。如果你是在 Google Docs 里写的,历史就在。问题只是你有没有去看过。

除了版本历史还要带什么

版本历史是这件事的中心,但不是全部。把周围的东西也带上。

  • 你手头最早的草稿,哪怕很粗糙。 粗糙的草稿是写作过程的证据,它的日期是文件在最终版本之前就存在过的证据。
  • 你写论文过程中做的笔记、大纲、或标注过的 PDF。 这些是研究的残留物,不是生成的残留物。它们的日期画出了一条不像单次文本输出的路径。
  • 跟导师或任何给过反馈的人的邮件往来。 如果你在某个日期发过一份草稿并收到了意见,那次交换在时间线上锚定了一个点。
  • AI 写作报告的 PDF,如果你有的话。 你有权看到它。Turnitin 的 FAQ 写着:「Please note, only instructors and administrators are able to see the indicator.」(请注意,只有教师和管理员能看到该指标。)同一页还有一句:「The AI writing detection indicator and report are not visible to students.」(AI 写作检测指标和报告对学生不可见。)听起来是绝对的,但下一句把它改了:「However, with the PDF download feature, instructors can download and share the AI report with students.」(但是,通过 PDF 下载功能,教师可以下载并与学生分享 AI 报告。)如果没有人给过你报告,去要 PDF。不是百分比的截图。是完整报告,因为完整报告告诉你高亮落在哪儿、分析了多少词、那个分数是一个真实的数字还是一个星号。

这些放在一起做一件事:把对话从关于一个数字的主张,转移到关于一份文件及其历史的讨论。我们在被标了但确实是你写的里走过这整套。

在谈话里怎么呈现时间线

不需要幻灯片。需要一张画着时间线的纸。

  1. 画一条横线。 左端标最早草稿的日期,右端标提交日期。
  2. 把版本历史的日期放上去。 不是每个版本。五六个就够了。那些有改动的。
  3. 把导师邮件和反馈日期放在同一条线上。 这些把版本历史锚定到文件外部发生过的事件上。
  4. 把 Turnitin 报告的生成日期放上去。 这是分数被产出的日期,不是你提交的日期。这两个有时不一样。
  5. 在线下面写一句话。 类似:「文件在 [日期] 到 [日期] 之间被在 [N] 次会话里编辑过。导师反馈在 [日期] 被纳入。AI 报告在 [日期] 生成。」

那张纸做两件事。它给审查者一个除了分数以外可以看的东西,也说明你来是为了参加一次复核,不是来对抗一项指控。

走进去之前还有一件事。Turnitin 的 FAQ 列出了容易产生假阳性的文本特征:

「Sometimes false positives (incorrectly flagging human-written text as AI-generated), can include content without a lot of structural variation, text that literally repeats itself, or text that has been paraphrased without developing new ideas.」(有时假阳性(错误地把人类写作标为 AI 生成),可能包括结构变化不多的内容、字面重复的文本、或只改写而未产生新想法的文本。)

下一句是你在谈话里需要的那句:

「If our indicator shows a higher amount of AI writing in such text, we advise you to take that into consideration when looking at the percentage indicated.」(如果我们的指标显示这类文本中有较多 AI 写作,我们建议您在查看所指百分比时将此考虑在内。)

读一下它覆盖的是什么。结构变化不多的内容。字面重复的文本。只改写而未产生新想法的文本。这几条描述了学术写作的很大一部分,尤其是文献综述和方法论部分。如果你被标的部分在那片地界里,造工具的公司在告诉读分数的那个人:正是因为这个原因,要把它打折。不是你说的。是公司说的。

版本历史不要怎么用

有三件事会削弱你手上的证据。

不要在展示之前改版本历史。 Google Docs 的修订名可以改,但每个修订的时间戳和内容改不了。如果你把一个版本改名为「第一稿」而时间戳显示它是提交前一天晚上创建的,这个改名只会让事情更糟。让历史自己说话。

不要声称版本历史能证明没用 AI。 它不能。它显示文件被随时间编辑过,模式与人类写作一致。这是它显示的东西。声称更多的东西,等于给对方递一个现成的反驳。

不要把旧的「首尾几句误报」那条当成现行缺陷带过去。 Turnitin 在 2023 年 5 月 发布过一条更新说明,承认假阳性曾集中在文档的首尾几句:

「Since launch, we have observed a higher incidence of false positive detection in the first few or last few sentences of a document. Many times these sentences consist of introduction or conclusion content written in a generic way. As a result, we have changed our detection logic to help reduce these false positives.」(自上线以来,我们观察到文档开头或结尾几句的假阳性检测发生率更高。这些句子很多是由以通用方式写作的引言或结尾内容组成。因此,我们已更改检测逻辑以帮助减少这些假阳性。)

关键短语是最后一句:「we have changed our detection logic to help reduce these false positives」(我们已更改检测逻辑以帮助减少这些假阳性)。这是一次 2023 年 announced 的修复,不是你现在可以指着的现行缺陷。如果你把它当作工具现在坏了的证据带过去,对面的人查一下、找到那条修复说明,你在其余所有问题上的可信度都会掉。这一点我们在20% 的 AI 率算高吗里讲过更多。

我们在哪

HumanPen 是一个文档改写工具。我们不会告诉你把论文跑一遍改写器就能让 AI 分消失,因为我们不对未来的分数做声称。我们可以说的是这个工具做什么:你把文档连同它的 AI 写作报告传上来,只有报告标出的片段会被改写,其余部分原样保留。输出在成为任何最终结果之前由你复核。

如果你想带着原文档和版本历史进那间办公室,让历史自己说话,这是一条路。如果你想提前把标出的部分改一改,那是另一条路。两条都正当。谈话在先。

常见问题

版本历史能证明我没用 AI 吗? 不能。它说明文档被随时间编辑过,模式与人类写作一致。它不能证明一个否命题。它做的是给审查者一个除了分数以外可以看的东西,而这正是它的价值。

我在 Word 里没开自动保存怎么办? 版本历史窗格没了,但不是什么都没了。早期草稿的文件修改日期、发给导师的邮件附件、云同步的备份文件夹都带时间戳。不如版本历史干净,但讲的是同一个故事。

导师只给我发了百分比的截图,我该要什么? 要 AI 写作报告的完整 PDF。Turnitin 的 FAQ 说学生看不到指标,但也说教师可以通过 PDF 下载功能把报告分享给学生。去要那个。不是截图。是报告。

如果报告是很久以前生成的呢? 这要紧。Turnitin 的 AI 写作检测模型 页面带日期的更新说明。2023 年 8 月 9 日那条修了一个高亮参考文献的 bug。2023 年 5 月那条改了首尾几句的检测逻辑。在那些日期之前生成的报告,跑在与今天不一样的逻辑下。生成日期在报告上。讨论分数之前先找到它。

把论文跑一遍改写器能修好分数吗? 我们不对未来的分数做声称。HumanPen 做的是改写你选中的被标片段。下一份报告会不会更低,我们不会承诺,因为模型在变,而报告是 Turnitin 产出的,不是我们。

继续阅读