OpenAI 给欧盟 ChatGPT 文本加水印:它会出现在 Turnitin 报告里吗?

OpenAI 10 月 5 日的博文说,欧盟的 ChatGPT「over the coming weeks」(未来几周)开始加水印;它的帮助中心页面大约一天后更新,已经用现在时说欧盟的 ChatGPT 文本带这个水印。两处都没给开始日期。如果你在欧盟上学、作业里用过 ChatGPT,下面把这两个页面、OpenAI 的技术报告和 Turnitin 自己的页面放在一起看:这件事到底会不会碰到你的报告。

HumanPen 团队

· 10 分钟

ChatGPT 的水印会出现在我的 Turnitin 报告里吗?

目前公开的材料里,没有任何一份说会。OpenAI 在 2026 年 10 月 5 日宣布,会给「eligible ChatGPT and Codex text output in the European Union」(欧盟境内符合条件的 ChatGPT 和 Codex 输出文本)加上隐形水印。公告说是未来几周内的事;OpenAI 的帮助中心大约一天后更新,已经用现在时说欧盟的 ChatGPT 文本带这个水印。两处都没给开始日期。读取水印的检测器不公开:OpenAI 只接受研究和学术机构申请,逐个审批。10 月 7 日查看时,Turnitin 的帮助中心和两个更新日志页面完全没有提到这个水印。Turnitin 报告里的 AI 比例来自 Turnitin 自己的分类器;按 Turnitin 的说明,它打分看的是文字本身。

所以单就水印而言,老师这周打开的报告,和公告之前没有区别。(Turnitin 10 月 6 日倒是改了另一件不相干的事:购买并开启了相应功能的学校,AI 检测现在也覆盖德语、土耳其语和荷兰语的提交。)水印真正改变的东西要窄得多,下面逐一说:哪些文本会带水印,谁能查,查出来又能说明什么、不能说明什么。

OpenAI 宣布了什么,哪些还说不清

OpenAI 这篇文章题为「Our approach to EU text provenance rules」(我们应对欧盟文本来源标识规定的做法),日期是 2026 年 10 月 5 日。我们用脚本请求线上页面被拒,所以以互联网档案馆 10 月 6 日 13:42(UTC)保存的副本为准,10 月 7 日又用浏览器和线上页面对过一遍,文字一致。OpenAI 开发者论坛上一位版主当天发的摘要,给出的时间线也一样。博文末尾指向一篇讲来源标识的帮助中心文章,那篇的「Updated」(更新)标记大约晚一天。博文分了三步,开始的时间并不一样。

步骤什么时候覆盖谁
API 客户的水印10 月 5 日起,自愿开启,默认关闭全球的 API 客户,「for select models」(限部分模型)
ChatGPT 和 Codex 的水印博文写「Over the coming weeks」(未来几周);帮助中心已经用现在时;两处都没给日期「eligible ChatGPT and Codex users across all plans in the EU only」(仅限欧盟、所有套餐里符合条件的 ChatGPT 和 Codex 用户)
检测器的使用权限10 月 5 日起接受申请「approved researchers and expert organizations」(获批的研究人员和专业机构)

这张表里有两点,比看上去要紧。

OpenAI 这两个页面在时间上对不上。博文里,ChatGPT 这一步用的是「we will add」(我们将加入)。帮助中心讲文本的那一条用的是现在时:「In the EU, ChatGPT-generated text includes an invisible change to the randomness used in the model's word choices to comply with the EU AI Act.」(在欧盟,ChatGPT 生成的文本包含一处看不见的改动,改的是模型选词时用到的随机性,以符合欧盟《人工智能法》。)两处都没给开始日期,所以这周起你在欧盟用 ChatGPT 写出来的文字,可能已经带水印,而两个页面都没法让你分辨。9 月的文字生成时,这次欧盟推送还没宣布。帮助中心也提到「Prior tests in ChatGPT」(之前在 ChatGPT 里做过的测试),没说是什么时候、对谁做的。

另外,「eligible」(符合条件)这个词博文通篇没有解释。博文没说哪些 ChatGPT 模型会带水印;OpenAI 怎么判断文本是「在欧盟」生成的,两个页面都没说:看账号所在国,看你打字时人在哪里,还是别的什么。我们在博文正文里搜了 location、travel、VPN、IP address,零命中(同一段文字里 watermark 出现 42 次,说明搜索是在正常读的);帮助中心页面里也没有 location 或 country。如果你人在里昂上学、账号是在多伦多注册的,或者反过来,两个页面都没告诉你算哪一边。

还有一条路,跟 ChatGPT 本身没关系。API 这一项是全球开放的,所以基于 OpenAI 模型做的写作类应用,可以给自己的用户打开水印,不管用户在哪儿。文章没列出哪些客户开了,也没说这类应用会不会告诉你。

谁能查一段文字里有没有这个水印

这个水印叫 textGrain,是藏在模型选词里的一种统计规律,页面上什么也看不出来。OpenAI 同一天发布的技术报告,把读取水印需要什么写得很清楚:「The detector requires only the generated text and the secret key」(检测器只需要生成的文本和密钥)。OpenAI 把检测器称为「our text watermark detector」(我们的文本水印检测器),手里没有那把密钥的人,就无从比对。

OpenAI 暂时也没打算把检查权限放得很宽。文章说权限「will initially be limited to approved researchers and expert organizations that can help us evaluate and improve the technology」(初期只开放给能帮助我们评估和改进这项技术的获批研究人员和专业机构),「on a case-by-case basis」(逐案)批准,理由也说得很直白:「Given the risk of missed watermarks and false positives, we are not making it publicly available at launch.」(考虑到漏检和误报的风险,上线时我们不会公开提供。)

大学能拿到权限吗?可以申请,但写明的用途不是批改作业。OpenAI 帮助中心说:「Text detector access is currently limited to approved research and academic organizations working to improve how reliably text watermarking works, how easy it is to use, and how clearly the technology and its results can be explained.」(文本检测器目前只开放给获批的研究和学术机构,用于改进文本水印的可靠性、易用性,以及这项技术和检测结果能被解释得多清楚。)它还点名了几位目前合作的研究人员,包括康奈尔大学、苏黎世联邦理工学院和 Kempelen 智能技术研究所的人。两个页面都没提到学生、老师或 Turnitin。博文倒是说了这个工具会返回什么:「whether it detects an OpenAI watermark, without identifying the user or revealing their prompts or conversations.」(是否检测到 OpenAI 水印,不会识别用户,也不会透露用户的提示词或对话。)

文章还提到,OpenAI 计划「to make the technology available in open source」(把这项技术开源)。这句话说的是方法本身。它没说开源之后谁就能查 ChatGPT 生成的文本,而技术报告写得很明确,检查需要那把密钥。

公告里也没有哪句话说 ChatGPT 本身能查文本里有没有水印。如果有人拿聊天机器人对你作文的「判断」给你看,那是另一回事了,见ChatGPT 能判断文章是否由 AI 写成吗?查看 OpenAI 公布的证据。

Turnitin 说过它能读这个水印吗?

我们查过的地方都没有。10 月 7 日 11:57 到 11:58(UTC),我们在 Turnitin 最可能说这件事的几个地方搜了一遍。每个计数都是在页面文字里不分大小写匹配,同时用同一页上的一个对照词证明搜索是正常工作的。

Turnitin 页面搜了什么结果同页对照
帮助中心搜索(guides.turnitin.com)watermark、textGrain各 0 条结果AI writing:152 条
AI writing detection capabilities FAQ(AI 写作检测功能常见问题,10 月 7 日修改,34,243 个字符)watermark、textGrain、provenance、OpenAI各 0 次detect:140 次
Product updates(产品更新,10 月 6 日修改)watermark、textGrain各 0 次detect:48 次
Release notes(版本说明,10 月 6 日修改)watermark、textGrain各 0 次detect:47 次

同一份 FAQ 倒是讲了 Turnitin 的检测器怎么工作:句子被切成相互重叠的片段,「Each segment is classified by the AI detection model and given a value between 0 and 1, denoting the probability of the text being likely human or AI-generated.」(每个片段由 AI 检测模型分类,并给出一个 0 到 1 之间的值,表示这段文字更可能是人写的还是 AI 生成的概率。)往下几段又说,它的分类器「are trained to detect these differences in word probability」(经过训练,用来识别这些用词概率上的差异)。这是根据文字本身做出的判断。这段说明里没有哪一步依赖文本里被放进去的标记,也不依赖任何人的密钥。

这个计数只能说明一件事:Turnitin 没说过它读这个水印。它说明不了 Turnitin 做不到,也说明不了它没去申请权限;一家悄悄做了其中任何一件的厂商,从外面看完全一样。如果 Turnitin 以后宣布什么,它上一次给 AI 检测的改动标日期,用的就是产品更新页,所以盯那一页就行。

如果真有人查了,结果能说明什么?

能说明的不多,这一点 OpenAI 自己的文章讲得最清楚。文中专门有一节「What a text watermark doesn't tell you」(文本水印不能告诉你什么),其中三点和作业直接相关:

  • 「A watermark does not measure human contribution. It can indicate that an OpenAI system generated or processed part of a passage, but not how much human judgment, editing, or creativity went into it.」(水印衡量不了人的贡献。它能表明某段文字有一部分是 OpenAI 的系统生成或处理过的,但说明不了其中有多少人的判断、修改或创造。)
  • 「A watermark does not identify the user. It does not associate a person, organization, account, prompt, or conversation with the text.」(水印不识别用户。它不会把某个人、机构、账号、提示词或对话和这段文字联系起来。)
  • 「The absence of a detected watermark does not prove human authorship.」(没检测到水印,并不能证明是人写的。)OpenAI 给出的原因里,包括文本可能「come from an unsupported model, predate watermarking, or have been generated by another company's tools.」(来自不支持水印的模型、早于水印上线,或者是别家公司的工具生成的。)

技术报告对这个标记的描述也一样,叫「a binary provenance signal」(二元的来源信号):它只回答一个是或否的问题,就是有没有 OpenAI 的系统参与过。

所以,就算检测到了,也没法告诉任何人,到底是你自己写完、让 ChatGPT 理顺了两段,还是反过来。查不到,也不等于替你洗清了。这两种结果都回答不了你的课程真正关心的问题:你用 AI 的方式在不在规定允许的范围内。

用过 ChatGPT 写作业,现在该怎么做

  1. 按课程的 AI 规定来,不要按水印来。这一切背后的法律义务落在 AI 公司身上。OpenAI 的原话是:「The EU AI Act requires generative AI providers to make generated text identifiable in a machine-readable way.」(欧盟《人工智能法》要求生成式 AI 提供者让生成的文本能以机器可读的方式被识别。)这是 OpenAI 的义务。你能做什么、不能做什么,由你的课程和学校决定,这周这些都没变。
  2. 课程要求申报 AI 使用的,就按它要求的方式申报。有没有水印,都不会让申报变得更必要或更不必要。哪些写作工具算「使用了 AI」需要声明?一份逐条判定清单逐个工具讲了。
  3. 如果有人拿 Turnitin 的 AI 分数找你,就把它当成 Turnitin 的分数来处理。它来自上面说的分类器,不是来自水印。要求看完整报告和被标出的段落。AI 比例偏高时,厂商是怎么教老师处理的讲了 Turnitin 给老师那一方的指引。
  4. 如果有人说「查到了水印」,问清楚是用什么工具查的、谁查的。上线阶段,OpenAI 的检测器只开放给获批的研究和学术机构,OpenAI 写明这些权限是用来研究水印效果的;没有这份权限的工具得出的结果,查的并不是这个水印。而且按 OpenAI 自己的说法,就算真的查到了,也只能说明某处有 OpenAI 的系统参与过,说明不了参与了多少、是谁用的。如果你确实按课程允许的方式用过 ChatGPT,就照实说明是怎么用的。
  5. 留好你的草稿。版本历史能看出一份作业是怎么在几天、几周里一点点写出来的,这是水印和检测分数都给不了的。

常见问题

我在欧盟,9 月用 ChatGPT 写过一篇作文。那些文字带水印吗? 不在这次欧盟推送的范围里,那是 10 月 5 日才宣布的。OpenAI 也把「predate watermarking」(早于水印上线)列为检测器查不到的原因之一。至于 Turnitin 的分类器会给这篇作文打多少分,那是另一个问题。

老师能查我的作文里有没有水印吗? 没有任何公开工具能查。OpenAI 说上线时不会公开提供检测器,权限要申请,只给研究这项技术的获批研究和学术机构。

我不在欧盟,也会受影响吗? ChatGPT 这边,OpenAI 说只在欧盟做,并写明:「We are not making text watermarking a global default at launch.」(上线时我们不会把文本水印设为全球默认。)另外,全球的 API 客户都可以给部分模型自愿开启水印。

我的 Turnitin AI 比例会因为它变吗? 10 月 7 日我们查过的 Turnitin 页面,没有一处把 AI 分数和水印联系起来。分数来自 Turnitin 自己的分类器。

OpenAI 怎么判断文本是不是在欧盟生成的? 博文和帮助中心都没说。

参考来源

继续阅读