Turnitin 能查出哪些 AI 模型?它点名的清单,和清单之外的名字
Turnitin 公布了一份清单,列出它的英文检测器「can detect content from」(能检测其内容)的模型,同一页也写着它可能会漏掉一部分 AI 文本。其他检测器公司正在写的一批模型名,比如 GPT-6 Astra 和 Claude Opus 5,在我们 2026 年 9 月 17 日核对时,Turnitin 的 461 篇英文帮助文章里一次都没有出现。下面是这份清单、清单之外的空缺,以及为什么两者都预测不了你那份文件的结果。
HumanPen 团队
· 10 分钟
你用的模型在 Turnitin 的清单上吗?
Turnitin 的英文 AI 写作检测 FAQ 点名了 32 个模型,从 `GPT-4o` 到 `Grok-4.1`,说它的检测器「can detect content from」(能检测其内容)这些模型,以及「and tools based on these LLMs as well」(以及基于这些大模型的工具)。在清单上,不等于你的文字一定会被查出来;同一页写着「we might miss some AI written text」(我们可能会漏掉一些 AI 写的文本)。不在清单上,也不等于过关。其他检测器公司一直在写的一批模型名,包括 GPT-6 Astra、Claude Opus 5、Gemini 3.7、Grok 4.6 和 Fable 5.1,截至 2026 年 9 月 17 日,在 Turnitin 的 461 篇英文帮助文章里一篇都没出现。这说明的是 Turnitin 没有在那里点名它们。FAQ 没有说没列出的模型生成的文本会怎样;紧跟在清单后面的那句是「We will continue to expand our detection capabilities to other models in the future.」(我们今后会继续把检测能力扩展到其他模型。)
所以这份清单回答的问题,比你带着来的那个问题窄。它告诉你 Turnitin 公开点了名的是哪些模型。它不告诉你某一篇论文会拿到什么分数,不管用的模型在不在清单上。
下面依次是:清单原样长什么样、这个措辞让 Turnitin 承诺了什么、我们是怎么数出这个空缺的,以及拿这些信息能做什么。
Turnitin 印出来的清单
清单在 Turnitin 的 AI 写作检测能力 FAQ 里。这页第一句就把范围限定在英文:「The following content and FAQs pertain to our AI writing detection capabilities for English submissions only.」(以下内容和常见问题仅适用于我们针对英文提交的 AI 写作检测能力。)按页面上的时间戳,它最后一次编辑是 2026 年 8 月 28 日。
那句话以「Currently, Turnitin's AI writing detection model for English submissions can detect content from」(目前,Turnitin 针对英文提交的 AI 写作检测模型能检测以下模型的内容)开头,后面逐个列出模型,每个后面括号里带一个发布日期。我们按逗号切分,从第一个模型数到「and tools based on these LLMs」(以及基于这些大模型的工具)这几个字为止,得到 32 条。`GPT-5.2` 和 `GPT-5.2-pro` 算两条;结尾的「tools based on these LLMs」(基于这些大模型的工具)不算一条。拼写和奇怪的空格都照 Turnitin 原样:
| 系列 | 条数 | 清单上的名字 |
|---|---|---|
| GPT | 11 | `GPT-4o`、`GPT-4o-mini`、`GPT-5`、`GPT-5-mini`、`GPT-5-nano`、`GPT-5.1`、`GPT-5.2`、`GPT-5.2-pro`、`GPT-5.3`、`GPT-5.4`、`GPT-5.4-pro` |
| o1 | 1 | `o1-mini` |
| Gemini | 7 | `Gemini-1.0- pro`、`Gemini-1.5- pro`、`Gemini-2.5-pro`、`Gemini 2.5 Flash`、`Gemini-3-flash-preview`、`Gemini-3-pro-preview`、`Gemini-3.1-pro-preview` |
| Claude | 7 | `Claude-3-Haiku`、`Claude Sonnet-3.5`、`Claude Sonnet-3.7`、`Claude Sonnet-4.5`、`Claude Sonnet-4.6`、`Claude-Haiku-4.5`、`Claude-Opus- 4.5` |
| LLaMA | 2 | `LLaMA-3.3`、`LLaMA-4-Maverick` |
| Mistral | 1 | `Mistral-Large-3` |
| Deepseek | 1 | `Deepseek-v3.2` |
| Nova | 1 | `Nova-2-lite` |
| Grok | 1 | `Grok-4.1` |
表里故意没放发布日期。这份清单在同一页上印了两遍,一遍在「How does it work?」(它是怎么工作的?)下面,一遍在「Which AI writing models can Turnitin's technology detect?」(Turnitin 的技术能检测哪些 AI 写作模型?)下面,两份除了两个日期之外完全一样。第一份写 `o1-mini` 发布于 2024-09,第二份写 2024-12。第一份把 `Claude Sonnet-4.6` 标为 2026-02,第二份标为 2026-05。我们不替 Turnitin 选哪个对。如果某个日期对你的论证要紧,引用时说清楚引的是哪一份,并注明另一份写的不一样。
还有一份清单常被和它搞混。Turnitin 的发布说明里 2026 年 8 月 18 日那一条也列了模型名,但它宣布的是阿拉伯语检测,而且写明了:「our Arabic AI writing model is a separate model from our English AI writing, Spanish AI writing, and Japanese AI writing models.」(我们的阿拉伯语 AI 写作模型,与英文、西班牙语和日语 AI 写作模型是彼此独立的模型。)Opus 4.6(那条里印作 `Claude Opus 4.5 (released 2025-11) and 4.6`)、`OpenAI o3` 和 `Qwen 3 Next` 都出自这一条。这三个都不在英文清单上;英文清单里唯一一条 Opus 是 `Claude-Opus- 4.5`。如果你用英文写作,却把那条发布说明读成「Turnitin 加上了 Opus 4.6」,那你读的是另一个模型的清单。
「can detect content from」让 Turnitin 承诺了什么
英文模型清单里的动词是「can detect content from」(能检测其内容)。在那句话里,它不是「trained on」(在其上训练过),也不是「tested against」(针对其测试过)。这个区别很容易丢,因为 Turnitin 描述日语检测时用的恰好是另一种说法:2025 年的一条发布说明写日语模型是「trained to detect text likely generated with」(被训练来检测很可能由以下模型生成的文本)GPT-4 和 GPT-4o。不要把日语那边的动词套到英文清单上。
这个动词后面没有跟任何数字。清单上没有一条旁边标着检出率,清单也没有把哪个模型排得比别的更难查。所以「Claude 被查出的概率比 GPT 低」这种话,在这份清单里找不到出处。
同一份 FAQ 对它低误报目标的代价也说得很直白:
In order to maintain this low rate of 1% for false positives, there is a chance that we might miss some AI written text in a document. We're comfortable with that since we do not want to incorrectly highlight human-written text as AI-written.(为了把误报率维持在 1% 这个低水平,我们有可能漏掉文档里一部分 AI 写的文本。我们接受这一点,因为我们不想把人写的文本错误地标成 AI 写的。)
接着它举了个例子:如果它判定一份文档里有 50% 的内容很可能是 AI 工具写的,这份文档「could contain as much as 65% AI writing」(实际可能含有多达 65% 的 AI 写作)。这一点对清单上的模型同样适用。
而且清单不是固定的。在「AI 百分比会不会随检测器和被检测模型的演进而变化」这个问题下,FAQ 写道「it is likely that our detection capabilities will also change, affecting the AI percentage」(我们的检测能力很可能也会变化,从而影响 AI 百分比),接着是:「However, for a submitted document, the AI percentage will change only if it's re-submitted again to be processed.」(不过,对已经提交的文档来说,只有重新提交处理,AI 百分比才会变化。)所以你手上已有报告里的百分比,不重新提交就不会变。
不在清单上的模型名,以及我们是怎么数的
其他检测器公司一直在发文章,讨论一些不在 Turnitin 清单上的模型名。Originality.ai 的博客有「Is GPT-6 Astra Content Detectable?」(GPT-6 Astra 生成的内容能被检测出来吗?)、「Is Gemini 3.7 Flash Content Detectable?」(Gemini 3.7 Flash 生成的内容能被检测出来吗?)和「Is Grok 4.6 Content Detectable?」(Grok 4.6 生成的内容能被检测出来吗?);Pangram 的博客有「Can Pangram Detect Claude Opus 5?」(Pangram 能检测 Claude Opus 5 吗?)和「Does Pangram Detect Fable 5.1?」(Pangram 能检测 Fable 5.1 吗?)。我们不转述这些文章的结论,也没有拿这些模型去和它们厂商的发布公告核对。这些名字我们只用来做一件事:看 Turnitin 的文档有没有提到它们。
就 Turnitin 的英文帮助中心而言,没有提到。下面说清楚这个「没有」具体指什么。
- 语料。 Turnitin 帮助中心 guides.turnitin.com 上的全部英文文章:461 篇。这个数字我们在 2026 年 9 月 17 日(UTC)用两种办法得到:一是把帮助中心的公开文章 API 翻到最后一页(共五页,去重后 461 篇),二是帮助中心的 sitemap(461 个英文文章地址)。两个集合互相比对,哪一边都没有多出来的。大约半小时后通过 API 又跑了一遍,还是 461。
- 方法。 去掉每篇文章正文的标签,然后做逐字、区分大小写的文本检索。
- 在全部 461 篇里零命中的检索词: `GPT-6`、`Astra`、`Opus 5`、`Opus-5`、`Opus- 5`、`Sonnet 5`、`Gemini 3.7`、`Gemini-3.7`、`Grok 4.6`、`Grok-4.6`、`Fable`。
- 检索确实在工作的证据。 同一批语料、同一种检索:`Nova-2-lite` 出现在 1 篇文章里(就是那份 FAQ,出现两次,两份清单各一次),`GPT-5.4` 出现在 2 篇文章里。所以检索是活的。它匹配的是逐字字符串,这也是上面的检索词里包含 Turnitin 自己会用的带空格、带连字符写法的原因,比如照清单里 `Claude-Opus- 4.5` 的写法补上的 `Opus- 5`。
- 没有覆盖的。 turnitin.com 本站,也就是营销网站和 Turnitin 的博客。那些我们没搜,所以我们不说 Turnitin 在任何地方都没提过这些名字。结论只到帮助中心为止。
接下来这部分比计数本身更要紧。一个名字缺席,说明的是 Turnitin 发布了什么,不是它的检测器做了什么。FAQ 没有说没列出的模型生成的文本会怎样。它谈到其他模型时,说的是以后的事。两份清单后面紧跟的都是这一句:
We will continue to expand our detection capabilities to other models in the future.(我们今后会继续把检测能力扩展到其他模型。)
它在回答如何为「yet to emerge」(尚未出现的)模型做准备时写道「we are continuously updating our model to detect these additional LLMs」(我们在持续更新模型,以检测这些新增的大模型),隔一句又写:「Since then, we've expanded our detection capabilities to include a large number of other LLMs as mentioned in the FAQ earlier.」(从那以后,我们已经把检测能力扩展到了 FAQ 前文提到的大量其他大模型。)清单本身以「and tools based on these LLMs as well」(以及基于这些大模型的工具)结尾,没有说同一厂商后来的模型算不算在内。这几句话里,没有一句说未列出的模型现在就能被查出,也没有一句说它会被漏掉。所以本文两样都不说。
拿这些信息能做什么
- 在你需要的那天,自己去读清单。 打开那份 FAQ,在页面里搜「can detect content from」,记下页面的时间戳。我们核对时,那页最后编辑于 2026 年 8 月 28 日,而且它是原地修改的。一张带日期的截图,在面谈里比任何文章的转述都管用,包括我们这篇。
- 对的是确切的模型名,不是应用名。 清单列的是模型(`Claude Sonnet-4.5`、`Gemini 2.5 Flash`),不是聊天应用。如果你说不清某个工具当时跑的是哪个模型,这份清单替你定不了任何事,而「tools based on these LLMs」(基于这些大模型的工具)那句也没有点任何一个工具的名。
- 看清语种。 英文论文对应英文清单。西班牙语、日语和阿拉伯语的提交各有各的模型和清单,和英文那份对不上。
- 别把这份清单扯进关于你自己论文的争论。 不管你用的模型在清单哪一边,同一份 FAQ 里都有一句话往另一个方向说,而且哪一边说的都不是你这份文档。
- 手上已经有报告,就从报告出发。 已提交文档的百分比只有在重新提交时才会变,所以你手上那份报告就是当时打出来的样子。怎么读一份 Turnitin AI 检测报告 讲了这个数字包含什么。如果被标出的文字确实是你自己写的,怎么准备申辩 和 怎么留住版本历史 比这份模型清单对你更有用。
常见问题
Claude Opus 4.6 在 Turnitin 的清单上吗? 不在英文清单上。英文 FAQ 里的 Claude 条目到 `Claude Sonnet-4.6`、`Claude-Haiku-4.5` 和 `Claude-Opus- 4.5` 为止。Opus 4.6 出现在 2026 年 8 月 18 日那条发布说明里,而那条讲的是阿拉伯语检测模型。
Turnitin 8 月份更新过英文模型清单吗? 那页 FAQ 最后编辑于 2026 年 8 月 28 日,但编辑时间戳说明不了改的是哪一部分,而我们手上没有那天之前的完整清单副本可以比对。8 月 18 日发布说明里的那份清单属于阿拉伯语模型。
清单能告诉我我用的模型被查出的可能性有多大吗? 不能。清单上没有逐个模型的数字。FAQ 确实给出的数字,比如 1% 的误报率目标,以及 50% 的结果「could contain as much as 65% AI writing」(实际可能含有多达 65% 的 AI 写作)这个例子,针对的是整个检测器。
`Claude Sonnet-4.6` 的发布日期到底哪个对? 这页两个都给了,2026-02 和 2026-05,两份清单各一个。阿拉伯语清单用的是 2026-05。换作我们,会只引模型名,不写日期。
延伸阅读
本页是总览。下面每篇各自深入一个模型系列或一条边界:
- Turnitin 能检测 GPT-5 和其他新 AI 模型吗
- Turnitin 能检测 Claude 吗?
- Turnitin 能检测 Gemini 和 Copilot 吗?
- Turnitin 能查出 Claude、Copilot、Gemini 吗? 讲为什么一份覆盖清单不是逐模型排名,以及 Copilot 不在清单上不能说明什么。
- Turnitin 能检测 DeepSeek 吗?
- Turnitin 能检测 Grok 吗?
- Turnitin 能检测 LLaMA 吗?
- Turnitin 能检测 Mistral 生成的文本吗?
- Turnitin 能检测 Perplexity AI 吗?
- Turnitin 新增阿拉伯语 AI 检测 对比了阿拉伯语清单和英文清单。
- 非英语的提交,Turnitin 能查出 AI 吗? 讲西班牙语、日语和阿拉伯语各自独立的模型。
核对过的页面
以下全部是 2026 年 9 月 17 日(UTC)在未登录状态下读的。Turnitin 会原地修改这些页面,真要依赖其中哪一条,先重新打开看一遍。
- Turnitin Guides,Turnitin's AI writing detection capabilities FAQs。页面时间戳 2026 年 8 月 28 日。模型清单(两份)以及上文所有 FAQ 引文都出自这里。
- Turnitin Guides,Turnitin release notes,2026 August 18 那一条,关于现代标准阿拉伯语检测。日语的「trained to detect」(被训练来检测)措辞也出自这页,在 2025 年的一条里。
- Turnitin Guides,全部 461 篇英文(en-us)帮助中心文章,用于模型名检索,通过帮助中心的公开文章 API 和它的 sitemap 计数。
- 只作为「不在清单上的模型名」那一节里模型名出处的博客文章:Originality.ai 的 Is GPT-6 Astra Content Detectable?、Is Gemini 3.7 Flash Content Detectable? 和 Is Grok 4.6 Content Detectable?;Pangram 的 Can Pangram Detect Claude Opus 5? 和 Does Pangram Detect Fable 5.1?。
继续阅读