心理学论文与 AI 检测:APA 第七版在你动笔前建议了什么

很多人以为 APA 只管参考文献怎么排。其实 APA 会建议各部分的时态,JARS 会列出研究报告应交代的信息,数字指南还会规定统计格式。课程要求或目标期刊再决定哪些条目必须出现。这篇教你把几层规则拆开,再判断哪些事实不能动、哪些措辞仍是你自己的。

HumanPen 团队

· 12 分钟

按 APA 第七版写的心理学论文,为什么每个字都是自己写的却拿到高 AI 率?

心理学论文里有很大一部分,会受到你动笔之前就存在的写作规范约束。APA 官网会按章节建议时态,JARS 会列出透明报告研究时应交代的信息,数字与统计指南则规定统计量怎么写。课程说明或目标期刊才决定这篇稿件必须采用哪些条目。Turnitin 在另一份文档里说,它的分类器学习词概率模式,而误报可能出现在结构变化少的文本中。方法或结果被标记,不能单凭这一点证明它是 AI 写的;删掉研究事实或明确要求的报告项目也不是解决办法。

先把范围说清楚:本文实读的 Turnitin AI 检测 FAQ没有针对 APA 作出说明。2026 年 8 月 27 日,我们通读了该页提取出的 31,712 个正文字符,然后逐项查词:`APA` 作为独立单词命中 0 次,`MLA` 0 次,`style guide` 0 次,`citation` 0 次,`discipline` 0 次,`psychology` 0 次。全页与学科最接近的一句,是讲训练数据时提到的 "less common subject areas such as anthropology, geology, sociology, and others"。

量具是活的:同一页 `qualifying text` 命中 4 次,`word probability` 2 次,`structural variation` 1 次。所以下面这条关联是我们自己搭起来的,两边的文档从头到尾没提过对方。同一页我们还带着另一个问题清点过一次,结果写在为什么写得好的文章反而被判成 AI

对中文母语的作者,这件事更明显

如果你曾经靠本领域的论文学习 Method 怎么写,很可能连那些论文的句子结构也一起学了过来。专业惯例就是这样进入新稿件的。

这个学习路径再叠上 APA 的时态建议,以及课程或期刊要求报告的项目,方法段的结构空间可能会变得很小。

如果你还在两种语言之间倒过一道手,另外两篇可以顺带看看:机翻会被 Turnitin 判成 AI 吗非母语写作被标记为 AI?文档怎么说。那是另外一条线,这篇不展开。

APA 第七版在句子层面建议了什么

先说时态,因为这是最多人不知道 APA 管的地方。APA 官网的 Verb Tense 页给了一张按章节推荐时态的表,例句是它自己印上去的:

论文的哪一部分推荐时态APA 给出的例句
文献综述过去时 / 现在完成时"Martin (2020) addressed" · "Researchers have studied"
方法(描述流程)过去时 / 现在完成时"Participants took a survey" · "Others have used similar approaches"
报告结果过去时"Results showed" · "Scores decreased" · "Hypotheses were not supported"
讨论结果的意义现在时"The results indicate" · "The findings mean that"
结论、局限、未来方向现在时"We conclude" · "Limitations of the study are" · "Future research should explore"

把右边那一列再看一遍。网上说「这看着就像 AI 写的」时点名的句头,基本都在这张表里,而它们印在权威机构自己的网页上。该页还注明这部分对应 Publication Manual 第 4.12 节。

这套指导不只涉及语法,也涉及报告内容。JARS–Quant 表一的标题是「建议纳入报告新数据采集稿件的信息」,读起来像一张清单:

  • "Report inclusion and exclusion criteria, including any restrictions based on demographic characteristics."(纳入与排除标准,含基于人口学特征的任何限制)
  • "Report major demographic characteristics (e.g., age, sex, ethnicity, socioeconomic status)."(主要人口学特征)
  • "percentage of sample approached that actually participated",以及预期样本量、实际样本量各自是怎么确定的。
  • "results of all inferential tests conducted, including exact p values if null hypothesis significance testing (NHST) methods were used"(所有推断统计的结果,用 NHST 就要给精确 p 值)
  • "effect-size estimates and confidence intervals on estimates that correspond to each inferential test conducted, when possible"(每个推断检验对应的效应量与置信区间)

标题里的「建议」很重要。APA 自己的 JARS 介绍页把它称为「structured guide」,说教师和学生也可以使用,并提醒作者从期刊投稿须知了解该刊是否采用。仅仅使用 APA 第七版,不会自动把表一的每一项都变成所有学生论文或期刊稿件的统一硬要求。

再往下是数字。APA 的 Numbers and Statistics Guide规定:精确 p 值保留两到三位小数,小于 .001 一律写成 "p < .001";正文里 "Use the term, not the symbol, for statistics",它给的例子就是 "the means were"。

三份文件摆在一起,一个方法段的结构空间可能会变小:时态有建议,报告项目有清单,数字格式有规则。但其中哪些项目对这篇稿件是硬要求,还要看研究设计、课程说明和目标期刊。

Turnitin 那边是怎么描述这类文本的

它的 FAQ 把要找的差异说成统计问题:

"Our classifiers are trained to detect these differences in word probability and are adept at the particular word probability sequences of human writers."

同一页还说,模型 "is not explicitly programmed to evaluate specific signals such as 'burstiness,' 'perplexity,' or other individual metrics sometimes referenced in public discussions"。两句必须连起来读:被否认的只是公众常挂在嘴边的那两个单项指标,词概率本身仍然是这套系统的计价单位。这一对说法在词概率与 Turnitin:分类器实际在读什么里拆得更细。

同一份 FAQ 还列了它自己的误报长什么样:

"Sometimes false positives (incorrectly flagging human-written text as AI-generated), can include content without a lot of structural variation, text that literally repeats itself, or text that has been paraphrased without developing new ideas."

而真正能带进谈话里的,是它后面那一句:

"If our indicator shows a higher amount of AI writing in such text, we advise you to take that into consideration when looking at the percentage indicated."

APA 方法部分的结构变化可能较少,因为写作指导和报告要求压缩了部分选择。这只是两份材料之间的一种可能联系,不能证明 APA 格式导致了某个分数。具体到你这一篇,它既不判定分数错,也不判定分数对。

你论文里有相当一部分根本没进这个分母

报告上那个数字,是从你文档的一部分算出来的,不是从全部算出来的。Turnitin 自己划了范围:

"This qualifying text includes only prose sentences, meaning that we only analyze blocks of text that are written in standard grammatical sentences and do not include other types of writing such as lists, bullet points (short non-sentence structures), or other non-sentence structures."

这条定义落到 APA 论文上非常不均匀,而心理学是不均匀得最厉害的那类——因为手册要求你不要在正文里重复表格里已经有的统计量。

APA 论文的组成部分APA 或 JARS 在这里怎么说厂商对这类文本的说法
标题页与作者注JARS 建议报告注册信息、经费来源、利益冲突等项目短的非句子结构不属于合格文本
摘要JARS 建议交代研究问题、被试、方法、发现和结论是散文句子,进分析范围
方法JARS 列出纳入排除标准、人口学信息、抽样过程、测量工具和信效度是散文句子,进分析范围
结果正文JARS 与统计指南涉及精确 p 值、效应量、置信区间和被试流失是散文句子,进分析范围
均值与标准差表APA:不要在正文和表格里重复同一个统计量2023 年的一条 release note 说表格里的长文散文会被处理。而一张均值表里没有任何散文句子,按上面那条定义就不算合格文本——最后这一步是我们对定义的解读,厂商没有给过针对统计表的示例
参考文献APA 的文献著录格式2023 年的一条 release note 说,修掉了在参考文献里高亮 AI 写作的问题,并写明 "Bibliographies are now excluded when processing the AI writing report."。同一条还说,要重新提交才对该文档生效

一篇引用扎实的心理学论文,参考文献能占好几页,表格又装走了你大部分数字。它们整体在被打分的范围之外或边缘,而你的方法段完完整整在里面。通用规则见Turnitin AI 检测中的「合格文本」是什么,表格那一层见Turnitin 会读表格里的文字吗

时态有指导,措辞仍是你的

这是真正会改变你下一步动作的一条分界,我们自己也是绕了一圈才看清。

三份来源做的事并不一样:APA 推荐时态,JARS 为相应研究设计提供报告标准,数字指南规定统计格式;课程或目标期刊再决定哪些报告项目必须出现。它们都没有替你写句子。"The results indicate"、"Future research should explore" 是时态例句,不是必须照抄的模板。

于是论文分成两半。

研究事实和明确要求的披露项目不能动。 如果研究设置了纳入排除标准,就要在课程或期刊要求的位置准确报告;最终样本量及其确定方法、精确 p 值、效应量与置信区间、所分析分数的信度系数也是同理。你可以改表达,不能改研究本身,更不能为了让段落显得不那么模板化就删掉目标明确要求的项目。这条线怎么划,方法与结果部分哪些可以改写,哪些必须逐字保持准确里逐项讲过。

解释仍然是你自己的。 这个问题为什么值得研究、前人留下的缺口具体在哪、测量工具的表现如何影响这个结果该怎么解释。JARS 建议解释结果时考虑 "sources of potential bias and threats to internal and statistical validity",也建议讨论外部效度,但它没有替你下结论。如果你的讨论部分读起来和别人的可以互换,那是写作习惯,不是手册给出的句子。

方法或结果被标红之后,按这个顺序做

  1. 先看高亮,再看数字。 整章方法连成一大片高亮,有它的机制解释,先弄明白这个:Turnitin 把我整章方法都标红了
  2. 数被分析的散文有多少,不要数页数。 短篇报告里如果真正进分析的散文只有几百词,厂商说预测会趋向 "mostly 'all or nothing'"。见短文档的「全有或全无」
  3. 动措辞之前,先把这篇稿件的要求标出来。 把课程说明或期刊投稿须知放在相应的 JARS 表旁边,保留目标明确要求的每一项,并确保所有研究事实准确。JARS 是报告地图,不等于每篇 APA 论文都必须塞进全部条目。
  4. 把厂商自己的立场带上。 它的 FAQ 写着,这个百分比 "should not be used as the sole basis for action or a definitive grading measure by instructors"。这类表述汇总在AI 比例偏高时,厂商是怎么教老师处理的
  5. 如果有人拿一个阈值压你AI 率 20% 算高吗解释了为什么没有任何公开数字能当合格线。

如果措辞反正要改

手工重写一段 APA 结果,翻车方式很固定:你在一堆有斜体规则、有小数位规则、还有「不能和表格重复」规则的数字之间挪句子。真正要保住的是数字和格式,不是文采。

HumanPen 在这篇里有用的地方,是开跑前那张范围确认界面,不是对下一次分数的承诺。HumanPen 由我们开发,以下只按第一方说明理解。你圈出愿意改的结果正文后,界面会先展示段落级范围;这时逐项检查表注、数字陈述或相邻段落有没有被带进目标。也可以导入已有的 Turnitin / iThenticate AI 报告,让它先定位候选段落。返回的文档仍可编辑,产品设计目标是保留术语、引用、样式和结构;统计量仍要和分析输出逐项核对。符合条件的段落可以免费继续处理。报告驱动的做法见只改写 Turnitin 报告标红的那几段

改完分数会是多少,没有工具能提前告诉你。所以无论用什么方式改,交之前都要把返回的统计量和你的分析输出摆在一起对一遍。一个 p 值掉了一位小数,比一句话被标红严重得多。

常见问题

用 APA 格式本身会推高 AI 率吗? 本文实读的 AI 检测 FAQ 没有这样的说法,也没有出现 APA、MLA 或任何格式手册。它只说误报可能出现在结构变化少的文本中。APA 指导和报告要求可能压缩某些章节的变化,但这不能证明 APA 格式导致了某个分数。

要不要把方法部分改得不那么模板化? 不能靠改研究事实或删除课程、期刊明确要求的内容来做。先确认哪张报告清单适用于这篇稿件,再改表达,不要改科学内容。

表格和参考文献算进那个百分比吗? 只有合格的散文句子进分析;2023 年的一条 release note 说处理 AI 写作报告时会排除参考文献,并且要重新提交才对旧文档生效。所以那个百分比描述的是你文档的一部分,不是全部。

结果部分整段被标红,但分析确实是我自己跑的。 自己运行分析能说明数字从哪里来,不能单独说明正文是谁写的。如果结果正文也确实由你写成,而且文本结构变化很少,它可能符合厂商列出的一项误报特征。这个百分比仍不能作为处理的唯一依据。带着报告、原始数据文件和写作版本去谈,不要把高亮直接当成结论。

APA 第六版或质性研究适用吗? 上面引的时态指引和 JARS–Quant 都是第七版的量化标准,质性研究另有一套 APA 报告标准。无论哪一种,都要先核对适用的报告标准,以及课程或目标期刊的实际要求,再决定改哪些。

继续阅读