法学论文被判 AI:IRAC 骨架、判例原文和 OSCOLA 脚注
法学论文有两块特别的地方:一块是老师按「有没有照这个结构写」给分的骨架,一块是逐字引用的成文法和判决原文。报告回来分数很高的时候,这两块要往相反的方向处理。
HumanPen 团队
· 15 分钟
先说结论
法学作业交给检测模型的,是一大段「被教成必须写成这个样子」的英文散文。IRAC、CLEO 把段落顺序定死了,按通行的教法连每段的开头几个词都定死了。判例摘述有固定句式。剩下的字里又有很大一部分是成文法条文和判决原句的逐字引用,改一个词就不再是引用,而是引错。
接下来这两半会落到两个完全不同的地方。
AI 写作报告的百分比只按「合格文本」算。而定义这份报告的那几页官方文档里,从头到尾没有出现过 quotation、footnote、endnote 这些词,所以没有任何公开材料能支持「块引用不算进这个百分比」的说法。相似度报告那一侧才有关于引文和出处的成文规则,而且在本文讨论的这几页里,它是唯一明确点到引用格式的地方:出处识别模型公开写明训练在 APA、MLA、Turabian 和 IEEE 编号引用上。OSCOLA 不在里面,Bluebook 也不在。
所以两半要分开处理。把它们当成一个问题,结果就是去改一段本来一个字都不该动的引文。
AI 报告在你的法学作业里到底读了什么
先看分母,因为法学作业的分母很特别。FAQ 对被分析的内容有定义:
"This qualifying text includes only prose sentences, meaning that we only analyze blocks of text that are written in standard grammatical sentences and do not include other types of writing such as lists, bullet points (short non-sentence structures), or other non-sentence structures."(合格文本只包含散文句,也就是说我们只分析由标准语法句子构成的文本块,不包括列表、项目符号等非句子结构。)
关于这个百分比和整份文件的关系,同一页还有一句:
"As noted previously, this percentage is not necessarily the percentage of the entire submission. If text within the submission is not considered long-form prose text, it will not be included."(如前所述,这个百分比不一定是整份提交内容的百分比。文中不属于长篇散文的部分不会被计入。)
对写 OSCOLA 或 Bluebook 的人来说,这里马上跟着一个问题:脚注算不算散文?一整页从判决里摘下来的块引用算不算散文?在这两种格式下,脚注常常占掉全文很大一块字数。文档没有回答这个问题。我没有猜,去数了一遍。
这次数了什么。 2026 年 8 月 27 日,用浏览器打开定义 AI 写作报告的三页官方文档(Using the AI Writing Report、Turnitin's AI writing detection capabilities FAQs、AI writing detection model 更新日志),读取渲染后的正文:7,218 + 31,712 + 9,957 = 48,887 字符。三页合计逐词检索:`quotation` 0 次 · `quote` 0 次 · `footnote` 0 次 · `endnote` 0 次 · `citation` 0 次 · `verbatim` 0 次 · `statute` 0 次 · `legal` 0 次。`cite` 在更新日志页有 3 次命中,三次都在 "excited" 这个词里面。同一份文本上的灵敏度对照,用来确认量具是活的:`prose` 13 次 · `qualifying` 15 次 · `bibliograph` 4 次。
公开写明会被排除的只有参考文献。2023 年 8 月的一条更新日志写着 "Bibliographies are now excluded when processing the AI writing report."(处理 AI 写作报告时,参考文献现已被排除。)紧跟的下一句是:已经提交过的文件需要重新提交才能重新处理。参考文献不是脚注,那条更新日志对脚注只字未提。
学科也一样查不到。`law` 在这 48,887 字符里 0 次命中。`subject area` 命中 3 次,全在 FAQ 那一页,三次都在讲训练数据的构成:一次是 `academic writing across geographies and subject areas`(跨地域、跨学科的学术写作),另外两次重复同一份名单 `less common subject areas such as anthropology, geology, sociology, and others`(人类学、地质学、社会学等较少见的学科)。和「文体」最沾边的说法出现在合格文本的定义句里:`a longer piece of written work, such as an essay, a dissertation, or an article, etc.`(一篇较长的书面作品,比如一篇论文、一篇学位论文或一篇文章等等。)
也就是说,公开文档里没有给法学写作开任何口子。这一点是双向的:既没有对判例评述的额外宽容,也没有额外的严格。
那副你是照着它拿分的骨架
IRAC 不是你自己写顺手了的风格。Touro Law Center 的学习方法页写得很直白:"IRAC stands for the 'Issue, Rule, Application, Conclusion' structure of legal analysis. An effective essay follows some form of the IRAC structure where it is organized around an 'issue', a 'rule', an 'application', and a 'conclusion' for each and every issue and sub-issue identified as a legal problem."(IRAC 指法律分析中「争点、规则、适用、结论」的结构。一篇有效的答案会以某种形式遵循 IRAC,围绕识别出的每一个争点和子争点分别组织出争点、规则、适用和结论。)同一页把它称作 "a supporting scaffold (or training wheels)"(一副支撑用的脚手架,或者说辅助轮)。
把那一页的教学要求,和 Turnitin 公开的误报易发特征放在一起看,撞得相当正面。
| 法学写作被教的动作 | 落到文本上是什么 |
|---|---|
| "Use the 'whether, when' structure to help you isolate and write an issue statement",开头写成 "The issue is whether," | 全文每一个争点用同样四个词开头。而同一页说这四个词是可以换的,见下 |
| "'Because' is the single most important word to use when writing the analysis",另给出 as 和 since 作为替换 | 一个连接词扛起了全部适用段落的推理 |
| "Repeat the process for each issue you identify. Each issue forms the basis for a separate IRAC analysis" | 一整份文件由 N 个结构完全相同的块拼成 |
| CLEO(claim / law / evaluation / outcome 四步),见 S. I. Strong《How to Write Law Essays & Exams》(Oxford University Press, 2014)目录 | 换一组标签,效果一样 |
Turnitin 自己对误报易发文本的描述:
"Sometimes false positives (incorrectly flagging human-written text as AI-generated), can include content without a lot of structural variation, text that literally repeats itself, or text that has been paraphrased without developing new ideas."(有时候误报会出现在结构变化不多的内容、字面上自我重复的文本,或者只做了改写、没有发展出新想法的文本上。)
紧接的下一句是拿去跟导师谈的时候最有用的:`If our indicator shows a higher amount of AI writing in such text, we advise you to take that into consideration when looking at the percentage indicated.`(如果我们的指标在这类文本上显示出较高的 AI 写作比例,建议你在看这个百分比时把这一点考虑进去。)
这段描述里没有出现「法律」两个字,但它写的就是一份按教学要求写出来的法学答案。文章结构如何影响 Turnitin AI 分是这件事的通用版本。
但先别急着认定这些都动不了。往 Touro 那一页下面再读两句,它自己写着:
Some professors might not want to see this language – “the issue is whether.” You achieve the same result with other words – “Did” or “Can”, for example. Don’t get fixated on language. Follow your individual professor’s instruction and realize that either way, you achieve the same result: identification of the legal problem. (有些老师并不想看到 "the issue is whether" 这种说法。换成别的词一样能达到同样效果,比如 "Did" 或者 "Can"。不要在措辞上死磕。听你自己那位老师的,而且要明白无论哪种写法,达到的结果是一样的:把法律问题识别出来。)
所以每个争点开头那四个词是可以换的,而且这话是教你这么写的那一页自己说的。真正有代价的是别的:四步的顺序,以及「每一个争点和子争点都要走一遍」这条要求。评分标准通常查的是这一部分,所以「把结构写得多变一点」这句话,在结构本来就由你自己定的学科里很便宜,在法学这边不便宜。
一个字都不能改的那部分
上面讲的都是 AI 那个数字。引用的权威材料属于另一份报告、另一套规则,而这套规则值得逐条看清楚,因为法学是受它影响最重的学科。
OSCOLA 把机械动作定死了。第 5 版写明 "Quotations must be faithful to the original"(引文必须忠于原文),只允许在单双引号之间转换,原文里的错误要用 `[sic]` 标出来而不是改掉。它还按长度把引文分成两类:三行以内并入正文、用单引号;超过三行则改为 "an indented paragraph, with no further indentation of the first line"(缩进段落,首行不再额外缩进),并且 "do not use quotation marks"(不使用引号)。出处一律进脚注:"When citing a source, place the reference in a footnote. Indicate footnotes with a superscript number."(引用来源时,把出处放进脚注,用上标数字标出脚注。)
再把这些动作对到相似度报告那一侧的机制上。
| 你的法学作业里有 | 官方文档怎么说 |
|---|---|
| 判决里摘出来的长块引用,缩进、完全没有引号 | 排除过滤器 "ignores text enclosed in quotation marks or formatted as block quotes"(忽略引号内、或设为块引用格式的文字)。另有一句补充:`will also exclude indented blocks of text when the original file is a .doc or .docx file`(当原始文件是 .doc 或 .docx 时,也会排除缩进的文本块) |
| 三行以内、用单引号的短引文 | 同一个帮助站的两页各印了一份可识别引号清单,而其中一处差异正好落在这个符号上,见下 |
| OSCOLA 或 Bluebook 的脚注出处 | "Citation recognition models have been trained on citations in certain formats: APA, MLA, Turabian, and IEEE numbered citations and references. If a citation is included for a match but is not in one of these formats, the report may--but is less likely to--recognize those as citations."(出处识别模型训练在特定格式上:APA、MLA、Turabian 以及 IEEE 编号引用与参考文献。如果某处匹配带的出处不属于这些格式,报告仍可能识别,但可能性较低。) |
| 权威放在页脚而不是句子旁边 | "Citations may not be recognized if they are placed very far from the matched text."(出处离被匹配的文字太远时,可能不会被识别。) |
单引号值得单独一段,因为 OSCOLA 强制用它,而 Word 会替你决定你拿到的是哪一种。Match Groups 那一页列了七种可识别引号,其中单引号那一条是弯的一对,U+2018 和 U+2019。排除过滤器那一页列了八种,其中单引号那一条是直的撇号,两个 U+0027。同一个帮助站、同一块功能,而在法学生唯一在意的那个位置上,两份清单给出的是不同的字符。这两页我是 2026 年 8 月 27 日打开、把码位取出来对的,因为在正文字号下这两个字形肉眼分不出来。
去纠结「到底该敲哪一种」是个错的任务,因为这两页官方文档自己就没统一。真正能查的是你即将上传的那个文件:换一次模板、导出一次 PDF、换个人用另一个字处理软件打开过,引号都可能在你上次看过之后被换掉,而屏幕上不会有任何东西提示你发生过这件事。排除过滤器那一页还直接写了另一种失效情形:引号和文字之间隔了空格就不会被识别。从判例数据库里复制粘贴出来的文本,最容易带的正是这种空格。
还有一句要读两遍:这些排除项是设置。「排除引号内文字」这个开关在你这次作业上是开还是关,由学校那边的人决定,而这个决定不会写在发给你的那个百分比旁边。引号打了、出处也标了,为什么还是被算成相似把四个匹配分组和识别模型讲全了。
落到法学作业上,规则很短:引用的法条、判决理由和附带意见,任何情况下都不是改写的对象。如果它们被标成匹配,要处理的是标注和格式,不是措辞。
法学作业真正还能动的地方
把引文、出处体系、以及评分标准要求的骨架部分都去掉之后,剩下的是「适用」这一步。IRAC 里的 A,CLEO 里的 E。Touro 那一页把这一步称作 "the heart of the discussion"(讨论的核心)。
具体说,下面这些动作只有真读过材料的人写得出来,所以它们读起来才像你写的:
- 点出具体事实,而不是事实的类别。 Touro 那一页把自己的两个版本并排放着。弱的那版只写警员注意到嫌疑人 "fit the description"(符合描述)。强的那版把理由写了出来:"because Dan was extremely tall at 6'4", was wearing a green and tan sweater with purple patches and pointy-toed alligator cowboy boots, fitting the description provided by the eyewitness to the robbery."(因为 Dan 身高 6'4" 非常高,穿着一件带紫色补丁的绿棕色毛衣和尖头鳄鱼皮牛仔靴,与抢劫案目击者提供的描述一致。)同样的法律、同样的事实,只有一版在做适用。
- 说明为什么用这个权威而不是那个更显眼的。 一句「这里依据的是一审判决,因为上诉审的论理落在本案不涉及的一个点上」,没读过两份判决的人写不出来。
- 把对方最强的论点写进去,然后在实体上驳掉它。 一个先跑对方论点、再说明它为什么不成立的段落,形状和复述规则的段落完全不同。
- 说清楚权威到哪里为止。 有节制、有指向的不确定(「本管辖区内该点尚无一审以上的判决,以下是类推论证」)既是诚实的法律写作,也和全文其余部分的语气不一样。
- 走不通的子争点,一句话带过就算。 考试状态下的本能是把每个子争点都 IRAC 一遍、写成同样长。而对轻重不同的争点做等长处理,恰好就是厂商描述的那种平坦形态,而且它把同样多的字给了本来不值同样多字的争点。
以上都不是对某个百分比的承诺,谁给你这种承诺都是在猜。它说的只是:法学作业里哪些段落是你自己该写出差别的,哪些不是。
如果报告已经回来了
按这个顺序做,能少走冤枉路。
- 先确认手上是哪一份报告。 AI 写作百分比和相似度百分比在文档里写明 "completely independent and do not influence each other"(完全独立、互不影响)。法学作业相似度偏高经常有完全正当的原因,而它对另一个数字什么都不说明。Turnitin AI 写作报告和相似度报告有什么区别?两种分数不要混着看一次讲清。
- 看高亮,别看数字。 高亮落在你的适用段落里,还是落在规则陈述里,决定了下一步做什么,而百分比不告诉你这个。
- 先把相似度那一侧的机械原因排掉。 引号形态、开引号后面多出来的空格、脚注与正文的距离、这次交的是 .docx 还是 PDF。这些几分钟就能查完,而且不改一个字就可能让一处匹配换一个分组。
- 不要动引用的权威材料。 为了这个目的,永远不要动。
- 然后,也只有到这一步,再看你自己写的那部分散文。 也就是适用、评价和结论,这也是改写唯一站得住脚的范围。
如果第五步终归要做,要保住的是出处体系。法学作业带着脚注编号、`(n 27)` 这类交叉引用、判例简称、权威索引表和 pinpoint 页码,文字一动,这些东西是会悄悄错位的。HumanPen 处理的是文件本身而不是粘贴进去的文本:上传 DOCX,拿回一份仍可编辑的 DOCX,结构、术语、引用、排版和样式都保留。把 Turnitin 或 iThenticate 的 AI 报告交给它,被标出来的片段由它去找,不用自己一段段挑;找到之后也只改这些,其余一个字不动。它能改动的最小单位是一个段落,开始之前会把扩展后的范围摆出来,你点了头才动——对一份脚注密集的文件来说,这就是「回头重校四段」和「回头重校四十段」的差别。符合条件时可以免费继续降 AI。
常见问题
引用的法条和判决原文会不会被 AI 百分比排除掉? 没有任何公开材料这么写。定义 AI 写作报告的三页文档里,quotation、quote、footnote、citation 这几个词一次都没出现。这份报告唯一公开的排除项是参考文献,来自 2023 年 8 月的一条更新日志。真正处理引文和出处的排除过滤器属于相似度报告,而且开不开由学校那边决定。
OSCOLA 会被识别成一种引用格式吗? 出处识别公开写明的训练格式是 "APA, MLA, Turabian, and IEEE numbered citations and references",其余格式的说法是 "may--but is less likely to--recognize those as citations"。OSCOLA 和 Bluebook 都不在清单上。这句话讲的是相似度报告的匹配分组,不是 AI 百分比。
我确实在某个环节用了 AI 工具,有没有规范的写法? 两套体系现在都有条文了,而且都不是变通办法。OSCOLA 第 5 版加了 3.7.13 节 "Generative artificial intelligence":把模型本身当作者,你给它的指令用引号引起来,写上开发它的机构,再加上生成日期。手册自己给的例子是 `ChatGPT, response to 'Explain how artificial intelligence works', OpenAI (16 July 2023)`。Bluebook 在 2025 年的第 22 版加了 Rule 18.3,分成大语言模型、搜索结果、AI 生成内容三类,并要求把输出存成 PDF 留档——这一条我是从当时的报道知道的,没有读过第 22 版原书。也要看清这两条规则不是什么:85 页的 OSCOLA PDF 我全文搜过,`detect`、`Turnitin`、`plagiar` 三个词都是 0 次。引用手册管的是怎么把工具署出来。你到底能不能用它,是学院的规定,两本手册都不回答这个问题。
规则那一整节全被标红,每个字都是我写的,怎么会这样? 句子不是一句一句单独打分的。官方描述是:提交内容被切成互相重叠的片段,每个片段拿到一个 0 到 1 的值,每个合格句子 "inherits the segment's score"(继承所属片段的分数),重叠部分再做池化。一整段用同一种语气写下来的文字,回来就可能是一条连续的色带。Turnitin 把我整章方法都标红了讲的是另一个学科里同样的形状。
我把一道 problem question 单独拿去测,分数很难看。 短文本的行为是性质上的不同。FAQ 写的是:在只有几百词的短文档里 "the prediction will be mostly 'all or nothing' because we're predicting on a single segment without the opportunity to overlap"(预测基本上会是「全有或全无」,因为只能在单个片段上预测、没有重叠的机会)。一道 800 词的答题接近这个区间。另外,生成 AI 写作报告本身就要求文件里至少有 300 词的散文。
那我还要不要用 IRAC? 这个问题该问导师和评分标准,不该问检测工具。不动骨架也能做的是:别再让适用段落和规则段落写成同一个形状,而分数本来就在适用那里。为了不被标红,要不要改自己的写法是这个问题的完整版本。
继续阅读