Rapports d’essais randomisés et détection de l’IA : ce que CONSORT 2025 a décidé avant que vous n’écriviez

Un rapport d’essai randomisé est écrit deux fois avant que quiconque ne le lise : une fois comme protocole, une fois comme article, les deux fois d’après des listes de contrôle numérotées du même groupe. La liste publiée descend jusqu’à un seul mot de votre titre. Cela vaut la peine de le savoir avant de décider quelles phrases modifier parce qu’un détecteur les a surlignées.

L'équipe HumanPen

· 15 min de lecture

Pourquoi un rapport d’essai randomisé revient-il avec un score d’IA élevé alors que les données sont les miennes ?

Parce que l’essentiel d’un rapport d’essai est spécifié à l’avance et qu’une bonne part en est un second récit de quelque chose que vous avez déjà écrit. CONSORT 2025 énumère trente éléments qu’un rapport doit couvrir, vous demande de mettre un mot précis dans le titre, et renvoie les effectifs de participants vers un diagramme de flux et les caractéristiques initiales vers un tableau. Ce qui reste en prose continue, ce sont le récit des Méthodes et la Discussion, et le récit des Méthodes est une version condensée d’un protocole enregistré. Turnitin, dans des documents qui ne mentionnent jamais les essais cliniques, dit ne mesurer que des phrases de prose et dit que ses propres faux positifs peuvent concerner un texte à faible variation structurelle ou un texte paraphrasé sans idées nouvelles. Un signalement sur une section Méthodes n’est la preuve de rien quant à la façon dont cette section a été écrite, et supprimer du contenu de la liste de contrôle pour qu’elle paraisse moins uniforme rend le rapport moins bon.

Rien du côté du fournisseur ne dit rien de tout cela à propos des essais. Nous avons lu les trois pages qui définissent l’AI Writing Report (Using the AI Writing Report, les AI writing detection capabilities FAQs et File requirements for an AI Writing Report) le 27 août 2026, soit 38 174 caractères de texte d’article rendu à elles trois, et nous y avons cherché : `CONSORT` 0 occurrence, `clinical` 0, `trial` 0, `randomis` 0, `randomiz` 0, `protocol` 0, `checklist` 0, `registr` 0. L’instrument fonctionnait sur le même passage : `prose` 12 occurrences, `qualifying` 12.

L’autre sens est celui où il est facile de se tromper, nous l’avons donc compté aussi. Sur les treize pages de contenu listées dans le plan du site SPIRIT-CONSORT, plus la liste de contrôle CONSORT 2025 et sa version détaillée de douze pages, soit 61 768 caractères au total : `detection` 0 occurrence, `detector` 0, `Turnitin` 0, `generative` 0, `large language` 0, `ChatGPT` 0, `plagiarism` 0. Test de sensibilité sur le même passage : `consort` 107, `trial` 167, `randomis` 36. `Artificial intelligence` ne renvoie qu’une seule occurrence, sur la page des extensions, où elle nomme une extension SPIRIT pour les essais dont l’intervention est un système d’IA. C’est une norme pour rapporter un essai portant sur un outil d’IA, ce qui est un sujet différent de celui d’un auteur qui en utilise un. Le rapprochement fait plus bas est donc le nôtre, assemblé à partir de deux ensembles de documents qui ne se sont jamais cités l’un l’autre.

La recommandation impose un mot dans votre titre

L’élément 1a de la liste de contrôle CONSORT 2025 se lit `Identification as a randomised trial` (Identification comme essai randomisé). La liste détaillée, qui est l’endroit où le groupe explicite chaque élément, le dit sans détour :

`Use the word "randomised" in the title` (Utilisez le mot « randomisé » dans le titre)

C’est une recommandation de publication qui descend jusqu’à un seul mot d’une seule ligne. C’est une bonne règle et elle existe pour une bonne raison : les indexeurs et les auteurs de revues systématiques doivent pouvoir trouver votre essai. Cela signifie aussi que la première ligne de chaque rapport de ce genre, dans le monde entier, porte le même terme.

L’élément 1b spécifie ensuite le résumé. Sa liste de contenus requis compte sept puces, dont trois s’ouvrent sur dix autres, et à elles toutes elles nomment quatorze choses que le résumé doit porter : les objectifs, le plan et le cadre de l’essai, les critères d’éligibilité et les cadres de l’étude, les interventions et les comparateurs, les critères de jugement principaux, la façon dont les participants ont été répartis, qui a été mis en aveugle, les effectifs randomisés par groupe, les effectifs analysés par groupe, un résultat par groupe avec taille d’effet et précision, les effets indésirables importants, une interprétation générale, le nom et le numéro du registre, et les sources de financement. Sous la liste figure une instruction de plus, imprimée en astérisques dans la source :

`Do not report information that does not appear in the body of the paper` (Ne rapportez pas d’information qui n’apparaît pas dans le corps de l’article)

Lue comme une contrainte d’écriture, elle est inhabituelle : votre résumé doit être une compression de votre propre article et ne doit rien contenir de nouveau. Il existe une expression pour cela du côté du fournisseur, dans le paragraphe où Turnitin décrit à quoi ressemblent ses faux positifs, et c’est `text that has been paraphrased without developing new ideas` (un texte paraphrasé sans développer d’idées nouvelles). Personne ne prétend que ces deux documents parlent de la même chose. Ce n’est pas le cas. Mais un résumé rédigé selon l’élément 1b entre dans cette description par construction et, à part ses intitulés de section, il est fait de phrases de prose du premier au dernier mot.

La section Méthodes, c’est la deuxième fois que vous l’avez écrite

C’est la partie qui n’a pas d’équivalent dans la plupart des autres genres, et c’est la raison pour laquelle un rapport d’essai est un problème différent de celui d’un article auquel on aurait agrafé une liste de contrôle.

Avant que l’essai ne se déroule, il y a eu un protocole. L’élément 3 de CONSORT exige que vous disiez où il se trouve : `Where the trial protocol and statistical analysis plan can be accessed` (Où le protocole de l’essai et le plan d’analyse statistique sont accessibles), la liste détaillée demandant une URL vers son emplacement. L’élément 2 exige le nom du registre, le numéro d’identification, l’URL et la date d’enregistrement. L’élément 10 exige que vous rapportiez `Important changes to the trial after it commenced including any outcomes or analyses that were not prespecified, with reason` (les modifications importantes apportées à l’essai après son début, y compris tout critère ou analyse non préspécifié, avec la raison).

Mettez ces trois éléments bout à bout et ils décrivent une situation précise : vos critères d’éligibilité, votre méthode de randomisation, la dissimulation de la répartition, vos procédures de mise en aveugle et vos analyses prévues ont tous été consignés dans un document vers lequel votre article pointe publiquement, et l’article rapporte le même contenu une seconde fois, en plus court. Ce n’est pas un raccourci. C’est tout le sens de l’enregistrement prospectif.

Le versant protocole a sa propre recommandation, du même groupe : SPIRIT 2025, une liste de contrôle de 34 éléments publiée parallèlement à CONSORT et financée par la même subvention. Les deux documents partagent donc plus que leur sujet. Ils ont été rédigés d’après des listes numérotées appariées, révisées ensemble.

Si vous avez déjà eu le sentiment que votre section Méthodes se lit comme un formulaire, voilà pourquoi. Deux des documents les plus fortement spécifiés de l’édition académique décrivent les mêmes procédures, l’un après l’autre, selon deux listes de contrôle alignées.

Les chiffres ont été sortis de la prose exprès

CONSORT ne se contente pas de dire quoi rapporter. Pour plusieurs des éléments les plus lourds, il dit sous quelle forme le rapporter.

Élément CONSORT 2025Forme requiseCe que cela donne pour une mesure qui ne lit que la prose
22a, participants assignés aléatoirement, ayant reçu l’intervention, analysés`In a flow diagram, the number of participants:` (Dans un diagramme de flux, le nombre de participants) suivi d’une liste à puces d’effectifsUn diagramme d’effectifs ne contient aucune phrase de prose
22b, pertes et exclusions après randomisation, avec raisonsÉgalement `In a flow diagram` (Dans un diagramme de flux)Idem
25, caractéristiques démographiques et cliniques initiales`A table showing baseline demographic and clinical characteristics for each group` (Un tableau présentant les caractéristiques démographiques et cliniques initiales de chaque groupe)Une grille de moyennes, d’écarts-types et de pourcentages
27, tous les effets indésirables ou événements non intentionnels`For each group preferably in a table with the number of participants at risk` (Pour chaque groupe, de préférence dans un tableau avec le nombre de participants à risque)Surtout tabulaire, avec un peu de prose autour
2, enregistrement de l’essaiNom du registre, numéro, URL, dateDes lignes courtes plutôt que des phrases
5a et 5b, financement et conflitsFinanceurs nommés, rôles, intérêts déclarésSouvent un bloc de déclarations fait d’entrées courtes

Mettez maintenant à côté la définition donnée par Turnitin de ce qu’il lit :

`This qualifying text includes only prose sentences, meaning that we only analyze blocks of text that are written in standard grammatical sentences and do not include other types of writing such as lists, bullet points (short non-sentence structures), or other non-sentence structures.` (Ce texte éligible ne comprend que des phrases de prose, ce qui signifie que nous n’analysons que des blocs de texte rédigés en phrases grammaticales standard et que nous n’incluons pas d’autres types d’écrits comme les listes, les puces (structures courtes qui ne sont pas des phrases) ou d’autres structures qui ne sont pas des phrases.)

Et la phrase qui la suit sur la même page :

`This percentage is not necessarily the percentage of the entire submission.` (Ce pourcentage n’est pas nécessairement le pourcentage de l’ensemble de la soumission.)

La liste des références est exclue elle aussi, d’après la propre note de mise à jour du fournisseur d’août 2023, qui indique qu’un bug surlignant de l’écriture IA à l’intérieur des références bibliographiques a été corrigé et que `Bibliographies are now excluded when processing the AI writing report.` (Les bibliographies sont désormais exclues lors du traitement du rapport d’écriture IA). Cette note ajoute qu’une soumission doit être renvoyée avant que le changement ne s’y applique.

Retirez donc le diagramme de flux, le tableau des caractéristiques initiales, le tableau des effets indésirables, la ligne d’enregistrement et la liste des références. Ce qui reste dans la mesure, c’est l’introduction, le récit des Méthodes, le récit des résultats autour des tableaux et la Discussion. Autrement dit : les parties que CONSORT spécifie le plus étroitement, moins presque toutes celles qui portent vos chiffres réels. Qu’est-ce que le « texte éligible » dans la détection de l’IA par Turnitin ? traite de la règle générale et Turnitin lit-il le texte à l’intérieur des tableaux ? traite du cas des tableaux, y compris la partie de cette note de mise à jour sur la prose longue à l’intérieur des cellules de tableau.

Il y a une seconde conséquence qui mérite d’être signalée. Un rapport court dont la prose analysée n’atteint que quelques centaines de mots tombe dans le comportement que Turnitin décrit comme `mostly "all or nothing" because we're predicting on a single segment without the opportunity to overlap` (essentiellement « tout ou rien », parce que nous faisons une prédiction sur un seul segment, sans possibilité de chevauchement), et la phrase suivante dit `some text that is a mix of AI-generated and original content could be flagged as entirely AI-generated` (qu’un texte mêlant du contenu généré par IA et du contenu original pourrait être signalé comme entièrement généré par IA). Un rapport d’essai avec un grand diagramme, trois tableaux et quarante références est plus court, au sens où la mesure l’entend, que son nombre de pages ne le suggère. Documents courts et problème du tout ou rien dans Turnitin détaille cela.

Là où la liste de contrôle statue aussi sur votre formulation, pas seulement sur votre contenu

Deux éléments vont plus loin que le simple énoncé d’un contenu, et les deux sont faciles à manquer parce qu’ils tiennent en une seule ligne à l’intérieur d’un long tableau.

L’élément 22b, sur les pertes et exclusions après randomisation, ajoute ceci :

`The wording "protocol deviation" is not sufficiently explicit and exact reasons should be reported` (La formulation « écart au protocole » n’est pas suffisamment explicite et des raisons exactes doivent être rapportées)

Qu’une recommandation de publication nomme une formulation pour la refuser est rare. La raison pour laquelle cela compte ici n’a rien à voir avec un détecteur. Remplacez une raison précise par une formule de synthèse bien propre pendant une révision et vous avez enfreint l’élément 22b. Cette défaillance est invisible pour un correcteur et évidente pour un évaluateur qui connaît la liste.

L’élément 29, sur l’interprétation, est l’autre :

`Avoid overinterpretation ('spin')` (Évitez la surinterprétation, le « spin »)

La Discussion est normalement décrite comme la partie libre d’un article. Dans ce genre, elle arrive avec une instruction sur la portée que peuvent avoir vos affirmations, à côté d’exigences consistant à relier les résultats aux données existantes et à mettre en balance bénéfices et effets indésirables. L’élément 30 nomme ensuite les quatre choses que votre paragraphe sur les limites doit traiter : les limites méthodologiques, l’imprécision, la généralisabilité et la multiplicité des analyses lorsqu’elle est pertinente.

Ce que la liste de contrôle ne touche jamais

Voici la distinction qui décide de ce que vous faites ensuite, et ce n’est pas celle que proposent la plupart des conseils de révision.

CONSORT spécifie ce qui doit apparaître, à plusieurs endroits la forme que cela doit prendre, et à deux endroits une formulation à éviter. Il n’écrit pas vos phrases. Rien dans la liste ne vous dit comment formuler l’importance de la question.

Fixe, et rattachable à un numéro. Ce qui est utile ici n’est pas un avertissement général sur ce qu’il ne faut pas toucher. C’est que chacun de ces éléments porte un numéro sur lequel vous pouvez pointer. Les effectifs du diagramme de flux sont 22a et 22b. Le nom du registre, le numéro, l’URL et la date sont l’élément 2. L’éligibilité telle qu’elle a réellement été appliquée est 12a. Qui a généré la séquence d’allocation et par quelle méthode, c’est 17a. Qui a été mis en aveugle et comment la mise en aveugle a été obtenue, ce sont 20a et 20b. Le résultat par groupe avec taille d’effet et précision, ainsi que les effets absolus et relatifs pour les critères binaires, c’est l’élément 26. Cela change la forme d’une conversation, parce que « je ne peux pas retirer ça » ne porte pas de la même façon quand une citation y est attachée. Pour la discipline générale qui consiste à séparer l’expression de l’état scientifique, dans CONSORT, STROBE et PRISMA ensemble, voyez Méthodes et résultats : ce que vous pouvez reformuler et ce qui doit rester exact.

Vôtre, et généralement sous-exploité. L’élément 6 demande `Importance of the research question` (Importance de la question de recherche) et `Why a new trial is needed in the context of available evidence` (Pourquoi un nouvel essai est nécessaire au regard des données disponibles), avec des sous-éléments sur la façon dont l’intervention pourrait fonctionner et sur le choix de ce comparateur. L’élément 29 demande comment vos résultats se rattachent aux données existantes. Ce sont des arguments, et les arguments varient en forme parce que la pensée qu’ils contiennent varie. Si votre introduction pouvait être échangée avec celle de n’importe quel autre essai de votre domaine, c’est l’habitude plutôt que la recommandation, et c’est le seul endroit du rapport où la variation ne vous coûte rien.

La liste elle-même ne prétend pas non plus couvrir tous les plans d’étude. Sa page des extensions énumère vingt-deux extensions CONSORT bâties sur la liste de 2010 et une bâtie sur celle de 2025, et dit dans ses propres termes que la liste `is by no means exhaustive` (n’est en aucun cas exhaustive). En grappes, croisé, en escalier, pilote, pragmatique, de non-infériorité, effets indésirables, critères rapportés par les patients, chacune avec ses éléments supplémentaires. Si votre essai en fait partie, la fraction spécifiée de votre article est plus grande, pas plus petite.

Si les Méthodes ou le résumé sont revenus surlignés

  1. Regardez où se trouve le surlignage avant de regarder le chiffre. Une section Méthodes qui arrive en un seul bloc continu a une explication mécanique qu’il vaut la peine de comprendre d’abord : Turnitin a signalé toute ma section méthodologie.
  2. Comptez la prose analysée, pas les pages. Retirez le diagramme de flux, les tableaux et la liste des références, puis voyez combien de prose continue il reste. C’est ce chiffre, et non le nombre de pages, auquel s’applique le comportement du tout ou rien.
  3. Marquez le contenu de la liste de contrôle avant de toucher à la moindre formulation. Ouvrez la liste détaillée à côté de votre manuscrit et marquez chaque phrase qui existe parce qu’un élément l’a exigée. Décidez cela d’abord, à froid, et non pendant la réécriture.
  4. Apportez à la conversation la position du fournisseur lui-même. Sa FAQ dit que le pourcentage `should not be used as the sole basis for action or a definitive grading measure by instructors` (ne doit pas être utilisé comme seule base d’action ni comme mesure de notation définitive par les enseignants), et le paragraphe sur les faux positifs se termine en conseillant au lecteur de prendre en compte la nature du texte lorsqu’il lit le pourcentage. Ce qu’on dit à votre enseignant de faire lorsque votre pourcentage d’IA est élevé rassemble ces recommandations.
  5. Si quelqu’un vous brandit un seuil, 20 % d’IA, est-ce trop élevé ? explique pourquoi aucun chiffre publié ne fonctionne comme note de passage.
  6. Vérifiez votre déclaration séparément. Le fait de devoir déclarer une révision assistée par IA est une question d’éditeur, pas de détecteur, et Politiques de déclaration de l’IA par les éditeurs, comparées met les principales côte à côte.

Si la formulation va de toute façon changer

Réviser un rapport d’essai a un coût spécifique qui n’a guère à voir avec l’écriture. Chaque paragraphe que vous ouvrez doit ensuite être relu en regard de trois autres documents : la liste de contrôle remplie, le protocole enregistré et le plan d’analyse statistique dont l’élément 3 a dit au monde où le trouver. Ouvrez le manuscrit entier et vous vous engagez à reverifier le manuscrit entier. Une vérification manquée ici n’est pas une coquille. C’est une affirmation publiée sur ce qui est arrivé à des personnes qui ont accepté de participer à une étude.

C’est la raison de se soucier du périmètre. HumanPen est le nôtre, considérez donc les phrases suivantes comme une description de première main de la façon dont la frontière fonctionne, plutôt que comme une recommandation. Le périmètre est tracé avant que quoi que ce soit ne s’exécute : soit vous ajoutez vous-même les passages, soit vous importez un rapport de détection et laissez les passages marqués les définir. Le site formule la règle ainsi : un paragraphe est la plus petite unité que le moteur réécrit. Marquez-en la moitié et la frontière s’élargit jusqu’au bord du paragraphe, et c’est la version élargie qui vous est présentée pour approbation. Rien au-delà n’est ouvert. La facturation suit la même frontière et ne compte que les mots réellement réécrits. Ce qui revient est un document modifiable, le sens, la structure, la terminologie, les citations, la mise en page et les styles figurant parmi les éléments que la réécriture vise à préserver, et le conseil du site lui-même est de relire les documents complexes après téléchargement. Lorsqu’un passage remplit les conditions et reste malgré tout signalé, il peut être relancé gratuitement. Ne réécrire que les paragraphes signalés par un rapport Turnitin détaille la version pilotée par le rapport.

Ce que sera un score ensuite, personne ne peut le promettre à l’avance, nous y compris. Quel que soit votre choix, mettez les paragraphes de Méthodes rendus à côté du protocole et les tailles d’effet rendues à côté de la sortie de votre analyse avant de soumettre à nouveau. Un intervalle de confiance qui a perdu un chiffre est un problème plus grave qu’une phrase surlignée.

Questions fréquentes

Suivre CONSORT augmente-t-il mon score d’IA ? Rien de ce que publie le fournisseur ne le dit, et dans la lecture décrite plus haut ses trois pages de rapport ne mentionnent ni les essais, ni les protocoles, ni les recommandations de publication. Ce qu’il publie, c’est que ses faux positifs peuvent concerner un contenu sans grande variation structurelle, et CONSORT retire délibérément la variation structurelle de certaines parties d’un rapport d’essai.

Ma section Méthodes répète mon protocole enregistré. Est-ce un problème ? Pas pour la publication. C’est le protocole qui rend l’essai prospectif, l’élément 3 exige que vous disiez où il se trouve, et l’élément 10 exige que vous rapportiez tout écart par rapport à lui. Ce n’est un problème qu’au sens étroit où un second récit de votre propre document est une prose dense et uniforme, c’est-à-dire la forme la plus exposée à la mesure.

Le diagramme de flux et le tableau des caractéristiques initiales comptent-ils dans le pourcentage ? Seul le texte éligible constitué de phrases de prose est analysé, et un diagramme d’effectifs et une grille de moyennes ne sont pas des phrases de prose. Une note de mise à jour d’août 2023 dit bien que la prose longue à l’intérieur des cellules de tableau est traitée, et que les soumissions existantes doivent être renvoyées pour être retraitées : un tableau rempli de phrases complètes est donc un cas différent d’un tableau de chiffres.

Puis-je reformuler le récit du flux des participants pour faire baisser le score ? Vous pouvez déplacer des phrases, mais l’élément 22b exige des raisons exactes pour les exclusions et refuse explicitement `protocol deviation` comme formulation suffisante. Si une révision remplace une raison par une formule de synthèse, le rapport est désormais moins conforme que celui que vous avez soumis, et aucun score ne compense cela.

Mon résumé entier est surligné. Un résumé rédigé selon l’élément 1b a quatorze contenus obligatoires, une instruction de ne rien inclure qui soit absent du corps de l’article, et aucun tableau, liste ou référence pour le découper. C’est le texte éligible le plus dense du document. La recommandation du fournisseur est que le pourcentage n’est pas une base d’action unique, et son paragraphe sur les faux positifs est ce qu’il faut mettre devant la personne qui pose la question.

Cela s’applique-t-il aux articles CONSORT 2010 ou aux études observationnelles ? Les éléments cités plus haut sont ceux de CONSORT 2025, publié en 2025 avec une liste de 30 éléments. Les études observationnelles suivent une recommandation entièrement différente. La démarche générale tient dans les deux cas : découvrez quelles phrases de votre texte une norme de publication a spécifiées avant de décider lesquelles changer.

CONTINUER LA LECTURE