Pourquoi Turnitin a-t-il signalé ma bibliographie ?

Deux rapports différents, deux choses différentes mesurées, et un seul des deux peut mettre de la couleur dans une bibliographie. Voici comment savoir lequel vous avez entre les mains, pourquoi une phrase contenant une citation peut tout de même être signalée, et là où Turnitin dit que se concentrent ses propres faux positifs.

L'équipe HumanPen

· 8 min de lecture

D’abord, déterminez quel rapport vous avez sous les yeux

Turnitin exclut les bibliographies lorsqu’il traite l’AI Writing Report, et les surlignages de l’écriture par IA n’apparaissent jamais dans le Similarity Report. Une bibliographie surlignée est donc une correspondance de similarité, pas un signalement d’IA, et ce n’est pas votre bibliographie qui a fait monter votre pourcentage d’IA.

Cette seule distinction règle la plupart de ces questions avant même que vous n’ayez à réfléchir à autre chose. Une seule soumission donne naissance, chez Turnitin, à deux produits distincts, et ils ne mesurent pas la même propriété. Le Similarity Report repère, dans votre texte, des passages qui coïncident avec un texte ailleurs. L’AI Writing Report estime la part de votre prose qui a été générée par une IA. La documentation de Turnitin les décrit comme indépendants l’un de l’autre et indique que les surlignages de l’écriture par IA n’apparaissent pas dans le Similarity Report. Aucun des deux chiffres n’alimente l’autre.

Il y a une raison très pratique à ce que l’on finisse par ne plus savoir lequel on a devant soi. Seuls les enseignants et les administrateurs peuvent voir les indicateurs d’écriture par IA, pas les étudiants. Un enseignant peut télécharger un PDF du rapport d’IA et le partager : ce qui parvient donc le plus souvent à un étudiant, c’est ce PDF, ou une capture d’écran transférée sur laquelle rien n’indique de quel rapport elle provient.

Demandez d’abord quel rapport c’était. Toutes les branches ci-dessous dépendent de la réponse.

Pour un parcours plus détaillé de leurs différences, voyez AI Writing Report et Similarity Report comparés.

S’il s’agissait du Similarity Report, des références qui correspondent sont le cas ordinaire

Une entrée de bibliographie est la chaîne de caractères la plus reproductible de l’écriture académique. Le nom de l’auteur, le titre, la revue, le volume, l’année et la ponctuation entre les deux sont fixés par le guide de style, si bien que deux travaux citant la même source produisent la même ligne, caractère pour caractère. C’est précisément à cela que sert un style de citation.

Une bibliographie qui s’illumine dans un Similarity Report n’est généralement que ce mécanisme à l’œuvre : vos références sont mises en forme selon le guide de style, et d’autres personnes citent le même travail. Ce qui mérite attention, c’est l’endroit où se trouve le reste de la couleur. Du texte concordant à l’intérieur de vos propres paragraphes, c’est une autre affaire, et c’est celle qui demande une réponse. Les correspondances prises en compte dans le chiffre qu’on vous a montré dépendent des filtres actifs sur ce rapport, ce que couvre la comparaison des deux rapports.

S’il s’agissait de l’AI Writing Report, votre bibliographie n’a pas été comptée

Une note de mise à jour datée du 9 août 2023 sur la page de Turnitin consacrée au modèle de détection de l’écriture par IA indique que les bibliographies sont désormais exclues lors du traitement du rapport d’écriture par IA. Ce n’est pas un filtre que quelqu’un a oublié d’activer. Cela fait partie de la façon dont le rapport est produit.

Le modèle n’examine d’ailleurs que ce que Turnitin appelle le texte admissible, c’est-à-dire une prose longue faite de phrases grammaticalement standard. Les structures courtes qui ne sont pas des phrases, comme les listes et les puces, sortent de l’analyse, et une entrée de bibliographie n’est une phrase dans aucun des deux sens. Deux conséquences prennent les gens de court : le pourcentage est une part de la prose admissible et non du document entier, et la quantité de surlignage que vous voyez ne correspondra pas au chiffre qu’on vous a donné. Ces deux points sont détaillés dans comment lire un rapport d’écriture par IA de Turnitin.

Si votre pourcentage d’IA est revenu plus haut que vous ne l’attendiez, il vient de votre texte. Il ne vient pas de la liste de références.

Mais alors, pourquoi la phrase qui contient ma citation est-elle surlignée ?

Parce que ce qui est noté, ce n’est pas la citation.

Turnitin décrit le mécanisme ainsi : la soumission est découpée en segments qui se chevauchent, chaque segment reçoit une note entre 0 et 1, chaque phrase hérite par regroupement de la note des segments dans lesquels elle se trouve, et le tout est agrégé en un chiffre à l’échelle du document (questions fréquentes sur la détection de l’écriture par IA). Nulle part dans cette description il n’existe une étape qui reconnaisse une référence, une citation ou une source.

Une phrase qui contient par hasard (Smith, 2019) est notée comme de la prose, exactement comme l’a été la phrase qui la précédait. Ce qui a été signalé, c’est la phrase. La citation qu’elle contient est accessoire.

Cela écarte toute une famille de tentatives de correction. Changer de style de citation, déplacer une référence entre parenthèses vers une note de bas de page ou reformuler l’attribution ne touche à rien de ce à quoi le modèle a réagi.

L’explication la plus répandue est précisément celle que Turnitin dément

Dans presque tous les fils de discussion sur le sujet, quelqu’un explique que les détecteurs d’IA mesurent la burstiness et la perplexité, et que la prose académique obtient de mauvais scores sur les deux parce qu’elle est dense et régulière. C’est une explication satisfaisante. Ce n’est pourtant pas ce que Turnitin dit avoir construit.

La même foire aux questions l’aborde directement : le modèle repose sur des transformeurs et n’est pas explicitement programmé pour évaluer des signaux précis comme la burstiness ou la perplexité, et Turnitin ajoute qu’une prédiction individuelle n’est pas toujours explicable trait par trait.

Voilà qui vaut la peine d’être su avant de suivre un conseil bâti sur l’autre modèle. Faire varier volontairement la longueur de ses phrases pour que le texte paraisse moins régulier, c’est une théorie sur un système dont le fournisseur affirme qu’il n’est pas conçu ainsi. D’où vient l’histoire de la burstiness et ce qui l’a remplacée, nous le détaillons dans ce que mesurent les détecteurs d’IA au-delà de la perplexité et de la burstiness.

Là où Turnitin dit que se concentrent ses propres faux positifs

Il reste une dernière pièce, et elle est curieusement précise. Une note de mise à jour datée du 24 mai 2023 sur la même page du modèle indique que Turnitin a observé une incidence plus élevée de faux positifs dans les premières et dernières phrases d’un document, et précise qu’il s’agit souvent de phrases d’introduction ou de conclusion rédigées de manière générique.

Pensez maintenant à l’endroit où se trouve votre conclusion. C’est la dernière chose avant votre liste de références.

Si vous avez vu de la couleur en bas d’un rapport et que vous l’avez interprétée comme le signalement de vos références, vérifiez où le surlignage s’arrête réellement. Le paragraphe juste au-dessus de votre bibliographie est exactement l’endroit que Turnitin désigne comme son propre point faible.

Une remarque liée, si votre document est court. Turnitin indique que les prédictions sur des documents de quelques centaines de mots seulement tendent vers le tout ou rien, parce qu’il n’y a qu’un seul segment et aucun chevauchement sur lequel faire une moyenne : un contenu mixte dans un document court peut donc revenir noté comme entièrement produit par l’IA.

Ce qu’il faut vérifier, dans l’ordre

  1. Établissez de quel rapport il s’agit. Si aucun chiffre ne figure à côté de l’indicateur d’IA, mais seulement un astérisque, c’est le rapport d’IA. Turnitin n’affiche pas de pourcentage pour les scores d’IA compris entre 1 et 19, et indique que cette plage porte un taux de faux positifs plus élevé.
  2. S’il s’agit du Similarity Report, regardez les correspondances qui se trouvent en dehors de la liste de références. Ce sont celles qui veulent dire quelque chose.
  3. S’il s’agit de l’AI Writing Report, lisez la prose surlignée et cessez de traiter le pourcentage comme une proportion du document.
  4. Vérifiez si les surlignages se trouvent dans vos premières ou dernières phrases, la zone que Turnitin nomme comme son propre point chaud de faux positifs.
  5. Gardez en tête à quoi le fournisseur dit que le chiffre sert. Sur plusieurs de ses propres pages, Turnitin affirme que l’indicateur peut se tromper et ne doit pas être le seul fondement d’une mesure à l’encontre d’un étudiant. C’est une phrase tout à fait raisonnable à apporter dans une conversation avec un directeur de recherche.

Si la conversation a déjà commencé et que vous avez écrit le travail vous-même, signalé, alors que vous l’avez écrit vous-même détaille les preuves qu’il vaut la peine de rassembler.

Si vous décidez de réécrire quelque chose

Un avertissement avant de coller quoi que ce soit dans un outil de réécriture. Si l’outil réécrit tout le fichier, votre liste de références se trouve dans son périmètre par défaut, et ce genre de dégât a déjà été constaté.

Tadhg Blommerde, enseignant à l’université de Northumbria, qui teste ces outils avec un accès Turnitin côté enseignant et affirme ne recevoir aucun parrainage et n’utiliser aucun lien d’affiliation, a construit une dissertation test avec des citations dans le texte et une liste de références en APA, puis l’a fait passer dans Walter Writes. Dans cette évaluation de février 2025, il rapporte que l’outil « even humanized the reference list » (l’outil a même humanisé la liste de références), et relève séparément une citation dans le résultat qui ne figurait pas dans le texte fourni (vidéo de l’évaluation). Une citation inventée est un problème plus grave que le score que vous cherchiez à corriger.

L’outil HumanPen est construit autour de cette contrainte. Les entrées de bibliographie, les marqueurs de citation dans le texte, les notes de bas de page, les légendes, la numérotation des figures, les cellules de tableau et les champs de renvoi sont protégés et ne sont pas réécrits. Le périmètre est quelque chose que vous définissez, et non quelque chose que l’outil suppose : sélectionnez vous-même les passages, ou importez l’AI Writing Report et laissez ses surlignages les délimiter, et les paragraphes concernés vous sont montrés avant que quoi que ce soit ne s’exécute. Un fichier DOCX ou PPTX revient sous la forme du même fichier modifiable. Rien n’est artificiellement abaissé en y insérant des fautes de grammaire ou d’orthographe. Les résultats qui remplissent les conditions peuvent continuer à faire baisser la détection d’IA gratuitement.

Rien de tout cela n’est une affirmation sur ce que dira votre prochain rapport. C’est la description de ce qui est touché et de ce qui ne l’est pas.

Questions fréquentes

Ma bibliographie fait-elle monter mon score d’IA Turnitin ? Non. Les notes de mise à jour de Turnitin indiquent que les bibliographies sont exclues lors du traitement de l’AI Writing Report, et l’analyse couvre la prose admissible en phrases grammaticalement standard, ce que les entrées de bibliographie ne sont pas. Un pourcentage d’IA élevé provient de votre texte.

Dois-je supprimer mes références avant de rendre le travail pour éviter qu’elles ne soient signalées ? Non. Cela ne change pas ce que le rapport d’IA analyse, puisque les bibliographies sont de toute façon exclues de ce traitement, et cela revient à rendre un travail incomplet pour régler un problème que vous n’avez pas. Si vous voulez savoir à quoi le rapport a réagi, regardez quels paragraphes de prose sont surlignés.

Pourquoi mon score de similarité est-il élevé alors que mon score d’IA n’est qu’un astérisque ? Ce sont des mesures indépendantes de choses différentes. Turnitin affiche un astérisque au lieu d’un chiffre pour les scores d’IA compris entre 1 et 19, et l’attribue à un taux de faux positifs plus élevé dans cette plage. Une similarité élevée avec un astérisque à côté de l’indicateur d’IA signifie généralement beaucoup de texte concordant, souvent y compris la bibliographie, et très peu de prose que le modèle a notée comme étant de l’IA.

Puis-je voir moi-même l’AI Writing Report ? Pas directement. Turnitin indique que les indicateurs d’écriture par IA ne sont visibles que pour les enseignants et les administrateurs. Un enseignant peut télécharger un PDF du rapport et le partager, ce qu’il vaut la peine de demander avant de vous mettre à raisonner à partir de la description que quelqu’un d’autre a faite de ce qui a été signalé.

CONTINUER LA LECTURE