Si je réécris une phrase signalée, le score baisse-t-il de ce que valait cette phrase ?

Plusieurs explications sur la façon dont Turnitin calcule le pourcentage en matière d'IA donnent l'impression d'un simple cumul. Chacune peut être rattachée à un document, et à chaque fois, ce document dit moins que les conseils qu'on prétend en tirer.

L'équipe HumanPen

· 9 min de lecture

La réponse courte

Non. Le score associé à une phrase n'a pas été produit par cette phrase seule, donc il n'existe aucun taux de conversion entre le nombre de phrases corrigées et les points de pourcentage retirés. D'après la description publiée par Turnitin, les phrases sont extraites et regroupées en segments qui se chevauchent, chaque segment reçoit une note entre 0 et 1, et une phrase hérite de la note de tous les segments auxquels elle appartient — ce qui signifie qu'une phrase située près d'une limite porte plus d'une note, combinées entre elles. Cette description invoque trois opérations — hériter, regrouper, agréger — et n'en publie aucune, donc impossible d'en déduire la contribution d'une seule phrase. Trois modèles de ce calcul circulent, et les trois sont additifs. Chacun renvoie vers un document, et à chaque fois, le document dit moins que le modèle qu'on en tire.

Les trois sont détaillés ci-dessous, chacun à côté de son document d'origine. Le mécanisme lui-même, ainsi que les relectures manuelles qui en découlent, sont traités à part dans comment humaniser un texte généré par IA sans outil.

"Le rapport est binaire au niveau des phrases" (Le rapport est binaire au niveau de chaque phrase)

Dans le guide d'une entreprise de relecture sur la façon de réduire un score IA, récupéré le 18 août 2026 et cité exactement :

"There is no colour scale like the similarity report. The AI report is binary at the sentence level: each sentence is either flagged or not flagged. The overall percentage is simply the proportion of flagged text across the whole document." (Il n'existe pas d'échelle de couleurs comme dans le rapport de similarité. Le rapport d'IA est binaire au niveau de chaque phrase : chaque phrase est soit signalée, soit non signalée. Le pourcentage global correspond simplement à la proportion de texte signalé dans l'ensemble du document.)

En tant que description du rapport que vous avez sous les yeux, la première moitié est correcte. Une phrase est surlignée ou ne l'est pas ; il n'y a pas de dégradé dans le rendu. Ce qui est faux, c'est ce qui se cache derrière le surlignage. Voici ce que dit Turnitin lui-même :

"Each qualifying sentence within these segments inherits the segment's score. Since segments overlap, some sentences may have multiple scores, which are then pooled into a single score." (Chaque phrase admissible dans ces segments hérite du score du segment. Comme les segments se chevauchent, certaines phrases peuvent avoir plusieurs scores, qui sont ensuite regroupés en un seul score.)

Ainsi, la phrase n'a pas récolté un verdict. Elle a hérité d'une probabilité, parfois de deux, provenant de blocs de texte qui incluent ses voisins. Le surlignage est le rendu d'un seuil, pas la quantité à partir de laquelle le chiffre est construit.

La dernière partie de cette citation pose un autre problème. « The proportion of flagged text across the whole document » n'est pas ce dont Turnitin dit que le pourcentage représente la proportion. L'analyse ne couvre que ce qu'il appelle le texte éligible — des blocs rédigés sous forme de phrases grammaticalement correctes, ce qui exclut les listes et les puces — et la conséquence que Turnitin en tire est que « this percentage is not necessarily the percentage of the entire submission ». Si un tiers de votre fichier est composé de tableaux, de puces et d'une bibliographie, le dénominateur n'est pas votre document. Nous avons détaillé cela dans comment lire un rapport Turnitin sur l'écriture IA.

À quoi ressemblent les conseils qu'on en tire : comptez les phrases surlignées, divisez, calculez combien vous devez en corriger. Selon la description publiée, cette arithmétique n'a aucun référent, car le nombre de phrases surlignées et le pourcentage ne sont pas deux vues d'une même quantité.

"La moyenne de tous les scores de segment" (La moyenne de tous les scores de segment)

D'après le guide d'un fournisseur de humanizer, qui cite le centre d'aide de Turnitin comme source du mécanisme. Récupéré le 18 août 2026, cité exactement :

"The model calculates an overall prediction based on the average of all segment scores, producing the percentage displayed in the AI writing indicator." (Le modèle calcule une prédiction globale basée sur la moyenne de tous les scores de segment, produisant le pourcentage affiché dans l'indicateur de rédaction par IA.)

Celui-ci est plus proche, et l'écart est assez mince pour valoir la peine d'être précisé exactement. La phrase publiée est :

"These sentence scores are further aggregated and used to compute the overall document AI writing score." (Ces scores au niveau des phrases sont ensuite agrégés et utilisés pour calculer le score global de rédaction par IA du document.)

Les scores de phrase, pas les scores de segment. Le score de segment est une valeur intermédiaire qu'une phrase hérite, parfois deux fois ; ce qui est agrégé, c'est ce qui sort du regroupement.

Impossible de vous dire si les deux aboutissent à des chiffres différents, car Turnitin n'a publié ni la fonction de regroupement ni l'agrégation. Ce qui diffère, c'est ce sur quoi porte l'opération, et c'est là la moitié sur laquelle repose un plan de révision. Selon une moyenne sur les segments, chaque segment compte autant, quel que soit le nombre de phrases qu'il contient, et chaque phrase se trouve dans exactement l'un d'entre eux. Or, aucune de ces deux affirmations ne correspond à ce que dit la description publiée.

"Réécrivez la première et la dernière phrase de chaque paragraphe" (Réécrivez la première et la dernière phrase de chaque paragraphe)

La troisième explication fait l'impasse sur le mécanisme et arrive directement sous forme d'instruction : réécrivez la phrase d'ouverture et la phrase de clôture de chaque paragraphe, ce sont celles qui sont le plus souvent signalées.

Il y a un vrai document derrière cela. Dans une note de publication datée du 24 mai 2023, sous le titre "Improvements in detection at the start and end of documents", Turnitin a écrit :

"Since launch, we have observed a higher incidence of false positive detection in the first few or last few sentences of a document. Many times these sentences consist of introduction or conclusion content written in a generic way. As a result, we have changed our detection logic to help reduce these false positives." (Depuis le lancement, nous avons observé une incidence plus élevée de faux positifs dans les premières ou dernières phrases d'un document. Souvent, ces phrases consistent en un contenu d'introduction ou de conclusion rédigé de manière générique. Par conséquent, nous avons modifié notre logique de détection pour réduire ces faux positifs.)

Trois enseignements à en tirer, dans l'ordre de fréquence avec laquelle on les oublie.

Cela parle du début et de la fin d'un document, pas de chaque paragraphe. Le conseil a migré de deux niveaux vers le bas dans la structure.

C'est une annonce de correctif. La troisième phrase est l'annonce. Citer les deux premières comme description du comportement actuel du détecteur, c'est citer un rapport de bogue comme s'il s'agissait d'un cahier des charges.

Et la note poursuit : "We also worked on making our segment boundaries detection more precise which could lead in some rare cases to change of boundaries compared with a previous version." Les limites ont bougé. La phrase qui se retrouve dans quel segment est un détail d'implémentation versionné, pas quelque chose sur quoi planifier.

Si vous vous préparez à un entretien pour inconduite, n'emportez pas cette note de publication avec vous. La personne en face peut aussi lire la troisième phrase. Ce que vous pouvez raisonnablement dire est plus nuancé et tient mieux la route : le fournisseur a révisé le modèle en réponse à des faux positifs, ce qui n'est pas le comportement de quelque chose qu'on devrait traiter comme une preuve établie.

Ce que les trois ont en commun

Chacun, s'il était vrai, vous permettrait de calculer ce que vaut une seule phrase. C'est ce qui les rend attractifs. Un plan de révision a besoin d'une unité de progression, et aucun des documents publiés n'en fournit.

Vous ne pouvez pas non plus retrouver le nombre manquant par expérimentation, pour deux raisons documentées. Les scores au-dessus de 0 % et en dessous du seuil de 20 % ne sont pas affichés du tout — un astérisque, pas de surlignages — donc un vrai passage de 19 % à 4 % ressemble à l'identique à aucune progression. Et dans la plupart des configurations, l'indicateur n'est pas le vôtre à consulter : Turnitin précise que l'indicateur et le rapport ne sont pas visibles par les étudiants, et qu'un enseignant disposant du téléchargement PDF peut vous les partager.

Un cas se comporte presque de manière addictive, et c'est celui que vous voulez le moins. Lorsqu'une soumission se limite à quelques centaines de mots, il n'y a qu'un seul segment et aucune possibilité de chevauchement, donc d'après Turnitin lui-même, la prédiction ressort presque toujours tout ou rien — et par conséquent, un texte mélangeant du contenu généré par IA et du contenu original peut donc être signalé comme entièrement généré par IA. Ce n'est pas une commande fine. C'est un interrupteur.

Ce que cela change dans votre façon de passer la soirée

  1. Avant de suivre une règle sur les phrases à réécrire, trouvez le document dont elle vient. Les trois ci-dessus en ont un. Dans les trois cas, le document dit moins que la règle, et l'écart est visible en environ cinq minutes de lecture.
  2. Partez des surlignages que vous avez réellement. Si un rapport a marqué des passages spécifiques, ce sont ceux-là qui ont des preuves attachées. Les preuves derrière une règle sur la position sont une note de publication de 2023.
  3. Comptez les paragraphes que vous devrez revérifier, pas ceux que vous allez modifier. Chaque paragraphe que vous touchez est un paragraphe que vous relisez pour une citation rompue, une affirmation déplacée, ou un chiffre qui a bougé. Un plan qui touche tous les paragraphes d'une thèse a tranquillement créé un travail de relecture de la taille de la thèse.
  4. Gardez le fichier avec lequel vous avez commencé. L'original et les brouillons intermédiaires sont la partie de tout ceci qui a une valeur probante, et ils la conservent quoi que fasse le chiffre. La mécanique est dans l'historique des versions comme preuve.

L'outil que nous développons, et le chiffre qu'il ne peut pas vous donner

HumanPen prend le AI Writing Report sous forme de PDF et travaille à partir des passages qu'il marque. L'une de ses règles est pertinente ici : un paragraphe est la plus petite unité qu'il réécrira, donc une sélection couvrant une partie d'un paragraphe est élargie au paragraphe entier avant que le traitement se lance.

Cette règle n'est pas une affirmation sur le score. Elle est là parce qu'un surlignage peut librement commencer au milieu d'une proposition, et réécrire exactement les caractères surlignés vous donne un paragraphe écrit par deux personnes — moitié dans un registre, avec la seconde moitié qui s'appuie sur des termes introduits dans la moitié que personne n'a touchée. Turnitin n'a pas publié quelle unité une réécriture devrait couvrir pour faire bouger un score, et nous ne sommes pas en mesure de le déterminer de l'extérieur.

Ce que nous ne pouvons pas vous donner, c'est le taux de conversion, et aucun autre outil ne le peut non plus. Un outil qui vous propose un pourcentage prédit vous offre un chiffre qu'il n'a pas.

Questions fréquemment posées

Si une phrase est surlignée, la supprimer retire-t-elle sa part du score ? Pas de façon prévisible. Le surlignage reflète un score que la phrase a hérité des segments qui l'entourent, et supprimer du texte modifie les segments. Le chiffre du document est une agrégation de scores de phrases regroupés, pas une somme de phrases surlignées.

Le score baisse-t-il de la même quantité si je réécris un paragraphe entier ? Il n'y a aucun chiffre publié, ni pour un paragraphe ni pour une phrase. Ce qui est publié, c'est que les segments se chevauchent, donc ce qui arrive à un passage dépend du texte de part et d'autre.

Pourquoi les surlignages et le pourcentage ne correspondent-ils pas ? Parce que le pourcentage est calculé uniquement sur la prose éligible, et Turnitin dit qu'un document mélangeant plusieurs types d'écriture "would result in a disparity between the percentage and the highlights."

La première et la dernière phrase de chaque paragraphe sont-elles vraiment plus souvent signalées ? Le document qui a lancé cela parlait des premières et des dernières phrases d'un document, l'a dit en 2023, et dans la même note annonçait un changement de la logique de détection pour le réduire. Ce n'est pas une description actuelle du comportement et ce n'est pas utilisable comme défense.

Puis-je tester moi-même mes modifications ? Généralement non. Tout ce qui est en dessous de 20 % s'affiche comme un astérisque sans chiffre ni surlignages, et dans la plupart des configurations, l'indicateur est visible pour les enseignants et les administrateurs plutôt que pour vous.

---

CONTINUER LA LECTURE