Pourquoi différentes sections de mon devoir affichent-elles des pourcentages d'IA différents ? Le processus de détection de Turnitin expliqué

Vous ouvrez votre AI Writing Report : une section affiche 60 % tandis qu'une autre indique 0 %, ou bien les surbrillances couvrent une partie de la page 3 et rien sur la page 5. Le premier réflexe est de se dire que le rapport est défectueux. Ce n'est pas le cas. Turnitin évalue le document phrase par phrase, regroupe ces évaluations, et le pourcentage global est une agrégation — ce qui signifie que des sections de longueur et de densité de phrases différentes donneront naturellement des résultats différents. Cet article vous explique le mécanisme officiel, ce que signifient réellement les surbrillances, et pourquoi le pourcentage d'IA ne correspond jamais au score de similarité.

L'équipe HumanPen

· 5 min de lecture

En bref

Différentes sections d'un même travail obtiennent des scores d'IA différents parce que Turnitin évalue le document phrase par phrase, puis regroupe ces scores dans un pourcentage global. Le propre guide de Turnitin décrit le processus : les phrases sont extraites, découpées en sections chevauchantes, chaque section reçoit un score, chaque phrase hérite d'un score, et les scores des phrases sont agrégés pour former le numéro du document. Une section courte et dense et une section longue et conversationnelle n'apparaîtront pas de la même manière dans le Submission Breakdown — c'est le mécanisme qui fonctionne comme prévu, pas une erreur du rapport.

Comment le détecteur lit réellement votre travail

Le guide officiel « Using the AI Writing Report » décrit le fonctionnement de la détection :

"When a paper is submitted to Turnitin, sentences from the submission are extracted and segmented into overlapping sections for prediction analysis." (Lorsqu'un travail est soumis à Turnitin, les phrases de la soumission sont extraites et segmentées en sections chevauchantes pour l'analyse prédictive.)
"Each segment is classified by the AI detection model and given a value between 0 and 1, denoting the probability of the text being likely human or AI-generated." (Chaque segment est classé par le modèle de détection d'IA et reçoit une valeur entre 0 et 1, indiquant la probabilité que le texte soit probablement humain ou généré par IA.)

Le blog officiel de Turnitin ajoute le détail sur la granularité :

"The submission is first broken into segments of text that are roughly a few hundred words (about five to ten sentences). Those segments are then overlapped with each other to capture each sentence in context." (La soumission est d'abord découpée en segments de texte d'environ quelques centaines de mots (environ cinq à dix phrases). Ces segments se chevauchent ensuite pour saisir chaque phrase dans son contexte.)

Ainsi, le rapport que vous lisez a été construit à partir de la plus petite unité : scores au niveau des phrases, puis regroupés en vues par section, puis agrégés dans le pourcentage unique en haut.

Pourquoi les sections donnent des résultats différents

Le guide officiel continue :

"Each qualifying sentence within these segments inherits the segment's score. Since segments overlap, some sentences may have multiple scores, which are then pooled into a single score. These sentence scores are further aggregated and used to compute the overall document AI writing score." (Chaque phrase éligible dans ces segments hérite du score du segment. Comme les segments se chevauchent, certaines phrases peuvent avoir plusieurs scores, qui sont ensuite regroupés en un seul score. Ces scores de phrases sont ensuite agrégés et utilisés pour calculer le score global d'écriture par IA du document.)

Trois conséquences découlent de ce mécanisme :

  • Les sections sont évaluées selon l'apparence des phrases qu'elles contiennent — une section remplie de phrases courtes et stéréotypées obtient un score différent d'une section avec une prose longue et variée.
  • La longueur de la section compte : le Submission Breakdown shaded chaque zone de votre document selon la quantité de texte éligible qui a été signalée. Une section de 5 pages peut visiblement porter plus de texte surligné qu'une section de 1 page, même si le schéma par phrase est similaire.
  • Le regroupement par chevauchement signifie qu'une phrase située à la frontière de deux sections peut porter un score combiné — ainsi, la bordure exacte d'une surbrillance n'est pas une limite de verdict précise.

Rien de tout cela n'est une erreur du rapport. C'est l'agrégation qui fonctionne comme Turnitin le documente.

Le pourcentage d'IA et le score de similarité sont indépendants

L'une des interprétations erronées les plus courantes consiste à comparer le « score » d'IA au pourcentage de similarité comme s'il s'agissait de deux lectures de la même chose. Le guide de Turnitin énonce explicitement cette séparation :

"The percentage generated by Turnitin's AI writing detection model is different from and independent of the similarity score." (Le pourcentage généré par le modèle de détection d'écriture par IA de Turnitin est différent et indépendant du score de similarité.)
"AI writing highlights are not visible in the Similarity Report." (Les surbrillances d'écriture par IA ne sont pas visibles dans le Similarity Report.)

Une section avec 40 % de similarité et un score d'IA de 0 % n'est pas contradictoire : un chiffre compte le texte apparié, l'autre reflète le jugement phrase par phrase du modèle de détection. Différentes sections d'un document peuvent donc différer en pourcentage d'IA pour la même raison que les pourcentages d'IA et de similarité peuvent différer l'un de l'autre — ils répondent à des questions différentes.

Lire le Submission Breakdown et les surbrillances

Le guide officiel décrit la barre interactive en haut du rapport :

"The overall percentage of text likely detected as AI is detailed in the Submission Breakdown." (Le pourcentage global de texte probablement détecté comme IA est détaillé dans le Submission Breakdown.)
"The bar is interactive and allows you to select each highlight to bring the corresponding text and page of the submission into focus." (La barre est interactive et vous permet de sélectionner chaque surbrillance pour mettre au premier plan le texte et la page correspondants de la soumission.)

Deux notes pratiques lorsque vous lisez votre propre rapport :

  • La couleur des surbrillances a changé en août 2026 : Turnitin a fusionné les catégories AI-generated et AI-paraphrased en une seule couleur bleue, donc les nouveaux rapports affichent une couleur là où les anciens en affichaient deux.
  • Seule la prose éligible participe au calcul — les listes, les puces, les tableaux, la poésie, les scripts et le code ne comptent pas. Le guide officiel précise : « The model does not reliably detect AI-generated text in the form of non-prose, such as poetry, scripts, or code, nor does it detect short-form/unconventional writing such as bullet points, tables, etc. »

Ainsi, une section « vide » n'est parfois pas vide de texte — elle est vide de prose éligible. Le rapport ne vous dit rien sur les puces ou les tableaux parce qu'il ne les compte jamais.

Trois états à connaître avant de paniquer en lisant une section

Le guide de Turnitin sur les états indicateurs couvre les pourcentages qui ne se comportent pas comme un simple chiffre :

"To avoid potential incidence of false positives, no score or highlights are attributed for AI detection scores above 0% and below the 20% threshold in the report. When this occurs, it is now indicated with an asterisk (%) and no percentage is attributed." (Pour éviter l'incidence potentielle de faux positifs, aucun score ni surbrillance n'est attribué pour les scores de détection d'IA supérieurs à 0 % et inférieurs au seuil de 20 % dans le rapport. Lorsque cela se produit, c'est maintenant indiqué avec un astérisque (%) et aucun pourcentage n'est attribué.)
"0% detected as AI … our testing has found that there is a higher incidence of false positives when the percentage is between 0 and 19." (0 % détecté comme IA … nos tests ont révélé qu'il y a une incidence plus élevée de faux positifs lorsque le pourcentage est entre 0 et 19.)

Cela change la façon dont vous lisez une différence au niveau d'une section : une section qui affiche 0 % peut être un vrai zéro ou un score inférieur à 20 % que le rapport refuse d'afficher — le rapport lui-même ne peut pas vous dire lequel. C'est voulu, pas accidentel.

En résumé

Un rapport AI de Turnitin qui affiche différents pourcentages selon les sections correspond au processus de détection qui fait exactement ce que Turnitin documente : les phrases sont évaluées individuellement, les segments chevauchants regroupent les scores, et le chiffre global est une agrégation — pas un verdict uniforme sur l'ensemble de votre document. Les sections diffèrent parce que le caractère et la longueur de leurs phrases diffèrent. Le pourcentage d'IA est indépendant du score de similarité, et les surbrillances ne couvrent que la prose éligible, donc les puces, les tableaux et le code restent entièrement hors du calcul. Lorsque vous lisez votre propre rapport : considérez les surbrillances comme une piste à examiner, pas comme une étiquette fixe sur chaque paragraphe.

CONTINUER LA LECTURE