Score Turnitin à 44 % alors qu’il n’y a que quelques sources : comment lire un score de similarité élevé
Votre rapport affiche 44 % de similarité, et la liste de sources en dessous est presque vide. Le pourcentage n’est pas le nombre de sources : c’est la part des mots qui correspondent. Cette page explique le calcul, pourquoi quelques sources suffisent à produire un score élevé, et pourquoi le score change selon les réglages du côté de l’enseignant.
L'équipe HumanPen
· 5 min de lecture
La réponse courte
Un score de similarité de 44 % avec seulement une poignée de sources listées n’est ni une contradiction ni un bug du système. Le pourcentage compte des mots, pas des sources : c’est la part des mots de votre texte qui correspondent à des textes de la base de données Turnitin. Une seule source longue — un article sur lequel vous vous êtes appuyé, votre propre travail déjà rendu, même un passage correctement cité — peut à elle seule représenter une grande part des mots.
Le score dépend aussi des réglages. Les enseignants peuvent exclure les citations, la bibliographie et les travaux déjà rendus, et ces réglages changent le chiffre pour un même document. Un score élevé avec peu de sources veut donc dire ceci : lisez la répartition des correspondances, pas le pourcentage affiché en gros.
Ce que vous avez sous les yeux
La page du rapport affiche deux choses côte à côte : un pourcentage en haut, et en dessous la liste des sources correspondantes. Un chiffre élevé avec une liste courte a quelque chose de suspect — « 44 %, mais seulement 7 % de correspondance » — parce qu’on a le sentiment que les deux chiffres devraient évoluer ensemble.
Ce n’est pas le cas. Le pourcentage et la liste de sources sont deux mesures différentes. Le pourcentage est un chiffre unique calculé sur l’ensemble de votre document. La liste de sources, elle, décompose l’origine des mots correspondants — et une seule source peut fournir énormément de mots.
Toute la confusion tient dans cette forme : un chiffre d’ensemble qui compte des mots, une liste qui compte des sources, et aucune règle qui relie les deux.
Ce que mesure réellement le pourcentage
Le guide de l’étudiant publié par Turnitin définit ce chiffre avec précision. Le score de similarité est le pourcentage de texte correspondant que contient votre travail, autrement dit la similarité globale. Il se calcule en divisant le nombre total de mots du travail par la quantité de mots correspondant à des sources de la base de données.
Deux conséquences découlent de cette définition.
Un : le pourcentage n’a rien à voir avec le nombre de sources listées. C’est une fraction unique des mots de votre document. Un document dont 44 % des mots correspondent — même à une seule source — affiche 44 %.
Deux : la base de données est vaste et variée. Le guide de Turnitin la décrit comme du contenu actuel et archivé provenant d’Internet, des milliers de périodiques, revues et publications, ainsi que des travaux déjà soumis à Turnitin. Une correspondance avec n’importe lequel de ces éléments compte les mêmes mots, que la source soit un long article ou vingt pages courtes.
Pourquoi quelques sources peuvent quand même donner un score élevé
Concrètement, voici comment une liste de sources courte produit un pourcentage élevé :
Une source longue. Si une part importante de votre texte paraphrase ou cite un seul article, cette source unique représente une grande part des mots correspondants. La liste de sources est courte ; le pourcentage ne l’est pas.
Votre propre brouillon antérieur. Parmi les scénarios officiels de Turnitin figure l’étudiant qui soumet plusieurs versions du même travail — avec pour résultat que la version finale peut atteindre 100 % face aux versions précédentes. Une seule source (vous-même) et le pourcentage maximal.
Du texte correctement cité et référencé. Le guide de l’étudiant indique qu’il est probable que votre travail corresponde à une partie de la base de données, et que les citations et références utilisées correctement seront tout de même signalées comme correspondances. Les passages cités sont de vraies correspondances ; le pourcentage les compte comme les autres.
Des répétitions à l’intérieur du document. Si votre propre texte répète plusieurs fois une expression ou une définition, et que cette expression figure une seule fois dans la base de données, chaque répétition peut compter comme du texte correspondant.
Le fil conducteur : le pourcentage est une part de mots, et ces mots peuvent s’accumuler sur une ou deux sources.
Le score dépend des réglages
Un même document peut donner des pourcentages différents selon la façon dont l’enseignant a configuré le rapport. C’est ce que décrivent les propres scénarios de Turnitin.
Les enseignants peuvent choisir d’exclure les citations du Similarity Report afin de faire baisser les scores de similarité lorsque cela s’applique — et l’un des exemples officiels est le travail d’un étudiant contenant de nombreuses citations et une bibliographie fournie : son score reste élevé jusqu’à ce que les citations et la bibliographie soient exclues du rapport.
Le pourcentage que vous voyez est donc fonction du document et des réglages du rapport : citations exclues ou non, bibliographie exclue ou non, travaux antérieurs exclus ou non. Ce sont les réglages côté enseignant qui changent le chiffre ; le document, lui, n’a pas changé.
Cela compte quand vous comparez des scores entre camarades de promotion ou entre deux versions : vous comparez peut-être deux rapports différents portant sur des documents similaires.
Comment lire votre propre rapport
Arrêtez de lire le pourcentage en gros : lisez la répartition des correspondances.
Premièrement, ouvrez la liste des sources et regardez les correspondances surlignées — pas leur nombre, mais le texte. De quoi s’agit-il ? Un long passage cité d’une source que vous avez référencée ? Une définition que vous avez répétée ? Un paragraphe de votre ancien brouillon ? Chacun de ces cas a un sens différent, et le pourcentage seul ne permet pas de les distinguer.
Deuxièmement, renseignez-vous sur les réglages. Le rapport a-t-il été généré en excluant les citations ? La bibliographie ? Les travaux antérieurs ? La réponse change le sens de ce chiffre pour votre document en particulier. C’est l’enseignant qui maîtrise ces réglages ; lui poser la question est le moyen le plus rapide de savoir ce que le pourcentage compte réellement.
Troisièmement, remettez le chiffre en perspective avec la position officielle : il n’existe pas de score acceptable fixe. Le guide de l’étudiant de Turnitin indique que chaque établissement, chaque enseignant ou chaque devoir peut considérer comme acceptable une quantité différente de texte correspondant, et conseille de consulter le plan de cours, les consignes du devoir ou l’enseignant pour connaître l’attente.
Un score élevé avec peu de sources est une question, pas un verdict — et la réponse se trouve dans le texte surligné et dans les réglages, pas dans le pourcentage.
L’essentiel
44 % avec une liste de sources courte n’est pas une contradiction. Le pourcentage de similarité compte les mots correspondants — une part de l’ensemble de vos mots — tandis que la liste de sources compte des sources ; or une source longue, vos brouillons antérieurs ou un texte correctement cité peuvent fournir une grande part de ces mots. Le score dépend aussi des réglages : les enseignants peuvent exclure les citations, la bibliographie et les travaux antérieurs, ce qui change le chiffre pour un même document. Lisez les correspondances surlignées et renseignez-vous sur les réglages : c’est là que se trouve le sens d’un score élevé.
CONTINUER LA LECTURE
Similarité à 2 %, score d’IA à 21 % : comment lire cette combinaison
5 min de lecture
Rapports de détectionTurnitin m'accuse d'avoir plagié mon propre article — ce que ce rapport signifie réellement
6 min de lecture
Rapports de détectionLe score de similarité Turnitin est gris : que faire quand aucun chiffre n’apparaît
5 min de lecture