Un pair évaluateur a signalé mon article comme IA. Voici ce que dit Turnitin

Un pair évaluateur vous a dit que votre article semblait généré par IA. Que dit exactement la documentation de Turnitin sur les limites de son indicateur IA ? La FAQ est claire : le score ne doit jamais servir de seul fondement à une décision. Ce n'est qu'un point de données parmi d'autres. Certains types de texte peuvent donner lieu à des faux positifs. Seuls les instructeurs et les administrateurs y ont accès. L'objectif affiché est un taux de faux positifs inférieur à 1 % pour les documents contenant plus de 20 % de rédaction IA. Voici ce que dit la documentation.

L'équipe HumanPen

· 4 min de lecture

Le score ne constitue pas l'unique fondement

La FAQ de Turnitin est explicite sur les limites de son indicateur de rédaction IA :

"Hence, we must emphasize that the percentage on the AI writing indicator should not be used as the sole basis for action or a definitive grading measure by instructors." (Le pourcentage de l'indicateur de rédaction IA ne doit servir ni de seul fondement à une décision ni de mesure définitive pour l'évaluation, soulignent-ils.)

Cette affirmation vient de Turnitin lui-même. Le pourcentage est un signal, pas une conclusion. Si un pair évaluateur a signalé votre article sur la base d'un score Turnitin, sachez que ce score n'a jamais été conçu pour trancher seul la question. La question de savoir si les revues soumettent réellement les articles à une vérification IA est autre : les revues vérifient-elles les articles pour l'IA.

Un point de données parmi d'autres

La FAQ présente le score comme une donnée d'entrée parmi d'autres :

"It is not meant to provide definitive answers in isolation. More important than any tool is the educator who sees the score and makes decisions balancing this information with their personal knowledge of their students, their work, and institutional policy." (L'outil ne prétend pas fournir de réponses définitives à lui seul. L'éducateur qui interprète le score et prend des décisions en pondérant ces informations avec sa connaissance personnelle des étudiants, de leur travail et de la politique institutionnelle reste plus important que n'importe quel outil.)

Le score est conçu pour être interprété par un éducateur qui dispose d'un contexte que l'outil n'a pas. Il ne connaît rien de votre processus d'écriture, de votre historique de brouillons, ni de votre style. La documentation est claire : la personne qui lit le score compte plus que le score lui-même.

Un pair évaluateur qui signale votre article sur la seule base du pourcentage utilise l'outil d'une manière que la FAQ déconseille explicitement. Le score doit être mis en balance avec la connaissance personnelle que l'on a de l'étudiant et de son travail.

À quoi ressemblent les faux positifs

La FAQ décrit les caractéristiques textuelles spécifiques susceptibles de déclencher des faux positifs :

"Sometimes false positives (incorrectly flagging human-written text as AI-generated), can include content without a lot of structural variation, text that literally repeats itself, or text that has been paraphrased without developing new ideas." (Les faux positifs peuvent parfois inclure un contenu sans grande variation structurelle, un texte qui se répète littéralement, ou un texte paraphrasé sans développer de nouvelles idées.)

Si votre article a été signalé, demandez-vous s'il présente l'une de ces caractéristiques. Un texte qui manque de variation structurelle, qui répète les mêmes formulations ou qui paraphrase des sources sans ajouter d'analyse nouvelle peut être signalé même si vous avez écrit chaque mot vous-même. Ces motifs de faux positifs sont documentés, ce n'est pas une simple spéculation.

Ces caractéristiques méritent attention car elles sont courantes dans l'écriture académique. Les revues de littérature, les sections méthodologiques et les descriptions de résultats peuvent naturellement présenter une faible variation structurelle ou des formulations répétitives. Un faux positif ne signifie pas que le texte est généré par IA. Cela signifie que le texte partage des motifs que le modèle associe à une production IA. Turnitin a signalé toute ma section méthodologique traite ce cas en détail.

La cible de faux positifs

La FAQ établit un objectif précis de faux positifs :

"We strive to maximize the effectiveness of our detector while keeping our false positive rate - incorrectly identifying fully human-written text as AI-generated - under 1% for documents with over 20% of AI writing." (Nous nous efforçons de maximiser l'efficacité de notre détecteur tout en maintenant notre taux de faux positifs - identification incorrecte de texte entièrement humain comme généré par IA - en dessous de 1 % pour les documents contenant plus de 20 % de rédaction IA.)

La phrase suivante : « In other words, we might flag a human-written document as AI-written for one out of every 100 fully-human written documents. »

L'objectif est inférieur à 1 % pour les documents contenant plus de 20 % de rédaction IA. Turnitin reconnaît ainsi noir sur blanc que des faux positifs se produisent et établit un seuil de fréquence. Ce seuil est un objectif, pas une garantie. Les faux positifs font partie des paramètres de conception du système. Ce que signifie un taux de faux positifs de 1 % lorsqu'une université soumet 75 000 articles transforme cet objectif en nombre concret.

Qui peut réellement voir le score

La FAQ précise que l'accès à l'indicateur IA est restreint :

"Please note, only instructors and administrators are able to see the indicator." (Seuls les instructeurs et les administrateurs peuvent voir l'indicateur.)

Les étudiants ne voient pas le score. Les pairs évaluateurs dans de nombreux flux éditoriaux peuvent ne pas avoir accès directement à l'indicateur IA de Turnitin non plus. Si un pair évaluateur a signalé votre article comme IA, il s'est peut-être basé sur le rapport de similarité, un autre détecteur, ou sa propre évaluation de la rédaction. Il vaut la peine de clarifier quel outil a produit le signalement et qui avait accès à quel rapport. Côté revue, il s'agit généralement d'iThenticate : iThenticate détecte-t-il l'IA.

Ce que cela signifie pour vous

Pour résumer ce que dit la documentation :

  • Le pourcentage de l'indicateur de rédaction IA ne doit servir ni de seul fondement à une décision ni de mesure définitive pour l'évaluation.
  • Le score n'est pas conçu pour fournir des réponses définitives à lui seul. La connaissance que l'éducateur a de l'étudiant et la politique institutionnelle comptent davantage.
  • Les faux positifs peuvent inclure un contenu sans variation structurelle, un texte qui se répète, ou un texte paraphrasé sans développer de nouvelles idées.
  • L'objectif de faux positifs est inférieur à 1 % pour les documents contenant plus de 20 % de rédaction IA. Les faux positifs font partie intégrante du système.
  • Seuls les instructeurs et administrateurs peuvent voir l'indicateur IA. Les étudiants n'y ont pas accès.

Si un pair évaluateur a signalé votre article et que vous souhaitez traiter les passages signalés, importez le rapport et travaillez dessus. Les passages éligibles peuvent être réexécutés sans frais.

CONTINUER LA LECTURE