Détection de l’IA en arabe par Turnitin : ce qui a changé pour qui écrit en arabe

Depuis le 18 août 2026, un travail en arabe standard moderne peut revenir avec un pourcentage d’écriture par IA. Les règles sont publiées sur une page que presque personne n’a ouverte : la FAQ en arabe de Turnitin, qui est un document distinct de la version anglaise et ne dit pas les mêmes choses. Voici ce qu’elle dit, et dans laquelle de trois situations vous vous trouvez réellement.

L'équipe HumanPen

· 10 min de lecture

Qu’est-ce qui a changé pour les dépôts en arabe le 18 août 2026 ?

Un travail en arabe standard moderne peut désormais être analysé à la recherche de texte probablement généré par IA et produire un pourcentage, lorsque l’établissement dispose de la fonction sous licence et qu’un administrateur l’a activée. Ce qui n’a pas changé : le détecteur arabe est un modèle différent, doté de son propre règlement publié, et si vous rédigez vos travaux en anglais, rien n’a bougé ce jour-là pour vos dépôts.

La liste des langues elle-même est traitée ailleurs sur ce site. Quelles langues lit la détection d’IA de Turnitin donne les quatre actuelles et ce qui arrive à une langue hors de cette liste. Cette page part du principe que vous êtes déjà dans la liste et pose la question suivante : qu’est-ce que la prise en charge vous apporte réellement, et qu’est-ce qu’elle ne vous apporte pas ?

Lisez la FAQ en arabe, pas celle en anglais

La FAQ anglaise de Turnitin sur l’écriture par IA commence par délimiter son champ : `The following content and FAQs pertain to our AI writing detection capabilities for English submissions only.` Sous cette ligne figurent trois liens sortants, un pour l’espagnol, un pour le japonais et un pour l’arabe.

La version arabe porte le même numéro d’article que la page anglaise et se trouve à `guides.turnitin.com/hc/ar/articles/28477544839821`. Ce n’est pas une traduction ligne à ligne. Nous avons relu les deux le 30 août 2026 : 20 282 caractères d’arabe rendu contre 31 012 caractères d’anglais rendu. La longueur seule ne prouve rien ; les différences utiles sont dans les réponses précises ci-dessous.

La plus nette concerne les exigences relatives au fichier. La liste des exigences de la page anglaise inclut `File must be written in English`. La ligne correspondante de la page arabe ne dit pas « arabe ». Elle dit arabe standard moderne : `يجب أن يكون الملف مكتوبً باللغة العربية الفصحى الحديثة`. Le reste de la liste arabe reprend les seuils anglais : moins de 100 Mo, au moins 300 mots de prose dans un format d’écriture long, pas plus de 30 000 mots, et les mêmes quatre types de fichiers acceptés.

Deux conséquences à retenir.

Un essai bref en arabe est dans la même position qu’un essai bref en anglais. En dessous de 300 mots de prose, il n’y a aucun rapport à contester, et ce que Turnitin compte comme texte éligible est la même idée de prose longue dans les deux langues. La page arabe répète presque mot pour mot l’avertissement sur les documents courts : dans un document de seulement quelques centaines de mots, la prédiction est surtout du tout ou rien, ce que documents courts et notation tout ou rien traite en détail.

Et l’exigence nomme un registre, pas une famille de langues. Ni la FAQ arabe ni l’entrée des notes de version du 18 août n’expliquent ce qui arrive à un dépôt qui mélange arabe standard moderne et dialecte, ni à un travail dont le matériel cité est en dialecte. Ces deux pages laissent la question ouverte : elles ne peuvent donc étayer une réponse dans un sens comme dans l’autre.

Ce que couvre le modèle arabe, en chiffres

Deux pages publient une liste des modèles à partir desquels le détecteur arabe peut détecter du contenu : la FAQ arabe et l’entrée datée du 18 août 2026 sur la page des notes de version de Turnitin. Turnitin tient plus d’un journal de mises à jour, le nom de la page compte donc. En comptant les entrées datées, la liste arabe en compte 18. La FAQ anglaise publie sa propre liste, deux fois sur la même page, et chaque copie en compte 32.

Aucune des deux listes n’est un sous-ensemble de l’autre. `Qwen 3 Next` et `OpenAI o3` figurent sur la liste arabe, et la chaîne `Qwen` n’apparaît nulle part dans la FAQ anglaise. `GPT-4o` et `Nova-2-lite` figurent sur la liste anglaise, et aucune de ces chaînes n’apparaît nulle part dans la FAQ arabe. L’entrée des notes de version en donne la raison en une phrase :

Veuillez noter que notre modèle d’écriture par IA en arabe est un modèle distinct de nos modèles d’écriture par IA en anglais, en espagnol et en japonais.

Il y a une raison supplémentaire de ne pas lire ces listes comme des inventaires. Les deux copies de sa propre liste sur la page anglaise se contredisent sur deux dates. Une copie date `Claude Sonnet-4.6` de 2026-02, l’autre de 2026-05, et la page arabe est d’accord avec la seconde. Une page de fournisseur qui se contredit à deux endroits du même écran n’est pas un document sur lequel bâtir une décision. Si Turnitin détecte un modèle précis explique pourquoi ces listes bougent.

Le détecteur anglais possède en outre une capacité que les trois autres n’ont pas : la partie qui recherche un texte passé par des outils de paraphrase ou de contournement, et la FAQ arabe indique que cette capacité n’est actuellement disponible que dans le détecteur anglais. Comment les quatre détecteurs diffèrent donne les citations.

Une phrase qui figure sur la page anglaise et pas sur la page arabe

La FAQ anglaise avance une affirmation sur les biais qui est beaucoup citée, y compris par nous. Sa réponse sur les données d’entraînement dit que l’échantillon a pris en compte `statistically under-represented groups like second-language learners, English users from non-English speaking countries, students at colleges and universities with diverse enrollments`. Cette phrase apparaît deux fois sur la page anglaise, une fois sous la question sur l’entraînement et une fois sous une question portant spécifiquement sur les biais.

La FAQ arabe a elle aussi une question sur l’entraînement, et sa réponse est plus courte. Elle dit que le modèle a été entraîné sur un échantillon représentatif réparti sur une période de temps, comprenant à la fois des écrits académiques générés par IA et authentiques, de différentes zones géographiques et disciplines. La clause sur les groupes sous-représentés n’y figure pas, et il n’existe aucune question distincte sur les biais sur la page.

Nous avons compté plutôt que jugé à l’œil. Dans la FAQ arabe rendue le 30 août, `تحيز` (biais), `لغة ثانية` (langue seconde) et `الممثلة` (représentés) ont chacun renvoyé 0 résultat. Sur cette même page, les contrôles `الذكاء الاصطناعي` (intelligence artificielle) et `الإيجابيات الخاطئة` (faux positifs) ont renvoyé 124 et 3. Dans la FAQ anglaise, `second-language learners`, `under-represented` et `bias` ont renvoyé 2 chacun. Les contrôles non nuls montrent que la recherche lisait bien les deux pages.

Ce que cela veut dire et ne veut pas dire. Cela ne veut pas dire que le modèle arabe est biaisé. Cela veut dire que la déclaration anglaise sur les données d’entraînement n’apparaît pas dans la FAQ arabe que nous avons vérifiée : la citer dans un dossier en arabe reviendrait donc à citer une page portant sur un autre modèle. L’affirmation de précision, en revanche, est répétée : la page arabe énonce la même cible de moins de 1 % de faux positifs pour les documents contenant plus de 20 % d’écriture par IA, et ce que signifie un taux de faux positifs de 1 % à l’échelle d’une université s’applique sans changement.

Dans laquelle de trois situations vous vous trouvez

La version du 18 août n’atterrit pas du tout de la même manière selon la langue dans laquelle votre document est réellement rédigé.

Vous déposez en arabe standard moderne. C’est le groupe visé par cette version. Un travail qui ne produisait rien auparavant peut désormais produire un pourcentage, et la même entrée des notes de version ajoute que les travaux plus anciens ne sont pas définitivement hors de portée : `Any previously submitted assignments can be checked with our AI writing detector when they are re-submitted to Turnitin, and you have AI writing enabled for your account.` Un chapitre de thèse déposé en mars est donc vérifiable si quelqu’un le redépose maintenant.

Vous étudiez dans un établissement arabophone mais écrivez en anglais. Rien n’a changé pour vos dépôts le 18 août. Votre travail va au détecteur anglais, celui que décrit la documentation en anglais de Turnitin, y compris les conseils de lecture du rapport dans comment lire un rapport d’écriture par IA Turnitin. Si votre première langue est l’arabe et que ce que l’on évalue est écrit en anglais, ce qu’il faut lire, ce sont les données sur le comportement du détecteur avec les scripteurs non anglophones, pas la version arabe.

Vous écrivez en arabe et traduisez, ou vous rédigez dans une langue et déposez dans une autre. L’exigence concerne le fichier que vous téléversez. Si le document est en anglais, c’est le texte anglais qui est segmenté et noté, quelle que soit la langue dans laquelle vous avez pensé. Traduction automatique et scores d’IA couvre ce qui est connu et ce qui ne l’est pas.

Le cas délicat, c’est un directeur de recherche qui lit les conseils en anglais et les applique à un dépôt en arabe, ou l’inverse. Mieux vaut le nommer tôt plutôt qu’au moment où quelqu’un doit défendre un chiffre.

Avant de supposer que tout cela vous concerne

Trois conditions, toutes institutionnelles et aucune portant sur votre écriture.

La fonction doit être sous licence. L’entrée des notes de version du lancement arabe est étiquetée `Turnitin license(s): Originality add-on`, et la FAQ arabe répète la règle générale de licence : la détection de l’écriture par IA n’est disponible que pour les clients qui licencient Turnitin Originality, les clients d’iThenticate 2.0 devant la prendre en complément. Pourquoi un établissement n’affiche aucun score d’IA porte essentiellement sur ce point.

Elle doit être activée. La FAQ arabe indique qu’un établissement qui ne veut pas que ses dépôts soient traités peut se retirer en désactivant la détection de l’écriture par IA dans les paramètres du compte administrateur, et que Turnitin ne traitera les dépôts que là où la fonction est activée pour l’établissement.

Et l’activer plus tard ne remonte pas tout seul dans le temps. La page arabe dit que les dépôts précédents ne peuvent pas être traités rétroactivement et doivent être redéposés, ce qui rejoint par l’autre bout la ligne sur le redépôt dans l’entrée des notes de version.

Une chose de plus surprend les étudiants. Dans la FAQ arabe, la réponse à la question de savoir si les étudiants peuvent voir les résultats est que l’indicateur et le rapport d’écriture par IA ne leur sont pas visibles, et que l’enseignant peut télécharger le rapport en PDF et le partager. Dans un cours où la fonction est activée, il se peut donc que vous ne voyiez jamais le chiffre, sauf si quelqu’un vous le montre, et la première fois que vous en entendrez parler sera peut-être une conversation.

Si une section doit de toute façon être réécrite

Il arrive qu’un directeur de recherche ait déjà demandé la révision d’une section. Dans une thèse en arabe, cela doit encore se faire à la main ou avec un outil qui prend en charge l’arabe : le flux d’humanisation actuel de HumanPen fonctionne uniquement en anglais et ne réécrit pas la prose arabe. Les éléments à protéger restent précis, notamment les Écritures ou hadiths cités, les termes techniques translittérés, la mise en page de droite à gauche avec des citations en alphabet latin, et les entrées bibliographiques déjà approuvées par un directeur.

Pour un document en anglais, L’outil HumanPen peut restreindre le travail aux passages choisis par la personne qui écrit ou appariés depuis un rapport Turnitin ou iThenticate. Il affiche le périmètre au niveau du paragraphe avant la réécriture et laisse intact le texte hors de ce périmètre confirmé, de sorte que la vérification finale reste concentrée sur la partie modifiée. Les passages éligibles peuvent être relancés gratuitement.

Rien de tout cela ne prédit ce que dira un futur rapport. Le modèle arabe de Turnitin est en service depuis le 18 août 2026 et peut changer après la publication de cet article. La limite stable est ici plus simple : le flux d’humanisation de HumanPen s’applique aujourd’hui aux documents en anglais, pas à la prose arabe.

Questions fréquentes

La détection de l’IA en arabe est-elle activée dans mon université ? Elle l’est si l’établissement licencie Turnitin Originality, ou détient le complément iThenticate, et si un administrateur a activé l’écriture par IA. La FAQ arabe dit que les dépôts ne sont traités pour l’écriture par IA que lorsque la fonction est activée pour l’établissement. Demandez au département ou à l’équipe de bibliothèque qui administre Turnitin.

Mon travail en arabe a été déposé en mai. Peut-il encore être vérifié ? Oui, si quelqu’un le redépose. L’entrée des notes de version dit que des travaux déjà déposés peuvent être vérifiés lorsqu’ils sont redéposés avec l’écriture par IA activée, et la FAQ arabe dit la même chose de l’autre côté : les dépôts passés ne peuvent pas être traités rétroactivement sans redépôt.

Cela fonctionne-t-il avec les dialectes arabes ? L’exigence publiée dit que le fichier doit être écrit en arabe standard moderne. La FAQ arabe et l’entrée des notes de version du 18 août ne décrivent ni le texte dialectal ni le texte à registre mélangé : ces pages ne répondent donc pas à la question.

Pourquoi le chiffre paraît-il petit alors que beaucoup de texte est surligné, ou l’inverse ? Pour la même raison qu’en anglais. La page arabe dit que le pourcentage couvre le texte éligible, c’est-à-dire les phrases de prose dans une écriture longue, et que le pourcentage n’est pas nécessairement celui de l’ensemble du dépôt. Les listes et autres structures qui ne sont pas des phrases restent en dehors.

Un pourcentage inférieur à 20 % apparaîtra-t-il ? La page arabe reprend la même règle d’affichage : les scores de 1 % à 19 % reçoivent un astérisque au lieu d’un chiffre, parce que Turnitin dit que les faux positifs sont plus probables dans cette plage. Ce que signifie l’astérisque sur un score d’IA Turnitin explique comment cela se traduit dans un rapport.

Mon directeur a cité une page Turnitin qui mentionne trois langues. Vérifiez de quelle page il s’agit et quand elle a été mise à jour. Le 27 août 2026, la page du guide d’utilisation du rapport d’écriture par IA listait quatre langues dans ses exigences, tandis que la page autonome des exigences de fichier en listait encore trois. Les deux étaient en ligne en même temps. Préférez l’entrée datée des notes de version à une ligne non datée dans un guide.

Puis-je voir mon propre score d’IA en arabe ? Pas directement. La FAQ arabe dit que l’indicateur et le rapport ne sont pas visibles pour les étudiants, même si un enseignant peut télécharger le rapport en PDF et le transmettre. Si vous voulez examiner votre propre texte avant le dépôt, cela doit se faire en dehors du rapport institutionnel, ce que parcourt vérifier son travail avant de déposer.

CONTINUER LA LECTURE