J'ai reformulé un texte d'IA avec une autre IA et Turnitin l'a quand même signalé

Une seconde passe par une IA est un scénario que Turnitin nomme dans sa propre documentation et contre lequel il a publié des notes de version datées. Voici sur quoi le score est réellement calculé, ce que les couleurs du rapport peuvent et ne peuvent pas vous dire maintenant que Turnitin a fusionné deux catégories en une seule, et la seule comparaison que vous pouvez faire vous-même sur vos deux fichiers.

L'équipe HumanPen

· 14 min de lecture

La réponse courte

Deux choses distinctes se produisent, et on les confond généralement en une seule. Premièrement, le pourcentage n'est pas calculé sur les mots qui ont changé : Turnitin extrait les phrases, les regroupe en segments chevauchants, attribue à chaque segment une valeur entre 0 et 1, et chaque phrase éligible hérite des scores, regroupés, des segments dans lesquels elle se trouve. Une passe qui renvoie les mêmes phrases dans le même ordre avec les mêmes coupures de paragraphes produit le même regroupement. Deuxièmement, ce scénario précis est décrit dans la propre documentation de Turnitin, qui publie des mises à jour à son sujet depuis décembre 2023.

Laquelle des deux joue dans votre cas ne se lit pas dans le pourcentage. La catégorie du rapport était autrefois une réponse partielle, et le 4 août 2026 Turnitin a fusionné les deux catégories en une seule : sur un rapport fraîchement généré, ce n'est même plus cela. Ce qui reste, c'est une comparaison que vous pouvez faire sur vos deux fichiers, sans aucun détecteur. Les deux points sont exposés ci-dessous.

Cet article part du principe que le texte était à l'origine une production d'IA et que vous avez passé un paraphraseur dessus. Si vous l'avez écrit vous-même et qu'il a quand même été signalé, la situation et la réponse sont différentes, et nous en parlons dans signalé, mais vous l'avez écrit vous-même.

À quoi le score est attaché, et ce que votre passe a déplacé

La FAQ sur les capacités de détection de Turnitin décrit le traitement en un seul paragraphe :

"When a paper is submitted to Turnitin, sentences from the submission are extracted and segmented into overlapping sections for prediction analysis. Each segment is classified by the AI detection model and given a value between 0 and 1, denoting the probability of the text being likely human or AI-generated. Each qualifying sentence within these segments inherits the segment's score. Since segments overlap, some sentences may have multiple scores, which are then pooled into a single score. These sentence scores are further aggregated and used to compute the overall document AI writing score." (Lorsqu'un devoir est soumis à Turnitin, les phrases de la soumission sont extraites et segmentées en sections chevauchantes pour l'analyse de prédiction. Chaque segment est classé par le modèle de détection d'IA et reçoit une valeur entre 0 et 1, qui désigne la probabilité que le texte soit probablement humain ou généré par IA. Chaque phrase éligible dans ces segments hérite du score du segment. Comme les segments se chevauchent, certaines phrases peuvent avoir plusieurs scores, qui sont ensuite regroupés en un score unique. Ces scores de phrase sont à leur tour agrégés et servent à calculer le score global d'écriture par IA du document.)

L'unité qui porte le score est le segment, et un segment est un groupe de phrases. C'est une affirmation sur le périmètre, pas un verdict sur une opération d'édition particulière. La substitution à l'intérieur d'une phrase est une opération parmi celles qu'une réécriture peut effectuer ; son effet sur le score d'un segment dépend de la part du segment qui bouge avec elle, et Turnitin n'a publié ni la fonction de regroupement ni l'agrégation : il n'existe donc aucune grandeur publiée sur laquelle raisonner. Cette lacune, aucun fournisseur ne peut la combler de l'extérieur, le nôtre compris.

Ce qu'on peut affirmer sans deviner est plus étroit, et reste utile. Si le fichier paraphrasé a le même nombre de phrases, le même ordre de phrases et les mêmes coupures de paragraphes, alors les phrases qui partageaient un segment auparavant en partagent toujours un maintenant. Fusionner deux phrases, en diviser une, supprimer une proposition redondante ou déplacer une affirmation vers un autre paragraphe change les phrases qui se retrouvent ensemble. Cette distinction est visible dans vos deux fichiers, ce qui est plus qu'on ne peut en dire de la plupart des affirmations faites sur ces rapports.

Les propriétés que Turnitin a réellement nommées publiquement sont du même ordre. Dans la même FAQ, il indique que les faux positifs "can include content without a lot of structural variation, text that literally repeats itself, or text that has been paraphrased without developing new ideas" (peuvent inclure un contenu sans grande variation structurelle, un texte qui se répète littéralement, ou un texte qui a été paraphrasé sans développer de nouvelles idées). Ce troisième élément est une description de ce que produit une passe de paraphrase, rédigée par le fournisseur, dans une liste de textes signalés. La phrase qui suit immédiatement va dans l'autre sens et a elle aussi sa place ici : "If our indicator shows a higher amount of AI writing in such text, we advise you to take that into consideration when looking at the percentage indicated." (Si notre indicateur montre une quantité plus élevée d'écriture par IA dans un tel texte, nous vous conseillons d'en tenir compte en regardant le pourcentage indiqué.) Les modifications manuelles qui découlent de tout cela sont décrites dans comment humaniser un texte d'IA sans outil.

Le scénario a un nom dans la documentation, et des dates

La deuxième chose ne concerne pas du tout votre fichier. Elle concerne ce que le détecteur a été conçu pour repérer. La FAQ de Turnitin le dit directement :

"Furthermore, it can also identify instances where AI-generated text may have been modified by AI paraphraser or bypasser (also called humanizers) tools to evade detection." (En outre, il peut également identifier les cas où un texte généré par IA peut avoir été modifié par des outils de paraphrase ou de contournement par IA — également appelés humaniseurs — afin d'échapper à la détection.)

La parenthèse est de Turnitin, pas de nous. Trois notes de version donnent une chronologie à cette capacité, et la plus récente a modifié ce que le rapport affiche, sans modifier ce que le modèle recherche.

Note de versionCe qu'elle ditCe que cela signifie pour une seconde passe
6 décembre 2023"AI word spinners are sometimes used to avoid identification of AI-generated text. We now detect likely AI-generated text even if it may have been paraphrased using an AI word spinner." (Les reformulateurs de mots par IA sont parfois utilisés pour éviter l'identification de textes générés par IA. Nous détectons désormais les textes probablement générés par IA même s'ils peuvent avoir été paraphrasés à l'aide d'un reformulateur de mots par IA.)L'étape de paraphrase fait partie du périmètre déclaré du modèle depuis plus de deux ans. La même note précise que les soumissions existantes doivent être renvoyées pour que le changement s'y applique.
27 août 2025"With this release, the 'AI-generated only' category in the AI writing report will now include the percentage of AI-generated text that may have been modified by an AI bypasser tool." (Avec cette version, la catégorie 'AI-generated only' du rapport d'écriture IA inclura désormais le pourcentage de texte généré par IA susceptible d'avoir été modifié par un outil de contournement par IA.)À partir de cette date, un surlignage `AI-generated only` n'exclut pas une classification comme contournement. Il n'y a jamais eu de troisième couleur distincte pour cela.
4 août 2026La note du 4 août 2026 indique que "We've updated the AI Writing Report to combine the previous two categories blue and purple into a single blue category" (nous avons mis à jour l'AI Writing Report afin de combiner les deux catégories précédentes, bleue et violette, en une seule catégorie bleue) et que "purple highlights previously used for AI-paraphrased text will no longer be shown" (les surlignages violets utilisés auparavant pour le texte paraphrasé par IA ne seront plus affichés). La même note ajoute que le modèle "will continue to detect likely AI generated content that may have been further modified by AI paraphrasers or bypassers" (continuera de détecter le contenu probablement généré par IA susceptible d'avoir été ensuite modifié par des paraphraseurs ou des contournements par IA).Le rapport a cessé de séparer les deux. La détection ne s'est pas arrêtée. Turnitin indique que le nouveau rapport concerne les fichiers soumis après cette date, et qu'une soumission plus ancienne doit repasser dans le système avant que son rapport ne soit reconstruit : un rapport que vous avez déjà entre les mains peut donc encore afficher du violet.

Turnitin indique aussi qu'il ne publiera pas la liste des outils contre lesquels il s'est entraîné : "Our AI writing detector has been trained and tested to detect leading paraphraser and bypasser tools. However, to safeguard the integrity of our solution and its effectiveness in maintaining academic honesty, we're unable to disclose the names of these tools." (Notre détecteur d'écriture par IA a été entraîné et testé pour détecter les principaux outils de paraphrase et de contournement. Toutefois, afin de préserver l'intégrité de notre solution et son efficacité dans le maintien de l'honnêteté académique, nous ne sommes pas en mesure de divulguer les noms de ces outils.) C'est pourquoi personne ne peut vous donner de réponse vérifiable à la question de savoir quel paraphraseur passe au travers, y compris ceux qui en vendent un. Cette liste n'existe pas publiquement, et le modèle évolue.

Une limite à tout cela, dans les propres mots du fournisseur. Une capacité documentée est une description de ce qu'un modèle a été entraîné à faire, pas la preuve qu'un passage précis est passé par ce scénario. La propre documentation de Turnitin indique que son modèle "may not always be accurate (it may misidentify human-written, AI-generated, and AI-paraphrased text), so it should not be used as the sole basis for adverse actions against a student" (peut ne pas toujours être exact — il peut identifier à tort du texte écrit par un humain, généré par IA et paraphrasé par IA —, et ne doit donc pas être utilisé comme seule base de mesures défavorables à l'encontre d'un étudiant), et que déterminer une faute "takes further scrutiny and human judgment in conjunction with an organization's application of its specific academic policies" (demande un examen plus approfondi et un jugement humain, conjointement avec l'application par l'établissement de ses politiques académiques propres).

La langue compte aussi ici : un article d'aide de Turnitin indique que "only our English AI detector includes AI paraphrasing and AI bypasser detection capabilities" (seul notre détecteur d'IA en anglais inclut les capacités de détection de la paraphrase par IA et du contournement par IA), et ajoute que les détecteurs espagnol et japonais ne les incluent pas.

Ce que la couleur du rapport vous dit, maintenant qu'il n'y en a plus qu'une

Jusqu'au 4 août 2026, l'AI Writing Report standard comportait deux catégories visibles. `AI-generated only` était l'une d'elles et, depuis la mise à jour d'août 2025, elle pouvait aussi contenir du texte que le modèle considère comme possiblement modifié par un contournement. L'autre était `AI-generated text that was AI-paraphrased`, affichée en violet : une inférence supplémentaire appliquée à un texte déjà jugé probablement généré par IA. Le 4 août 2026, Turnitin a intégré la seconde dans la première et indiqué que les surlignages violets ne seraient plus affichés.

Ce que vaut la couleur dépend donc du rapport que vous avez en main. Sur un rapport généré avant cette date, le violet indique que le modèle est parvenu à une classification de paraphrase en plus de celle de texte généré par IA, tandis que l'autre catégorie, après août 2025, ne dit rien dans un sens ni dans l'autre sur une étape de paraphrase. Sur un rapport généré après, il n'y a qu'une seule catégorie et aucune réponse à ce niveau-là. Ce qui n'a pas changé, c'est la détection : la même note de version indique que le modèle continuera de détecter le contenu généré par IA susceptible d'avoir été ensuite modifié par des paraphraseurs ou des contournements. Aucun des deux états ne nomme un outil, un compte, un appareil ou une invite, et les deux anciennes catégories méritent d'être lues sérieusement avant de bâtir un récit sur un vieux rapport : nous les avons décortiquées dans ce que signifient réellement les étiquettes « paraphrasé par IA » et « contournement par IA » de Turnitin.

Il y a une deuxième raison de ne pas surinterpréter un changement de catégorie entre vos deux rapports. Ces changements ne sont pas rétroactifs : Turnitin indique que celui d'août 2026 ne concerne que ce que vous envoyez ensuite, et que ce qui se trouve déjà dans le système conserve le rapport qu'il a jusqu'à un nouvel envoi. Deux rapports générés de part et d'autre d'une mise à jour ne mesurent pas la même chose, et une catégorie peut changer sans que votre texte en soit la cause. Si vous avez deux rapports et cherchez à savoir ce que votre révision a fait, la comparaison comporte plus d'éléments mobiles qu'il n'y paraît, et comparer deux rapports plutôt que deux scores est la version longue de cet argument.

La comparaison que vous pouvez faire sans détecteur

Vous ne pouvez presque certainement pas mesurer l'effet de la passe, pour deux raisons documentées qui se cumulent. Turnitin n'affiche ni chiffre ni surlignage pour les scores supérieurs à 0 % et inférieurs à 20 %, seulement un astérisque : un vrai passage de 19 % à 3 % et une absence totale de changement sont donc identiques à l'écran. Et dans la plupart des configurations, l'indicateur n'est pas à votre disposition : Turnitin indique que le rapport n'est pas visible pour les étudiants, même si les enseignants peuvent télécharger le PDF et le partager.

Ce que vous pouvez faire, c'est ouvrir côte à côte vos fichiers avant et après paraphrase et répondre à quatre questions. Aucune n'a besoin du détecteur, et répondre aux quatre prend environ cinq minutes sur un chapitre.

Quoi comparerComment le vérifierCe que cela vous apprend
Nombre de phrases par paragrapheComptez les signes de ponctuation finals dans trois ou quatre paragraphes signalés, dans les deux fichiersSi les comptes correspondent, les phrases qui partageaient un segment auparavant en partagent toujours un
Coupures de paragraphes et ordre des affirmationsLisez les deux à 50 % de zoom, en regardant la forme plutôt que les motsFusionner, diviser et réordonner change les phrases qui se retrouvent ensemble. Les remplacements à l'intérieur d'une phrase laissent cette disposition inchangée
Passages que le premier rapport n'a jamais surlignésMarquez-les dans le rapport, puis vérifiez si la passe les a malgré tout réécritsUne passe qui n'a pas de rapport sous les yeux traite de la même façon le texte signalé et celui qui ne l'est pas. Tout ce qu'elle a touché est un texte que vous devez maintenant relire
Matériel cité, chiffres et citations dans le texteRecherchez les guillemets, puis chaque citationUn paraphraseur n'a aucun moyen de savoir quelle phrase est une citation directe d'une source que vous êtes tenu de reproduire exactement
Un piège propre à ce scénario : si vous avez testé le paraphraseur sur un court extrait, le résultat ne vous apprenait pas grand-chose. Turnitin indique que, dans des documents de seulement quelques centaines de mots, "the prediction will be mostly 'all or nothing' because we're predicting on a single segment without the opportunity to overlap" (la prédiction sera le plus souvent « tout ou rien » parce que nous prédisons sur un seul segment, sans possibilité de chevauchement), et qu'en conséquence un texte mêlant contenu généré par IA et contenu original peut être signalé comme entièrement généré par IA.

La quatrième ligne est celle qui coûte des points de note plutôt que des points de pourcentage. C'est aussi celle que personne ne vérifie, parce que le fichier est revenu avec l'air d'être terminé.

Ce que la passe aveugle a fait au reste du document

Un paraphraseur lancé sur un fichier entier n'a pas de rapport, donc pas de périmètre. Il réécrit l'introduction qui vous convenait, le paragraphe de méthodologie sur lequel vous avez passé une semaine, et la phrase contenant le chiffre que votre directeur a contesté. Aucun de ces éléments n'avait été signalé. Tout cela est désormais un texte que vous n'avez pas lu sous sa forme actuelle.

C'est un travail de relecture de la taille du document, et il tombe au moment du cycle de soumission où l'on a le moins de temps. Les choses précises qui cassent sont ennuyeuses et lourdes de conséquences : une citation directe discrètement reformulée, une nuance supprimée si bien qu'une affirmation dit plus que ce que vos données appuient, un terme technique remplacé à mi-parcours par un quasi-synonyme, si bien que le même concept a désormais deux noms, un chiffre arrondi. Les listes de références, les tableaux et les équations ont leurs propres modes de défaillance, que nous avons listés dans ce qu'il advient des citations, des tableaux et des équations.

L'alternative n'est pas « ne rien faire ». Elle consiste à laisser le rapport décider du périmètre, pour que les paragraphes que vous revérifiez soient ceux sur lesquels quelque chose a réellement été dit. C'est ce que signifie concrètement ne réécrire que les paragraphes signalés par un rapport, et l'essentiel de la difficulté consiste à faire correspondre un surlignage qui commence au milieu d'une proposition au paragraphe correspondant de votre fichier source.

Que faire du rapport que vous avez déjà

Vous avez quelque chose de plus utile qu'un pourcentage : un ensemble de passages marqués. Partez de là.

  1. Conservez chaque fichier, dans l'ordre. Le brouillon original, la version paraphrasée et les deux rapports. Cette séquence est la seule chose ici qui réponde à la question de savoir comment ce texte a été écrit, et elle continue d'y répondre quoi que fasse le chiffre.
  2. Ne lancez pas une seconde passe aveugle sur l'ensemble. Elle double le travail de vérification et vous empêche de savoir quel changement a fait quoi, puisque deux séries de modifications se retrouvent mélangées dans un texte que vous ne reconnaissez plus.
  3. Relisez les quatre lignes du tableau ci-dessus avant toute chose. Les citations et les références d'abord. Ce sont des critères d'évaluation, pas des sorties de détecteur.
  4. Décidez du périmètre à partir du rapport, pas du score. Un passage que personne n'a surligné est un passage auquel aucune preuve n'est attachée.
  5. Vérifiez la règle de votre établissement avant de réécrire quoi que ce soit. Il n'existe aucun seuil publié, et ce qui compte comme une assistance acceptable se décide localement, pas par le fournisseur. Pourquoi les 20 % souvent cités ne constituent pas cette règle, c'est dans 20 % d'IA, est-ce trop ?.

Nous construisons un outil pour le quatrième point. L'outil HumanPen prend l'AI Writing Report au format PDF, fait correspondre ses passages surlignés au document que vous avez téléversé, et vous montre le périmètre avant que quoi que ce soit ne s'exécute. Le paragraphe est la plus petite unité qu'il réécrira : un surlignage couvrant la moitié d'un paragraphe est donc élargi au paragraphe entier et vous est présenté ainsi pour confirmation. Il facture les mots qu'il réécrit réellement, donc un travail limité à quatre paragraphes est facturé comme quatre paragraphes.

Ce qu'il ne fait pas, c'est vous donner un score prédit, car ce chiffre n'est disponible pour personne en dehors de Turnitin. Ce que nous pouvons dire, c'est que les passages éligibles peuvent être relancés gratuitement.

Questions fréquentes

Une troisième passe de paraphrase aiderait-elle ? Il n'existe aucune grandeur publiée qui permettrait à quiconque de répondre, et chaque passe ajoute une série de modifications à un texte qu'il faut ensuite revérifier. La propre liste de faux positifs du fournisseur nomme "text that has been paraphrased without developing new ideas" (un texte qui a été paraphrasé sans développer de nouvelles idées) comme une propriété des textes signalés, ce qui mérite d'être lu avant d'ajouter une troisième série exactement de cela.

Il y a du violet dans mon rapport. Est-ce la preuve que j'ai utilisé un outil de paraphrase ? Non, et vérifiez d'abord la date du rapport. Le violet était une classification à laquelle le modèle parvenait à partir du texte final, pas un enregistrement de la façon dont le document a été produit, et Turnitin indique que le modèle peut identifier à tort du texte écrit par un humain, généré par IA et paraphrasé par IA, et que le score ne doit pas être la seule base d'une action contre un étudiant. Depuis le 4 août 2026, cette catégorie n'est plus affichée séparément : du violet sur la page signifie donc que vous regardez un rapport généré avant cette date, ou une soumission qui n'a pas été renvoyée depuis.

J'ai paraphrasé un extrait de 300 mots pour tester, et tout l'extrait est revenu signalé. Pourquoi ? Turnitin indique que, dans des documents de seulement quelques centaines de mots, la prédiction est le plus souvent tout ou rien, parce qu'il y a un seul segment et aucune possibilité de chevauchement, et qu'en conséquence un contenu mélangé peut être signalé comme entièrement généré par IA. Un extrait court est proche du pire banc d'essai possible.

Tout cela s'applique-t-il à ma soumission en espagnol ou en japonais ? Pas la partie paraphrase. Un article d'aide de Turnitin indique que seul le détecteur anglais inclut les capacités de détection de la paraphrase par IA et du contournement par IA, et que les détecteurs espagnol et japonais ne les incluent pas.

Puis-je simplement vérifier le score entre deux passes ? En général non. Tout ce qui est au-dessus de 0 % et en dessous de 20 % s'affiche comme un astérisque, sans chiffre ni surlignage, et dans la plupart des configurations, l'indicateur et le rapport sont visibles pour les enseignants et les administrateurs, pas pour vous. C'est la raison principale pour laquelle tout ce domaine fonctionne à coups d'affirmations plutôt que de mesures, et aussi pourquoi différents détecteurs vous donnent des réponses différentes, ce que nous avons abordé dans pourquoi le même texte obtient un score différent selon le détecteur.

Sources : la FAQ sur les capacités de détection de l'écriture par IA de Turnitin, utiliser l'AI Writing Report et les notes de version du modèle de détection de l'écriture par IA. Citations vérifiées sur ces pages le 14 août 2026, et l'entrée du 4 août 2026 dans les notes de version de Turnitin vérifiée le 18 août 2026. Ceci est publié sur le blog d'une entreprise qui vend un outil de réécriture de documents, ce qu'il vaut mieux savoir en lisant la section sur ce que coûte une passe aveugle.

CONTINUER LA LECTURE