Faut-il changer votre façon d’écrire pour ne pas être signalé ?

Parmi les conseils qu’on vous a donnés, il y en a un qui vous demande d’écrire d’une façon qui vous protège plutôt que d’une façon qui soit bonne. Ça vaut la peine de savoir lequel c’est avant de le suivre.

L'équipe HumanPen

· 11 min de lecture

La réponse courte

Plutôt non, et la raison, c’est que les deux consignes les plus courantes se contredisent. Le propre guide étudiant d’une université dit d’employer le vocabulaire et les structures de phrase qui correspondent à votre niveau académique, parce que « sudden shifts in tone, complexity, or vocabulary can trigger suspicion » (des changements brusques de ton, de complexité ou de vocabulaire peuvent éveiller les soupçons). Le fournisseur du détecteur dit que les faux positifs peuvent inclure « content without a lot of structural variation » (un contenu sans grande variation structurelle) et « text that literally repeats itself » (un texte qui se répète littéralement lui-même). Gardez votre voix stable et vous correspondez à la seconde description. Faites-la varier et vous correspondez à la première. Vous ne pouvez pas vous en sortir par l’écriture face aux deux à la fois, et le seul conseil de ces pages qui aide vraiment n’a rien à voir avec l’écriture.

Ce qu’une université dit à ses propres étudiants

L’University of Texas Rio Grande Valley publie dans sa base de connaissances un article intitulé « How to avoid false positives when using Turnitin AI detection » (Comment éviter les faux positifs lors de l’utilisation de la détection d’IA de Turnitin). Il se compose de huit points numérotés plus un résumé de deux lignes en haut, et il vaut la peine d’être précis sur ce que sont ces huit points, car un seul concerne la façon dont vous formez vos phrases.

C’est le point 3, « Maintain a Natural Writing Style » (Conservez un style d’écriture naturel). Textuellement, ses trois puces :

« Use vocabulary and sentence structures that reflect your own academic level. » (Employez le vocabulaire et les structures de phrase qui reflètent votre propre niveau académique.)
« Sudden shifts in tone, complexity, or vocabulary can trigger suspicion. » (Des changements brusques de ton, de complexité ou de vocabulaire peuvent éveiller les soupçons.)
« Consistent voice throughout your essay helps reduce false positives. » (Une voix cohérente dans tout votre essai aide à réduire les faux positifs.)

Parmi les sept autres, deux portent sur la mesure dans laquelle s’appuyer sur les outils d’IA (point 2, « Limit Use of AI Tools » (Limitez l’usage des outils d’IA) ; point 6, « Avoid Over-Editing with AI Grammar Tools » (Évitez la sur-édition avec les outils grammaticaux à IA)), un porte sur la conservation de vos brouillons (point 7), un sur le fait de passer d’abord un brouillon dans Turnitin si votre établissement l’autorise (point 8), et trois sont des conseils d’écriture académique ordinaires que vous suivriez de toute façon : écrivez avec vos propres mots, paraphrasez dans votre propre style, citez avec parcimonie et mentionnez vos sources.

Le résumé du haut, sous « To lower the risk of false positives » (Pour réduire le risque de faux positifs), ajoute :

« Use AI writing and editing tools sparingly (avoid Grammarly's Rephrase, Rewrite, and Use our best version features). » (Utilisez avec parcimonie les outils d’écriture et d’édition à IA (évitez les fonctions Rephrase, Rewrite et Use our best version de Grammarly).)

La seule consigne de la page à propos de votre prose est donc : écrivez au niveau que vous avez déjà démontré, et ne laissez rien le rehausser. C’est un conseil défensif. Que ce soit aussi un bon conseil dépend de quelque chose que la page ne dit pas.

La liste du fournisseur pointe dans l’autre direction

Turnitin publie sa propre version de l’endroit où se concentrent les faux positifs. Textuellement :

« Sometimes false positives (incorrectly flagging human-written text as AI-generated), can include content without a lot of structural variation, text that literally repeats itself, or text that has been paraphrased without developing new ideas. » (Il arrive que les faux positifs (le fait de signaler à tort un texte écrit par un humain comme généré par IA) incluent un contenu sans grande variation structurelle, un texte qui se répète littéralement lui-même, ou un texte paraphrasé sans développer d’idées nouvelles.)

La phrase juste après est celle que personne ne cite, et elle s’adresse à la personne qui vous évalue plutôt qu’à vous :

« If our indicator shows a higher amount of AI writing in such text, we advise you to take that into consideration when looking at the percentage indicated. » (Si notre indicateur montre une quantité plus élevée d’écriture par IA dans un tel texte, nous vous conseillons d’en tenir compte en regardant le pourcentage indiqué.)

Maintenant, mettez les deux documents côte à côte. « Consistent voice throughout your essay » (Une voix cohérente dans tout votre essai) et « content without a lot of structural variation » (un contenu sans grande variation structurelle) ne sont pas la même affirmation, mais elles sont assez proches pour que suivre la première puisse vous rapprocher de la seconde. Un étudiant qui maintient chaque paragraphe au même registre, avec les mêmes constructions, pour ne pas avoir l’air d’avoir reçu de l’aide, a écrit quelque chose qui correspond à la première description du fournisseur.

Deux affirmations sur le même détecteur, pointant dans des directions opposées

La façon tentante de s’en sortir est de dire que l’université parle d’un lecteur humain et le fournisseur d’une machine. Dans les propres termes de la page, ce n’est pas ce qu’elle fait. L’article s’intitule « How to avoid false positives when using Turnitin AI detection » (Comment éviter les faux positifs lors de l’utilisation de la détection d’IA de Turnitin), et la troisième puce de ce même point dit qu’une voix cohérente « helps reduce false positives » (aide à réduire les faux positifs). Les deux affirmations portent sur ce à quoi le classificateur réagit, et elles tirent dans des directions opposées.

Nous ne pouvons pas vous dire laquelle est juste, et aucune des deux pages ne le peut. Ce qui mérite d’être remarqué, c’est la différence de ce qui se trouve derrière. La liste des propriétés propices aux faux positifs est publiée par l’entreprise qui a entraîné le détecteur et constitue une déclaration sur ses propres modes d’erreur. L’entrée UTRGV se trouve dans un article de la base de connaissances informatiques d’une université qui cite ailleurs sur la page la FAQ de Turnitin, pour la question Grammarly, et ne cite rien pour celle-ci. Ce n’est pas une accusation — les directives institutionnelles servent à réduire les litiges, pas à décrire un classificateur — mais l’une des deux est le fournisseur qui décrit son propre produit, et l’autre non.

Voici notre lecture, présentée comme la nôtre et non comme celle de la page. Il y a un risque réel dans « sudden shifts in tone, complexity, or vocabulary » (les changements brusques de ton, de complexité ou de vocabulaire), et il ne suppose aucune théorie du classificateur, car un changement de registre est observable par une personne. Celui qui a lu vos trois derniers rendus s’apprête à lire celui-ci, et remarquera que le chapitre quatre ne sonne pas comme les chapitres un à trois. Cette lecture survit à la version du modèle en cours d’exécution, et l’action qu’elle implique est peu coûteuse : gardez le document cohérent de bout en bout, et si vous en modifiez une partie, relisez les coutures. Pour le modèle, une phrase modifiée peut faire bouger le chiffre ou ne rien changer du tout, et savoir laquelle des deux choses se produit est impossible de l’extérieur — ni pour vous ni pour nous. Les raisons sont exposées dans ce que mesurent les détecteurs d’IA.

L’endroit où ça mord le plus fort, c’est la section méthodes

Les sections méthodes et résultats sont formulaïques parce que les conventions l’exigent. Voix passive, ordre fixe des sous-sections, le même moule de phrase répété pour chaque mesure, répétition littérale délibérée pour que deux procédures décrites de la même façon puissent être comparées. Ce n’est pas de l’écriture faible. C’est l’écriture que la discipline demande.

Elle correspond aussi à deux des trois points de la liste de faux positifs du fournisseur à la fois, et il n’existe aucune version de « variez votre structure » qui survive au contact d’une liste de contrôle de rapport.

Ce qui vaut la peine d’être su avant de prendre une consigne d’ajouter de la variété et de l’appliquer à une section où la variété est un défaut. Si une section méthodes revient marquée, la démarche productive consiste à vérifier si le chiffre est même signalable à cette longueur, plutôt qu’à détendre la prose. Nous en avons écrit la version révision sans risque dans liste de contrôle pour une révision sans risque des méthodes et des résultats.

Une affirmation très répandue que nous ne formulons pas

Le guide d’un outil concurrent énonce la version forte, textuellement :

« This clean, formal, well-structured academic writing is smooth. Smooth reads like a machine to the model. The more disciplined and polished your prose, the more it can resemble the thing being detected. » (Cette écriture académique propre, formelle et bien structurée est lisse. Le lisse se lit comme une machine pour le modèle. Plus votre prose est disciplinée et polie, plus elle peut ressembler à la chose que l’on cherche à détecter.)

Nous la citons plutôt que de l’affirmer. Ce qui est documenté est plus étroit : trois propriétés textuelles précises sur une liste de fournisseur, plus un effet mesuré sur les rédacteurs dont l’étendue lexicale en anglais est plus réduite, que nous avons détaillé dans biais des détecteurs d’IA et anglais non natif. « La prose polie est signalée » est une affirmation plus large que ce que l’une ou l’autre de ces sources soutient, et si vous bâtissez un plan de révision là-dessus, vous finirez par écrire délibérément moins bien sans retour mesuré.

Le point de cette page qui vaut vraiment la peine d’être suivi

Le septième des huit points, textuellement :

« Save your drafts, outlines, and research notes to show your writing process. This can be useful if you need to defend your work against a false positive. » (Conservez vos brouillons, vos plans et vos notes de recherche pour montrer votre processus d’écriture. Cela peut être utile si vous devez défendre votre travail contre un faux positif.)

Et dans la note finale du même article :

« Wherever possible, always strive to be transparent and open about the tools you use for creating content, and save original versions for clarity if required. » (Dans la mesure du possible, efforcez-vous toujours d’être transparent et ouvert au sujet des outils que vous utilisez pour créer du contenu, et conservez les versions originales pour plus de clarté si nécessaire.)

Les points autour se divisent en deux. Certains sont des conseils que vous suivriez de toute façon — citez correctement, paraphrasez dans votre propre style, citez avec parcimonie. Le reste dépend d’une théorie de ce à quoi le détecteur réagit, c’est-à-dire précisément ce que personne hors de Turnitin ne peut vérifier. Le point sept n’est ni l’un ni l’autre. Il ne coûte rien, il tient quelle que soit la version du modèle en cours, et ce qu’il produit est une preuve sur vous plutôt qu’une supposition sur un classificateur. La mécanique est dans l’historique des versions comme preuve.

Il y a sous tout cela une asymétrie facile à manquer. La position du fournisseur est que l’indicateur d’IA n’est pas montré aux étudiants du tout : il est destiné aux enseignants et aux administrateurs, et ne vous parvient que si votre enseignant choisit de télécharger le rapport en PDF et de vous le transmettre. Les conseils ci-dessus vous demandent donc d’écrire de façon défensive contre un chiffre que vous n’êtes pas autorisé à regarder.

Quoi faire concrètement

  1. Ne baissez pas délibérément votre registre. Le conseil d’écrire à votre niveau concerne la cohérence, pas le plafond. Écrire délibérément moins bien vous coûte des points dans un système où les points sont réels et le score probabiliste.
  2. Gardez le document cohérent de bout en bout. C’est le risque du lecteur humain vu plus haut, pas une affirmation sur le modèle : si deux chapitres se lisent comme s’ils venaient de deux personnes, c’est observable, détecteur ou pas.
  3. Si vous révisez une partie d’un document, relisez les coutures. Le paragraphe d’avant et le paragraphe d’après chaque modification. Dix minutes, et cela attrape le décalage observable par un lecteur.
  4. Laissez les sections conventionnelles conventionnelles. Méthodes, résultats et tout ce qui est régi par une liste de contrôle de rapport doivent se lire comme la discipline l’exige, et un score élevé sur ces sections est une conversation, pas une réécriture.
  5. Sauvegardez tout, à partir de maintenant. Brouillons, plans, notes, historique de recherche. C’est le seul point ici qui fonctionne rétrospectivement.
  6. Vérifiez ce que votre outil grammatical est configuré pour faire. Turnitin distingue la correction courante d’orthographe et de grammaire des fonctions de réécriture générative, et nous avons détaillé où passe cette ligne dans Turnitin détecte-t-il Grammarly.

Ce que le ciblage fait au problème de registre

Un outil de réécriture ne supprime pas la question du registre. Il la déplace.

Réécrivez un document entier et le résultat est cohérent de bout en bout, mais différent de tout ce que vous avez soumis par ailleurs. Réécrivez trois paragraphes marqués et le document a trois paragraphes qui se lisent différemment de leurs voisins. Les deux sont des décalages. Le second est plus petit et, plus important encore, assez petit pour que vous puissiez réellement relire chaque paragraphe modifié face à ce qui l’entoure.

C’est l’argument en faveur du ciblage plutôt que d’un passage sur le fichier entier, et c’est autour de cela qu’est conçu l’outil HumanPen. Donnez-lui un rapport et les paragraphes qu’il compte toucher vous sont listés pour confirmation avant que quoi que ce soit se produise. La valeur de cette liste ne tient pas à sa brièveté. Elle vous dit exactement quelles coutures aller lire, et lire les coutures est un travail qu’aucun outil ne fait pour vous.

Deux limites tirées de nos propres pages, puisque cet article consiste à ne pas prendre les conseils pour argent comptant. Le registre est verrouillé sur académique et n’est pas un réglage que vous puissiez déplacer, ce qui l’exclut partout où la voix est le sujet — nous avons listé ces cas dans quand ne pas utiliser un humaniseur de document. Et le résultat est délibérément pas plus lisse que ce qui est entré : notre propre page de comparaison dit des réécritures qu’elles « sometimes introduce more conversational, less tidy phrasing on purpose - that is the point, not a defect » (introduisent parfois volontairement une formulation plus conversationnelle et moins soignée — c’est le but, pas un défaut).

Cette seconde limite n’est pas la même chose qu’écrire délibérément moins bien, qui est le premier point de la liste ci-dessus et une mauvaise idée. Baisser son propre registre pour paraître moins compétent vous coûte des points. Une réécriture qui revient moins soignée n’est pas vous écrivant en dessous de votre niveau ; c’est une sortie machine qui n’a pas été lustrée, et c’est encore à vous de la lire et de la corriger avant qu’elle aille où que ce soit. Si ce que vous voulez, c’est du poli, c’est le mauvais instrument dans les deux cas.

Questions fréquentes

Dois-je employer des mots plus simples pour ne pas être signalé ? Les directives citées ici disent de correspondre à votre propre niveau académique, pas de descendre en dessous. Écrire délibérément en dessous de son niveau a un coût assez certain en points et un bénéfice non mesuré face à un score probabiliste.

Une voix d’écriture cohérente aide-t-elle ou nuit-elle ? La page de l’université dit qu’elle réduit les faux positifs. La propre liste du fournisseur de propriétés propices aux faux positifs pointe dans l’autre direction, et ni nous ni l’une ou l’autre page ne pouvons trancher. Ce que nous pouvons dire, c’est qu’une voix cohérente retire un risque du côté de la personne qui vous note, ce qui ne dépend pas du tout du détecteur.

Ma section méthodes est répétitive parce qu’elle doit l’être. C’est le cas conventionnel, et elle correspond à deux points de la propre liste de faux positifs du fournisseur. Le conseil du fournisseur dans cette situation s’adresse à l’enseignant : prendre la nature du texte en considération en lisant le pourcentage.

Une écriture soignée est-elle plus susceptible d’être signalée ? Certains fournisseurs d’outils le disent directement. Ce qui est documenté est plus étroit — trois propriétés textuelles nommément désignées, plus un effet mesuré sur les rédacteurs ayant une étendue lexicale plus réduite en anglais. Traitez la version large comme une affirmation plutôt que comme un résultat.

Puis-je vérifier tout cela moi-même ? En général non. Dans la plupart des configurations, l’indicateur d’IA est visible pour les enseignants et les administrateurs plutôt que pour les étudiants, et un enseignant doit partager le rapport pour que vous le voyiez.

---

CONTINUER LA LECTURE