Faux positif : ce que mesure vraiment un signalement IA
Si vous vous demandez pourquoi votre texte est détecté comme IA alors que chaque mot est de vous, commencez par ce que le détecteur a réellement vu. Il ne vous a pas regardé écrire. Il a vu un texte fini et a estimé à quel point il ressemble aux traces que laissent les modèles de langage : choix de mots prévisibles, rythme de phrases régulier, formules toutes faites.
Un signalement est donc une supposition sur le style, pas le compte rendu de ce qui s'est passé. Une écriture humaine soignée et conventionnelle correspond souvent à ces schémas, et c'est de là que viennent les faux positifs. Un détecteur d'IA gratuit qui marque chaque phrase, comme le nôtre, a au moins le mérite de montrer quelles lignes ont fait basculer le score, au lieu de vous donner un seul chiffre. Pour la mécanique, voyez comment fonctionnent les détecteurs d'IA.
Pourquoi les détecteurs d'IA signalent votre texte : six causes fréquentes
Six choses rendent un texte humain prévisible aux yeux d'un détecteur. Vous en reconnaîtrez sans doute au moins une.
1. Un registre formel et convenu
L'écrit scolaire et professionnel récompense les formulations sûres : « par ailleurs », « joue un rôle essentiel », des phrases d'introduction qui reformulent le sujet. Les modèles de langage ont appris sur d'immenses quantités de textes de ce genre, et ils piochent donc dans les mêmes formules. Écrivez dans le registre attendu, et vos phrases deviennent faciles à prévoir. Or ce qui est facile à prévoir, un détecteur le note comme de l'IA.
2. Les plans types et le plan en trois parties
La structure compte aussi. Une introduction qui se termine par l'annonce d'un plan en trois points, trois parties de longueur à peu près égale, une conclusion qui reprend la thèse : c'est aussi la forme par défaut de ChatGPT. Si la méthode qu'on vous a apprise impose cette forme, votre dissertation peut sembler fabriquée par une machine à l'échelle des paragraphes, même quand chaque phrase est de vous.
3. Les outils de correction et de reformulation qui lissent votre texte
Grammarly peut réécrire des phrases entières, et QuillBot est conçu pour les paraphraser. Quand vous acceptez une réécriture complète ou passez un paragraphe dans un outil de paraphrase, la phrase porte les choix de mots de l'outil plutôt que les vôtres. Les détecteurs y font attention : Turnitin, par exemple, indique que son modèle recherche aussi le texte IA retravaillé avec des outils de paraphrase comme QuillBot. Vos propres phrases, une fois reformulées par ces mêmes outils, peuvent prendre les mêmes traits.
Corriger l'orthographe et les virgules, c'est une chose. Les réécritures lourdes peuvent être exactement ce que le signalement pointe du doigt.
4. Écrire dans une seconde langue
C'est la cause la mieux étayée. Dans une étude de Stanford publiée en 2023 dans Patterns, sept détecteurs très utilisés ont étiqueté comme générées par IA plus de la moitié de 91 rédactions du TOEFL écrites par des non-anglophones, soit un taux moyen de faux positifs de 61,22 %. Les rédactions de collégiens américains (eighth grade) ont été classées presque parfaitement, et 89 des 91 rédactions du TOEFL ont été signalées par au moins un détecteur.
Les chercheurs ont attribué cet écart au vocabulaire. Un éventail de mots plus restreint et plus sûr rend un texte plus prévisible. Quand ils ont demandé à ChatGPT de simplifier les choix de mots dans les rédactions des élèves américains, la part moyenne étiquetée comme IA est passée de 5,19 % à 56,65 %.
5. Les textes courts
Un paragraphe ou deux donnent très peu de matière à un détecteur, et quelques phrases génériques peuvent faire basculer le résultat. Turnitin a relevé son minimum de 150 à 300 mots à la suite de ses propres tests, et notre détecteur n'attribue aucun score en dessous de 40 mots pour la même raison. Un court message sur un forum de cours ou un résumé d'article est le type de texte le plus facile à mal juger.
6. Les sujets rebattus et les formulations familières
Des millions de personnes ont écrit sur les adolescents et les réseaux sociaux, ou sur les causes de la Première Guerre mondiale. Les arguments évidents, et les façons évidentes de les formuler, sont ceux qu'un modèle a vus le plus souvent. Dans un exemple célèbre, Ars Technica a montré des détecteurs qui étiquetaient une partie de la Constitution américaine comme écrite par une IA, en grande partie parce que ce texte revient très souvent dans les données dont ces modèles apprennent.
Mon devoir est détecté comme IA mais je n'ai pas utilisé l'IA : que faire ?
Restez calme et répondez par écrit
Un signalement ressemble à un verdict, mais même les entreprises qui fabriquent les détecteurs disent que ce n'en est pas un. Turnitin explique aux enseignants que son modèle n'est pas toujours exact et ne doit pas être le seul fondement de sanctions contre un étudiant. Répondez poliment, dites clairement que vous avez écrit ce travail vous-même, et demandez à en parler. Faites court. Vos preuves parleront pour vous.
Rassemblez les preuves de votre façon d'écrire
La meilleure preuve que vous avez écrit un texte, ce sont les traces laissées pendant que vous l'écriviez. Rassemblez ce que vous avez avant tout rendez-vous.
| Preuve | Où la trouver | Ce qu'elle montre |
|---|---|---|
| Historique des versions | Google Docs le conserve automatiquement ; Word le conserve pour les fichiers enregistrés sur OneDrive ou SharePoint | Le texte qui prend forme sur des heures ou des jours, avec suppressions, fautes de frappe et réécritures |
| Brouillons et plans | Anciens fichiers, cahiers, photos de plans écrits à la main, e-mails envoyés à vous-même | L'évolution de votre argumentation avant la version finale |
| Notes et sources | PDF surlignés, emprunts à la bibliothèque, historique du navigateur, logiciel de gestion bibliographique | Les lectures derrière vos affirmations |
| Retours en cours de route | Commentaires d'un tuteur, d'un directeur de mémoire, d'un service d'aide à la rédaction ou d'un camarade | D'autres personnes ont vu le travail en cours |
Ne fabriquez rien après coup. Un « brouillon » antidaté vous nuira bien plus qu'un brouillon manquant.
Demandez quel outil a signalé le texte et quel score il a donné
Demandez quel détecteur a été utilisé, quel score il a donné et quels passages il a surlignés. Les détails comptent. Un score limite pèse moins qu'un score élevé, et Turnitin lui-même marque d'un astérisque les scores inférieurs à 20 %, car ses tests ont trouvé davantage de faux positifs dans cette zone. Si les passages surlignés sont les parties les plus convenues, comme votre introduction ou votre conclusion récapitulative, faites-le remarquer.
Pour savoir quel poids un score peut avoir, lisez notre guide sur la fiabilité des détecteurs d'IA.
Proposez d'expliquer votre travail de vive voix
Une conversation est souvent votre meilleure preuve. Proposez de dérouler votre argumentation, d'expliquer pourquoi vous avez choisi vos sources, et de dire ce que vous avez coupé et pourquoi. Quelqu'un qui a écrit un devoir peut en général en parler en détail sans notes. Si cela peut aider, proposez d'écrire un court paragraphe sur le sujet devant votre enseignant.
Connaissez le règlement de votre établissement et les voies de recours
Lisez le règlement de votre établissement sur l'intégrité académique avant le rendez-vous, en particulier les passages sur l'IA et sur les recours. Cherchez ce qui compte comme preuve, qui décide, et de combien de temps vous disposez pour contester. Si la décision vous est défavorable, demandez-la par écrit et suivez la procédure officielle. Un représentant des étudiants, un médiateur ou un conseiller pédagogique peut vous aider à vous préparer.
Ne passez pas une dissertation signalée dans un humaniseur pour la « corriger ». Modifier le texte après coup ne prouve pas que vous l'avez écrit, et cela peut aggraver votre situation. L'humaniseur LumenWrite, qui ne traite que les textes en anglais, est fait pour les brouillons où l'usage de l'IA est autorisé. Si l'on vous accuse d'avoir utilisé l'IA alors que ce n'est pas le cas, c'est votre méthode de travail qui vous disculpera.
Comment faire pour que votre texte vous ressemble davantage
Rien de tout cela ne garantit qu'un détecteur vous donnera raison, et vous ne devriez pas avoir à écrire pour une machine. Mais les habitudes qui rendent un texte moins prévisible le rendent aussi plus agréable à lire.
- Soyez précis. « Mon bus a eu quatre fois du retard en mars » en dit plus que « les transports en commun sont souvent peu fiables ». Les noms, les chiffres, les lieux et les titres sont difficiles à prévoir.
- Apportez vos propres exemples. Quelque chose vu en cours, au travail ou lors d'une conversation. Un modèle ne peut pas inventer votre expérience, et les lecteurs sentent quand elle est vraie.
- Variez la longueur des phrases. Faites suivre une longue phrase qui construit un argument d'une phrase courte. Comme celle-ci.
- Supprimez les formules toutes faites. « Joue un rôle essentiel », « un large éventail de », « nous rappelle que ». Dites plutôt la chose simplement.
- Prenez position. Un texte écrit par un modèle équilibre tout. Si un argument est plus solide, dites-le et expliquez pourquoi.
- Acceptez des paragraphes inégaux. Tous les paragraphes n'ont pas besoin de la même longueur ni d'une jolie phrase de conclusion, et vous pouvez en général supprimer celle qui répète ce que vous venez de dire.
- Gardez votre méthode visible. Écrivez dans Google Docs, ou dans Word avec le fichier enregistré sur OneDrive, pour que l'historique des versions se constitue au fil du travail.
Si vous êtes étudiant et que vous vérifiez un devoir avant de le rendre, notre page détecteur IA pour mémoire et dissertation explique ce que le score signifie pour un travail universitaire et comment lire les phrases surlignées.