Un score d’IA Copyleaks est une estimation de probabilité qu’un texte ressemble à une écriture générée par machine — ce n’est pas une preuve de paternité. Il compare les schémas statistiques de vos mots aux schémas associés aux modèles d’IA. Le même passage peut obtenir un score différent lors de deux exécutions, car le modèle échantillonne sa sortie, et parce que le texte que vous collez peut avoir légèrement changé.
Que mesure réellement un score d’IA Copyleaks ?
Copyleaks ne vérifie pas si ChatGPT a écrit votre essai. Il n’a aucune trace de votre historique de discussion. Au lieu de cela, il mesure à quel point votre texte est prévisible selon un modèle statistique entraîné sur des écrits humains et machines.
Les signaux qu’il a tendance à pondérer :
- Perplexité — à quel point chaque mot est surprenant compte tenu des mots qui le précèdent. Une faible perplexité (choix de mots très prévisibles) penche vers l’IA.
- Burstiness — variation de la longueur et du rythme des phrases. L’écriture humaine oscille généralement entre des phrases courtes et longues ; l’écriture machine tend vers un juste milieu uniforme.
- Distribution des tokens — si les choix de mots se regroupent autour des options statistiquement les plus probables.
C’est pourquoi un paragraphe rigide et formulaïque que vous avez écrit vous-même peut obtenir un score élevé, et pourquoi un brouillon d’IA décousu et désordonné peut obtenir un score inférieur aux attentes. Le score reflète des statistiques de surface, pas l’intention.
Pour une analyse plus détaillée de ces signaux, consultez Comment fonctionne la détection d’IA : les signaux derrière le score.
Pourquoi le même texte obtient-il un score différent lors de deux exécutions ?
C’est la plainte la plus courante, et elle a des causes réelles.
| Cause | Ce qui se passe | Ce que vous pouvez faire |
|---|---|---|
| Échantillonnage du modèle | Le modèle du détecteur intègre une part d’aléatoire | Relancez avant de paniquer ; considérez un chiffre comme un échantillon |
| Dérive du texte | Vous avez collé une version légèrement modifiée | Enregistrez une copie canonique et testez uniquement celle-ci |
| Différences de formatage | Les sauts de ligne, les titres et les tableaux modifient le découpage du texte | Testez le même format que celui que vous soumettrez |
| Longueur du segment | Les passages très courts donnent moins de matière au modèle | Testez des paragraphes entiers, pas des phrases isolées |
| Sensibilité au seuil | Un léger décalage de probabilité franchit un seuil d’affichage | Regardez les surlignages au niveau des phrases, pas seulement le chiffre principal |
Rien de tout cela ne signifie que le détecteur est défectueux. Cela signifie que vous examinez une estimation probabiliste, et les estimations de probabilité fluctuent. Copyleaks n’est pas unique ici — GPTZero, Turnitin et d’autres montrent le même comportement. Notre propre comparaison du comportement de ces outils se trouve dans Précision des détecteurs d’IA : quelle est la fiabilité de GPTZero, Turnitin et d’autres ?.
Quand l’alerte est probablement erronée
Les faux positifs sont réels, et ils frappent certains groupes plus durement que d’autres.
- Rédacteurs non anglophones. Une prose soignée et grammaticalement uniforme est perçue comme peu perplexe par un modèle statistique. C’est l’un des modes de défaillance les mieux documentés dans la détection d’IA.
- Écriture académique stéréotypée. Les revues de littérature, les sections de méthodes et les rapports de laboratoire suivent des modèles. Les modèles paraissent prévisibles.
- Brouillons fortement remaniés. Si vous avez passé votre propre texte dans un outil de grammaire qui a lissé chaque phrase, vous avez supprimé exactement la variation que les détecteurs recherchent.
- Matériel cité ou paraphrasé. Une citation en bloc d’une source peut porter la signature statistique de la source, pas la vôtre.
Si l’un de ces cas décrit votre situation, le signalement est un indice sur votre style, non sur votre processus. Cette distinction compte lorsque vous parlez à un enseignant.
Un exemple concret
Voici une illustration, pas une soumission réelle.
Avant (phrase typique signalée) :
La mise en œuvre de pratiques durables est essentielle pour les organisations cherchant à maintenir leur viabilité à long terme sur des marchés concurrentiels.
Après (même idée, rythme humain) :
Les entreprises qui ignorent la durabilité finissent généralement par le payer plus tard. Celles qui ne le font pas sont généralement encore là dans dix ans.
Même affirmation. La deuxième version comporte une phrase courte, une contraction et un cadre temporel concret. Les détecteurs y réagissent. Les lecteurs aussi.
Que faire lorsque vous pensez que le signalement est erroné
Suivez ces étapes dans l’ordre. Ne passez pas directement à la réécriture.
- Conservez vos preuves. Historique des brouillons, horodatages des versions, notes, fichiers sources. Si vous l’avez écrit dans Google Docs ou Word, l’historique des versions est votre meilleur atout.
- Retestez exactement le même texte. Copiez depuis votre fichier sauvegardé, pas de mémoire. Si le score change, vous avez la preuve que l’outil est instable.
- Examinez les surlignages au niveau des phrases. La plupart des détecteurs indiquent quelles phrases ont déclenché l’alerte. Si les surlignages tombent sur des citations, des références ou un paragraphe de méthodes stéréotypé, vous avez une explication concrète.
- Vérifiez votre propre processus. Avez-vous utilisé l’IA pour le brainstorming, la structuration ou la grammaire ? Soyez honnête avec vous-même avant de discuter avec qui que ce soit.
- Parlez à votre enseignant tôt. Apportez les preuves, pas une défense. Expliquez ce que vous avez fait, montrez les brouillons et demandez ce dont ils ont besoin.
L’étape 3 est celle où la détection au niveau des phrases prouve son utilité. Un score global de document ne vous dit presque rien ; savoir quelles lignes portent le signal vous indique où chercher. Le détecteur de DeAIze fonctionne ainsi — un score pour l’ensemble du document plus un surlignage par phrase — ce qui est utile même si vous n’utilisez jamais l’humaniseur.
Si vous avez utilisé l’IA, corrigez-le correctement
La voie honnête consiste à réécrire vous-même les passages signalés, avec votre propre voix, en vous appuyant sur votre propre compréhension. Les idées, les données et les conclusions doivent être les vôtres. Ce n’est pas un détail technique ; c’est tout l’intérêt de l’exercice.
Si vous avez utilisé l’IA comme aide à la rédaction et que vous devez maintenant ramener le texte vers votre propre style, un humaniseur peut aider sur la surface — le rythme des phrases, le choix des mots, en supprimant l’uniformité révélatrice. Il ne peut pas fournir votre réflexion. L’humaniseur de DeAIze fonctionne en boucle fermée : il note le texte, ne réécrit que les phrases signalées, ne conserve une réécriture que lorsque la similarité sémantique confirme que le sens a survécu, puis note à nouveau et vous montre l’avant et l’après. Sur le paragraphe d’exemple du site, un score IA de 92 % devient 4 %. Le site rapporte une réduction moyenne de plus de 60 % (meilleur cas 71 %), et ce sont les scores prédits par le produit lui-même — pas un verdict de Copyleaks ou de tout autre détecteur tiers. Vous pouvez voir le fonctionnement sur Humanize AI Text.
Une première étape moins coûteuse : lisez à voix haute les phrases signalées. Si vous ne les diriez jamais de cette façon, réécrivez-les. La plupart des corrections de faux positifs se résument à cela.
Les limites que vous devez connaître
Aucun détecteur, y compris Copyleaks, ne publie de chiffre de précision vérifié, et tout nombre que vous voyez cité en ligne doit être traité avec suspicion. La détection est une estimation de probabilité. Ce n’est pas une preuve, et ce n’est pas en soi une preuve de mauvaise conduite.
Cela joue dans les deux sens. Un score faible ne certifie pas qu’un texte est écrit par un humain, et un score élevé ne certifie pas qu’il ne l’est pas. Les institutions qui traitent l’un ou l’autre de ces chiffres comme définitif font un mauvais usage de l’outil.
Ce que vous pouvez contrôler : vos brouillons, vos notes, votre volonté d’expliquer votre processus et la clarté de votre propre prose. Commencez par le hub du détecteur d’IA si vous voulez une vue d’ensemble avant de décider quoi faire ensuite.