Qu'est-ce qu'un détecteur d'IA ?
Un détecteur d’IA estime la probabilité qu’un morceau de texte ait été écrit par un modèle de langage plutôt que par une personne. Au lieu de rechercher le sens, il recherche des empreintes statistiques : dans quelle mesure les choix de mots sont-ils prévisibles, dans quelle mesure les phrases sont-elles uniformes et dans quelle mesure la formulation correspond-elle aux modèles produits par défaut par les modèles.
Le résultat est une probabilité. Un score de 85 % ne signifie pas que 85 % du texte est écrit par l'IA ; cela signifie que le texte dans son ensemble ressemble plus à une sortie de modèle qu'à une écriture humaine. Cette distinction est importante chaque fois qu’un score est utilisé pour prendre une décision concernant une personne.
Le détecteur prend actuellement en charge uniquement le texte anglais.
Comment fonctionne la détection de l'IA
Quatre choses se produisent entre le collage et le rapport :
- Prévisibilité: le modèle mesure à quel point chaque mot est surprenant. L’écriture humaine prend des tournures étranges ; l'écriture du modèle a tendance à choisir le mot suivant le plus probable.
- Variété de phrases: les gens mélangent des lignes courtes et percutantes avec des lignes longues et sinueuses. Le texte généré garde souvent un rythme régulier et prudent.
- Correspondance de motifs: les constructions de titres (« il est important de le noter », « en conclusion ») et les arguments couverts et symétriques font monter le score.
- Notation: les signaux se combinent en une probabilité globale, une répartition et une carte de surbrillance par phrase que vous pouvez vérifier par rapport au texte.
Qu'est-ce qui affecte la précision
Aucune détection n’est parfaite et la longueur du texte est de loin le facteur le plus important. Trois choses font le plus bouger l’aiguille :
- Longueur: un passage de 300 mots donne au modèle beaucoup plus de signal qu'une réponse de deux lignes. En dessous de 150 caractères nous ne marquerons pas du tout.
- Édition: Le texte de l’IA qu’une personne a considérablement réécrit dérive vers des partitions mitigées ou humaines, ce qui est généralement la réponse honnête.
- Écriture de formules: les rapports de laboratoire, les passe-partout juridiques et la prose fortement modélisée peuvent être lus comme de l'IA même lorsqu'une personne l'a écrit. C’est la principale source de faux positifs.
Lire votre rapport
Commencez par le badge de verdict et la probabilité globale, puis vérifiez la répartition : un score de 55 % construit à partir de quelques paragraphes fortement IA est une situation différente de celle d'un score de 55 % réparti uniformément dans le texte. Les surlignages des phrases constituent la couche de preuves ; lisez vous-même les phrases signalées et demandez si les drapeaux ont un sens. Copiez le rapport ou téléchargez-le au format PDF si vous devez partager ou archiver le résultat.
Conseils pour des résultats équitables
- Vérifiez au moins 300 mots lorsque vous le pouvez ; les extraits courts obtiennent des scores peu fiables dans les deux sens.
- N’agissez jamais seul sur un score. Utilisez les surlignages des phrases comme point de départ du jugement, et non comme un substitut.
- Réexécuter après les modifications. Les partitions sont un instantané du texte que vous avez collé, et non de son auteur.
Les écrits qui doivent être lus de manière plus naturelle peuvent être directement dirigés vers AI Humanizer.