Aller au contenu
Ghostchars

Rapport sur vos habitudes d'écriture

Collez un brouillon et voyez les habitudes mesurables qui font qu'un texte se lit comme un texte généré : phrases toutes de la même longueur, mots révélateurs, transitions toutes faites, densité de tirets cadratins, absence de détails concrets. Vous pouvez alors les corriger.

Ce n'est pas un détecteur

Cette page ne produit aucune probabilité qu'un texte ait été généré, parce qu'aucune mesure déterministe honnête ne le peut. Des détecteurs comme GPTZero notent la prévisibilité de chaque mot et la variation de cette prévisibilité, avec un classificateur entraîné par-dessus ; rien ici ne fait quoi que ce soit de tel. Ce que vous obtenez, c'est une liste d'habitudes et ce qu'il faut changer à chacune.

Quelques centaines de mots donnent le rapport le plus utile. Rien n'est envoyé.

Rien de mesuré pour l'instant

Collez un brouillon ci-dessus. Tout est calculé dans cet onglet ; le texte ne quitte jamais votre navigateur.

Ce qui est mesuré, et pourquoi chaque mesure

Variation de la longueur des phrases

Le signal isolé le plus fort. Les brouillons générés se regroupent autour d'une seule longueur ; l'écriture humaine, non. Le rapport donne la moyenne, l'écart-type, le coefficient de variation et un histogramme à cinq classes.

Forme des paragraphes

Des paragraphes tous de la même longueur, c'est la même habitude un cran au-dessus. Un brouillon dont chaque paragraphe fait trois phrases se lit comme un métronome.

Mots et expressions révélateurs

Soixante-quatre mots et quarante-cinq expressions surreprésentés dans la prose d'après 2023, comptés et ramenés à un millier de mots. Un « delve » isolé ne veut rien dire ; douze révélateurs pour mille mots sont une habitude.

Rythme et cadrage

Les transitions toutes faites en début de phrase, la densité de tirets cadratins, le cadrage par contraste « ce n'est pas X, c'est Y » et les listes de trois éléments. Chacun a un seuil en dessous duquel rien n'est dit.

L'absence de détails concrets

Nombres, noms propres, formes contractées et première personne. Un texte généré est générique par construction : leur absence est donc mesurable là où leur présence ne le serait pas.

Voir un rapport sur les habitudes d'écriture

Un brouillon est mesuré : mots, phrases, longueur moyenne des phrases, écart type, variation, transitions toutes faites, formules prudentes et densité de tirets, chacun avec le chiffre derrière. Des chiffres plutôt qu'une note, aucune probabilité, et aucun verdict sur qui a écrit le texte.

Regarder

Lire un rapport sur les habitudes d'écriture

30 secondes · Sous-titres inclus

Ce que ce rapport ne peut pas vous dire

  • Si un texte a été généré. Aucun nombre ici ne répond à cette question, et c'est délibéré.
  • Si un filigrane statistique est présent. SynthID-Text et les dispositifs semblables sont inscrits dans le choix des mots et ne sont pas détectables sans la clé.
  • Si un humain a retravaillé un brouillon généré, ou s'il a fait générer un plan puis écrit le texte. Les deux sont courants et aucun des deux n'est visible ici.
  • Si le texte est bon. Certaines proses excellentes sont régulières ; certaines proses détestables sont irrégulières.

Questions sur le rapport de style

Pourquoi n'y a-t-il ni pourcentage ni note ?

Parce que ce serait malhonnête. Un pourcentage laisse entendre une probabilité calibrée, et rien de ce qui est mesuré ici n'en autorise une : chaque habitude du rapport se rencontre aussi dans l'écriture humaine. Le rapport vous donne les mesures et laisse le jugement là où il doit être.

En quoi est-ce différent d'un détecteur d'IA ?

Un détecteur note la prévisibilité de chaque mot sous un modèle de langue et la variation de cette prévisibilité, puis fait tourner un classificateur par-dessus. Ceci compte des habitudes dans le texte que vous avez sous les yeux, de façon déterministe, avec le même résultat à chaque fois. Il n'a aucun modèle et n'affirme rien sur l'origine du texte.

Mon brouillon est-il envoyé quelque part ?

Non. L'analyse tourne dans votre onglet. Le site est un export statique sans backend ; il n'y a nulle part où envoyer quoi que ce soit. La mesure d'audience, si vous y avez consenti, enregistre le nombre de mots et rien d'autre. Jamais le texte.

Quelle quantité de texte lui faut-il ?

Certaines mesures exigent un minimum avant de dire quoi que ce soit : les observations sur la longueur des phrases demandent cinq phrases, la densité de vocabulaire quatre-vingts mots, et les vérifications de détails concrets cent cinquante. En dessous, les chiffres restent affichés et les observations sont simplement absentes.

Si je corrige tout ce qu'il signale, mon texte passera-t-il un détecteur ?

Presque certainement pas, et ce n'est pas le but. Les détecteurs notent la prévisibilité des mots, que ces corrections ne changent guère. Corriger ces habitudes rend le texte meilleur et plus proche de vous ; cela ne trompe pas un classificateur.

Donne-t-il la même réponse que l'outil en ligne de commande ?

Oui, au chiffre près. Cette page est un portage de style_report.py, et les deux sont vérifiés contre les mêmes fixtures en intégration continue : mêmes mesures, mêmes seuils, même formulation dans chaque observation.

Statistiques anonymes ?

Ghostchars traite votre texte dans le navigateur et ne l'envoie jamais nulle part. Nous aimerions comptabiliser les pages vues avec un service de mesure auto-hébergé et sobre en cookies. Jamais le moindre contenu.