Aller au contenu
Ghostchars

Espaces exotiques

NARROW NO-BREAK SPACE (U+202F)

Un espace insécable plus étroit, environ la moitié de la largeur d’un espace ordinaire, employé là où un espace pleine largeur paraîtrait trop large.

Point de code
U+202F
Supprimé par défaut
Non
Option qui le régit
Espaces -s
Peut être porteur
Non

D’où il vient

La typographie française (la recommandation moderne avant `;` `:` `?` `!` et à l’intérieur des grands nombres), le mongol, et — la raison pour laquelle on le cherche — certaines sorties de ChatGPT, où il apparaît devant la ponctuation française et parfois en anglais.

Pourquoi il compte

C’est le caractère derrière la plupart des billets « ce texte est-il écrit par une IA ? », et la réponse est plus ennuyeuse que la question. C’est aussi une vraie différence invisible : il casse la recherche et la tokenisation exactement comme U+00A0.

Avant et après

AvantBonjourU+202F: ça vaU+202F?
AprèsBonjour : ça va ?

Un espacement de ponctuation français correct. Ici, l’espace étroit est le caractère typographiquement juste.

Le caractère est affiché sous forme de pastille étiquetée, pour que vous voyiez où il se place. Dans votre texte, il ne dessine absolument rien.

Quand il est légitime

La typographie française et suisse, le groupement des chiffres (1 000 000) et le mongol. Tout cela est standard, et tout cela est correct.

Comment le supprimer

Activez l’option Convertir les espaces exotiques (`-s`) et il est remplacé par un espace ordinaire.

Est-ce un filigrane d’IA ?

Présent dans certains textes d’IA — ce n’est pas un filigrane

Voici la réponse honnête que les gens viennent chercher : oui, U+202F apparaît dans certaines sorties de ChatGPT, en particulier autour de la ponctuation française — et c’est AUSSI de la typographie française standard, antérieure de plusieurs décennies à tous les modèles de langue. Ce n’est pas un filigrane, ce n’est pas délibéré, ce n’est pas détectable par construction, et en trouver un ne vous dit rien de fiable sur l’auteur. Quiconque vous le vend comme une preuve d’écriture par IA vous vend un tirage à pile ou face.

Il apparaît bel et bien dans les sorties de modèles, comme une typographie ordinaire apprise sur les données d’entraînement. Il n’est pas délibéré, pas détectable par construction, et ne prouve rien sur un document donné.

Questions

Un espace insécable étroit prouve-t-il que ChatGPT a écrit ce texte ?

Non. Il apparaît dans certaines sorties de modèles et c’est aussi ce que produisent une typographie française correcte, LaTeX, InDesign et beaucoup de claviers. Un seul caractère ne peut pas établir qui a écrit un texte, et Ghostchars ne vous dira jamais le contraire.

Alors pourquoi apparaît-il dans les sorties de modèles ?

Parce que les données d’entraînement contiennent énormément de français et d’écrits techniques correctement composés. Le modèle reproduit la typographie qu’il a apprise, exactement comme il reproduit les tirets cadratins.

Faut-il le supprimer ?

Seulement s’il vous faut un espacement ASCII pur — pour un champ de code, un CSV, ou un système qui le prend pour un caractère bizarre. Dans une prose française, il est correct et mérite d’être gardé.

Vérifier votre propre texte

Collez n’importe quoi dans le nettoyeur pour voir tous les caractères invisibles qu’il contient, avec leur position, leur point de code et ce qui arrive à chacun. Rien n’est envoyé.

Vérifier votre propre texteTous les caractères