Puntuación tipográfica
RIGHT SINGLE QUOTATION MARK (U+2019)
La comilla simple de cierre tipográfica y, en inglés, el apóstrofo correcto: don’t, it’s. En español aparece dentro de una cita anidada y en apellidos y préstamos como O’Higgins.
- Punto de código
U+2019- Categoría
- Puntuación tipográfica
- Se elimina por defecto
- No
- Opción que lo gobierna
- Puntuación
--punct - Puede cumplir una función
- No
De dónde viene
De las comillas inteligentes de cualquier procesador de texto y gestor de contenidos, del procesado “smartypants” de Markdown y de cualquier texto que haya pasado por una cadena editorial.
Por qué importa
Es un punto de código distinto del apóstrofo ASCII, así que “O’Higgins” y "O'Higgins" son cadenas diferentes. Eso rompe la búsqueda, la detección de duplicados y los diffs; y es la base de un esquema de esteganografía publicado que codifica bits alternando apóstrofos rectos y tipográficos.
Antes y después
Dos apóstrofos que ningún lector distingue y que ninguna máquina confunde.
El carácter se muestra como una etiqueta con nombre para que veas dónde está. En tu texto no dibuja absolutamente nada.
Cuándo es legítimo
En prosa compuesta con tipografía cuidada, donde es la comilla simple correcta. El apóstrofo ASCII es un apaño heredado de la máquina de escribir.
Cómo eliminarlo
Activa Puntuación (`--punct`) y todas las comillas tipográficas —simples, dobles, de apertura, de cierre y las bajas que usa el alemán— pasan a su equivalente recto de ASCII.
¿Es una marca de agua de IA?
Aparece en algunas salidas de IA, pero no es una marca de agua
Lo que escriben los modelos suele ser tipográficamente correcto, así que lleva comillas tipográficas. Igual que cualquier libro, cualquier periódico y cualquier documento hecho con un procesador de texto desde 1995. Es una propiedad de la cadena de producción, no una marca de autoría; y su único uso realmente sospechoso es como portador de esteganografía, donde lo que hay que mirar es una MEZCLA rara de apóstrofos rectos y tipográficos dentro de un mismo documento.
Sí que aparece en lo que generan los modelos, como tipografía corriente aprendida de los datos de entrenamiento. No es deliberado, no está diseñado para poder detectarse y no dice nada sobre ningún documento concreto.
Preguntas
¿Por qué no encuentro la palabra si la busco con el apóstrofo normal?
Porque el texto lleva un U+2019 y tu consulta lleva un U+0027. Normalizar con `--punct` hace que las dos partes coincidan.
¿Cómo se pueden esconder datos con los apóstrofos?
Recto para el 0, tipográfico para el 1, un bit por apóstrofo. El texto se lee con toda normalidad; la señal es la incoherencia. `--punct` los aplana todos y destruye el canal.
Comprueba tu propio texto
Pega lo que quieras en el limpiador para ver todos los caracteres ocultos que contiene, con su posición, su punto de código y lo que le pasa a cada uno. No se sube nada.