Unicode puede contener secuencias distintas relacionadas canónicamente y visualmente parecidas. La letra é precompuesta es U+00E9; la forma descompuesta usa U+0065 seguida de U+0301. Igualarlas para búsqueda puede ser útil, pero convertir una en otra es normalización separada y destruiría la evidencia exacta de entrada.
Las dos formas producen evidencia distinta
En UTF-8, U+00E9 es C3 A9 y U+0065 U+0301 es 65 CC 81. Sus recuentos son uno y dos valores, una y dos unidades UTF-16, y dos y tres bytes. UnicodeLens muestra estos hechos sin decidir si una fuente los dibuja igual. El preset coloca ambas formas junto a un separador para revisar el orden.
Inspección y normalización son tareas distintas
Un inspector debe conservar el valor inspeccionado. UnicodeLens no aplica NFC, NFD, NFKC ni NFKD, no cambia mayúsculas ni quita selectores o uniones. Un normalizador futuro necesitaría formas explícitas, evidencia antes y después, avisos de pérdida y datos de conformidad ejecutables. Separarlo hace que U+ y bytes copiados correspondan al textarea, no a una reparación oculta.
El sistema consumidor decide la comparación
Bases de datos, lenguajes, sistemas de archivos y buscadores no normalizan ni comparan igual. La equivalencia canónica tampoco resuelve orden local, grafemas, suplantación o políticas de identificadores. Usa UnicodeLens para capturar la secuencia exacta y aplica una política documentada donde se consumen los datos. No deduzcas identidad, intercambio ni seguridad solo por un glifo parecido.