Cómo inspeccionar caracteres Unicode y diferencias ocultas.
Examina los puntos de código cuando un texto parece idéntico pero se comporta de otra forma. Normaliza solo cuando lo permitan las reglas del destino.
Adapta el flujo de trabajo a tu tarea.
Examina los caracteres reales y enumera sus puntos de código y posiciones en lugar de fiarte de su apariencia. Identifica marcas combinantes, símbolos parecidos y caracteres invisibles. Compara formas normalizadas solo bajo una regla acordada y conserva los originales cuando importen los identificadores o bytes exactos.
- Qué aportas
- Texto con caracteres inesperados.
- Qué obtienes
- Puntos de código, caracteres invisibles y sugerencias de normalización.
Mira la entrada y el resultado.
Entrada y salida ilustrativas · ejemplo didáctico, no una ejecución de WebAct en directo
Ejemplo campo
Inspect these two strings: café and café. Compare their code points and their NFC-normalized values.
Ejemplo completo
café: U+0063 U+0061 U+0066 U+00E9 (4 code points). café: U+0063 U+0061 U+0066 U+0065 U+0301 (5 code points). Both normalize to café under NFC. Their original sequences differ; preserve originals when exact byte identity matters.
Carga esta entrada en el prompt y cópialo en WebAct para probar la tarea. Tu resultado puede diferir del ejemplo.
Decisiones y solución de problemas.
¿Pueden tener distinta longitud dos cadenas Unicode visualmente idénticas?
Sí. Un carácter visible puede representarse con un punto de código o varios, y la longitud en bytes es otra medida distinta.
¿Por qué la normalización no consiguió igualar dos letras parecidas?
Pueden ser caracteres distintos de sistemas de escritura diferentes, no representaciones alternativas del mismo carácter. Examina sus puntos de código.
Referencia para este flujo de trabajo.
Pruébalo con tu propia fuente.
Sustituye el ejemplo por tu material en el prompt. Conserva los requisitos que necesites y copia la tarea en WebAct.
Personalizar y copiar la tarea ↑