Como inspecionar caracteres Unicode e diferenças ocultas.
Examine os pontos de código quando textos parecem iguais, mas se comportam de forma diferente. Normalize apenas quando as regras do destino permitirem.
Adapte o fluxo à sua tarefa.
Inspecione os caracteres reais, listando pontos de código e posições em vez de confiar na aparência. Identifique marcas combinantes, símbolos parecidos e caracteres invisíveis. Compare formas normalizadas somente sob uma regra acordada e preserve os originais quando identificadores ou bytes exatos forem importantes.
- O que você fornece
- Texto com caracteres inesperados.
- O que você recebe
- Pontos de código, caracteres invisíveis e sugestões de normalização.
Veja a entrada e o resultado.
Entrada e saída ilustrativas · exemplo didático, não uma execução real do WebAct
Exemplo campo
Inspect these two strings: café and café. Compare their code points and their NFC-normalized values.
Exemplo completo
café: U+0063 U+0061 U+0066 U+00E9 (4 code points). café: U+0063 U+0061 U+0066 U+0065 U+0301 (5 code points). Both normalize to café under NFC. Their original sequences differ; preserve originals when exact byte identity matters.
Carregue esta entrada no prompt e copie para o WebAct para testar a tarefa. Seu resultado pode ser diferente da ilustração.
Decisões e solução de problemas.
Strings Unicode visualmente idênticas podem ter comprimentos diferentes?
Sim. Um caractere visível pode ser representado por um ou vários pontos de código, e o comprimento em bytes é outra medida distinta.
Por que a normalização não tornou iguais duas letras parecidas?
Elas podem ser caracteres diferentes de sistemas de escrita distintos, não representações alternativas do mesmo caractere. Examine os pontos de código.
Referência para este fluxo de trabalho.
Teste com sua própria fonte.
Substitua o exemplo pelo seu material no prompt. Mantenha os requisitos necessários e copie a tarefa para o WebAct.
Personalizar e copiar a tarefa ↑