Unicode 문자와 숨겨진 차이를 검사하는 방법.
텍스트가 같아 보이는데 다르게 동작한다면 코드 포인트를 살펴보세요. 대상 규칙이 허용하는 경우에만 정규화하세요.
작업에 맞게 절차를 조정하세요.
겉모양에 의존하지 말고 코드 포인트와 위치를 나열해 실제 문자를 검사하세요. 결합 문자, 닮은 기호, 보이지 않는 문자를 식별하세요. 합의한 규칙에 따라서만 정규화된 형태를 비교하고 정확한 식별자나 바이트가 중요하면 원본을 보존하세요.
- 제공할 내용
- 예상하지 못한 문자가 있는 텍스트.
- 받을 결과
- 코드 포인트, 보이지 않는 문자, 정규화 제안.
입력과 결과를 확인하세요.
설명용 입력과 출력 · 실제 WebAct 실행이 아닌 학습용 예시
입력 항목 예시개
Inspect these two strings: café and café. Compare their code points and their NFC-normalized values.
완성된 예시
café: U+0063 U+0061 U+0066 U+00E9 (4 code points). café: U+0063 U+0061 U+0066 U+0065 U+0301 (5 code points). Both normalize to café under NFC. Their original sequences differ; preserve originals when exact byte identity matters.
이 입력을 프롬프트에 넣고 WebAct에 복사해 작업을 실행해 보세요. 결과는 설명용 예시와 다를 수 있습니다.
판단 기준과 문제 해결.
시각적으로 같은 Unicode 문자열의 길이가 다를 수 있나요?
네. 눈에 보이는 문자 하나가 코드 포인트 하나 또는 여러 개로 표현될 수 있으며, 바이트 길이는 또 다른 측정 기준입니다.
정규화해도 비슷하게 생긴 두 글자가 같아지지 않는 이유는 무엇인가요?
같은 문자의 다른 표현이 아니라 서로 다른 문자 체계의 별개 문자일 수 있습니다. 코드 포인트를 확인하세요.
이 워크플로의 참고 자료입니다.
직접 준비한 자료로 시도하세요.
작업 프롬프트의 예시를 내 자료로 바꾸세요. 필요한 요구 사항은 유지하고 작업을 WebAct에 복사하세요.
작업 맞춤 설정 및 복사 ↑