잘못된 레코드를 병합하지 않도록 유사 일치를 검토하는 방법.
유사 일치는 검토할 후보이지 동일성이 확인된 결과가 아닙니다. 맥락을 제공하는 필드를 사용하고 불확실한 대안도 유지하세요.
작업에 맞게 절차를 조정하세요.
대소문자와 문장부호처럼 합의된 차이만 정규화한 뒤 후보 이름을 안정적인 보조 필드와 함께 비교하세요. 각 쌍을 제안한 이유를 보여 주고 대안도 유지하세요. 잘못 병합했을 때의 비용에 맞는 검토 임계값을 사용하세요.
- 제공할 내용
- 작은 목록 두 개와 일치 기준.
- 받을 결과
- 모호성과 신뢰도에 대한 메모가 포함된 일치 후보.
입력과 결과를 확인하세요.
설명용 입력과 출력 · 실제 WebAct 실행이 아닌 학습용 예시
입력 항목 예시개
Fictional lists contain Acme Ltd and Acme Limited, both at the supplied address 10 Example Road. Suggest a reviewable match.
완성된 예시
Candidate pair: Acme Ltd ↔ Acme Limited. Supporting evidence: similar name with an expanded suffix; supplied address matches at 10 Example Road. Status: possible match for human review, not confirmed entity identity. Before merging: compare any stable business identifiers and conflicting fields.
이 입력을 프롬프트에 넣고 WebAct에 복사해 작업을 실행해 보세요. 결과는 설명용 예시와 다를 수 있습니다.
판단 기준과 문제 해결.
비슷한 회사 이름을 자동으로 병합해도 되나요?
이름이 비슷하다는 것만으로는 충분하지 않습니다. 레코드를 합치기 전에 보조 식별자나 주소 정보를 확인하세요.
서로 다른 두 회사의 일치 점수가 높게 나오는 이유는 무엇인가요?
공통 단어가 유사도 점수에 지나치게 큰 영향을 줄 수 있습니다. 점수를 동일성의 증거로 받아들이지 말고 구별되는 단어, 위치, 식별자를 살펴보세요.
직접 준비한 자료로 시도하세요.
작업 프롬프트의 예시를 내 자료로 바꾸세요. 필요한 요구 사항은 유지하고 작업을 WebAct에 복사하세요.
작업 맞춤 설정 및 복사 ↑