矛盾する値を失わずに重複行を見つける方法。
レコードの同一性を決めるフィールドで重複を定義してください。元の行への参照を保持し、矛盾する値を説明なしに統合しないでください。
作業手順をタスクに合わせましょう。
重複を定義する列を選び、大文字小文字や前後の空白を区別するか決めます。一致するレコードを元の行番号付きでまとめてください。完全に同一のコピーと、キーは同じでも他の値が異なるレコードを区別し、競合を確認できるよう残します。
- 用意するもの
- 提供された表と照合キー。
- 得られるもの
- 元の行への参照を保持した重複グループ。
入力と結果を確認しましょう。
説明用の入力と出力 · 実際の WebAct 実行ではない学習用サンプル
入力項目サンプル個
Compare exact order_id values. Source rows: row 2: O12, USD 100; row 3: O13, USD 50; row 4: O12, USD 105. Keep source references.
完成例
Duplicate-key group O12: - Row 2: USD 100 - Row 4: USD 105 Classification: conflicting amounts, difference USD 5. Row 3 has no duplicate key in this input. No rows removed; an owner must resolve the conflict.
この入力をプロンプトに読み込み、WebAct にコピーして試してください。結果は掲載例と異なる場合があります。
判断のポイントとトラブル対処。
顧客名が繰り返されていれば重複レコードと見なすべきですか?
名前だけで同一性を確定できることはほとんどありません。データセットに適したレコードキーと補助フィールドを使ってください。
重複する IDs を削除したら新しい値が失われたのはなぜですか?
行が互いに矛盾する更新を表していた可能性があります。どのレコードを残すか、そもそも残すべきかを決める前に、タイムスタンプとフィールドの違いを確認してください。
自分の資料で試しましょう。
タスクのプロンプト内の例を自分の資料に置き換えてください。必要な要件を残し、タスクを WebAct にコピーします。
タスクを調整してコピー ↑