CSVの照合で、IDが重複していたら
CSVをIDで比較するとき、一番大切なのは「同じキーが複数の行に出てこないこと」です。重複があると、どの行とどの行を比べるべきか決まりません。先頭行だけを採用すると、見落としにつながる場合があります。
重複の原因を分ける
- 同じデータを二重に登録した。
- 1つの商品が複数の店舗に存在する。
- 1つの注文に複数の明細がある。
- IDの空欄や、別々のデータで同じ番号を使っている。
店舗別在庫や注文明細のように、重複が正しい場合もあります。重複をすぐ削除するのではなく、1行の意味を確認します。
複合キーの例
商品ID,店舗,在庫 001,東京,8 001,大阪,12
商品IDだけでは重複ですが、商品IDと店舗の組なら一意です。CSV照合室では最大3列をキーにできます。列の値を単純に連結せず、区切りを含む値でも組を区別して照合します。
片側だけ重複していても、両側の行を確認する
A:ID 001 が2行 B:ID 001 が1行
この場合は「001」に属するAの2行とBの1行、合計3行を要確認に分けます。Bの1行をAのどちらかに推測で結び付けたり、Aの2行目を勝手に削除したりしません。
空欄をIDとして使わない
空欄のキーは同一対象を特定できません。複合キーのどれか1列が空欄の場合も要確認になります。キーを補うか、比較対象を絞って元データを確認してください。
001と1は違うキー
IDは文字列として扱います。「001」と「1」は別物です。別システムの出力で桁数が変わっている場合は、元の仕様を確認し、意図的にそろえてから比較します。ゼロを自動で消すと、別のIDを同じものとして扱うおそれがあります。
どのキーも一意にならない場合
このツールは1対1の比較に絞っています。複数明細の金額合算、部分入金の配賦、曖昧な氏名の名寄せは対象外です。キーが決まらないデータを無理に照合せず、元システムから明細IDを出す方法を検討してください。