ビジネスの現場において、表計算ソフトウェアが担う役割は年々重みを増している。単なる数字の集計ツールから、大規模な情報を蓄積・分析する情報基盤へと昇華した。だが、日本語環境における文字コードの過渡期を通過してきた経緯もあり、漢字データの扱いには根深い課題が残されたままだ。
特に問題となるのが、人間には同じ文字に見えてもコンピュータ上では異なるバイナリデータとして扱われる「表記揺れ」である。外部からインポートしたテキストデータや、手入力によって作成された名簿では、文字コードの違いや旧字体・新字体の混在が頻発する。これが検索機能の動作を阻害し、名寄せ作業に膨大な時間を費やす最大の要因となっている。