ときどき、書き方は違っていても発音が似ている、またはほぼ同じという「やっかいな」文字列に出会います。SQL Server には、そうした文字列を検出するための SOUNDEX() と DIFFERENCE() という関数があります。
SOUNDEX()
DIFFERENCE()
次の記述のうち、これらの関数についての説明として誤っているものはどれですか?
この演習はコースの一部です
理論を実践に変える、インタラクティブな演習のひとつをお試しください
まずは、なぜデータクレンジングが重要なのかを学びます。文字列の前後にある余分な空白の除去、フライト登録番号の表記ゆれの統一、文字列の結合など、基本的な問題の解決から始めます。
現在の演習
この章では、データクレンジングの知識をさらに深めます。欠損値への対処、データセット内の重複の回避、そして異なる日付形式の扱い方を学びます。
この章では、範囲外の値や不正確なデータへの対処を行います。さらに、異なるデータ型への変換を実践します。最後に、パターンマッチングを用いて外れ値を見つける方法に取り組みます。
最終章では、複数列のデータをまとめて集約する、1 列のデータを複数列に分割する、行と列を相互に変換する方法を学びます。