データセットを読み込む
NannyML には、ユースケースのデモやさまざまなアルゴリズムのテストを簡単にするための内部データセットが用意されています。データセットを読み込むには、nannyml.load_us_census_ma_employment_data() 関数を使うだけで十分です。
この関数は3つの Pandas DataFrame オブジェクトを返します。reference セット(テストセット)、analysis セット(本番の未観測データ)、そして analysis セットの正解ラベル(ground truth)です。これらのデータフレームは、それぞれ reference、analysis、analysis_gt という名前で受け取りましょう。
この演習では、US Census Employment データセットを読み込み、各データフレームを出力して中身のイメージを掴みます。
この演習はコースの一部です
Pythonで学ぶ機械学習のモニタリング
演習の手順
nannymlライブラリをインポートします。nannymlライブラリから US Census Employment データセットを読み込みます。- reference データの先頭を表示します。
- analysis データの先頭を表示します。
実践的なインタラクティブ演習
このサンプルコードを完成させて、この演習に挑戦してみましょう。
# Import nannyml
import ____
# Load US Census Employment dataset
____, ____, ____ = ____.____()
# Print head of the reference data
____
# Print head of the analysis data
____