始める無料で始める

PySpark MLlib のアルゴリズム

PySpark シェルで Machine Learning のアルゴリズムを使う前に、pyspark.mllib ライブラリのサブモジュールをインポートし、目的の Machine Learning タスクに適したクラスを選ぶ必要があります。

このシンプルな演習では、協調フィルタリング、分類、クラスタリングのアルゴリズムを実行するために必要な pyspark.mllib の各サブモジュールとクラスのインポート方法を学びます。

この演習はコースの一部です

PySparkで学ぶBig Data入門

コースを見る

演習の手順

  • pyspark.mllib の recommendation サブモジュールと Alternating Least Squares クラスをインポートします。
  • pyspark.mllib の classification サブモジュールと Logistic Regression with LBFGS クラスをインポートします。
  • pyspark.mllib の clustering サブモジュールと kmeans クラスをインポートします。

実践的なインタラクティブ演習

このサンプルコードを完成させて、この演習に挑戦してみましょう。

# Import the library for ALS
from pyspark.mllib.____ import ____

# Import the library for Logistic Regression
from ____.____.____ import ____

# Import the library for Kmeans
from ____.____.____ ____ ____
コードを編集して実行