Algoritmi PySpark MLlib
Înainte de a folosi orice algoritm de învățare automată în shell-ul PySpark, trebuie să imporți submodulele bibliotecii pyspark.mllib și să alegi clasa potrivită pentru sarcina de învățare automată dorită.
În acest exercițiu simplu, vei învăța cum să imporți diferitele submodule ale pyspark.mllib, împreună cu clasele necesare pentru filtrarea colaborativă, clasificare și clustering.
Acest exercițiu face parte din cursul
Fundamentele Big Data cu PySpark
Instrucțiuni pentru exercițiu
- Importă submodulul de recomandare din
pyspark.mllibși clasa Alternating Least Squares. - Importă submodulul de clasificare din
pyspark.mllibși clasa Logistic Regression with LBFGS. - Importă submodulul de clustering din
pyspark.mllibși clasa KMeans.
Exercițiu interactiv practic
Încearcă acest exercițiu completând acest cod de exemplu.
# Import the library for ALS
from pyspark.mllib.____ import ____
# Import the library for Logistic Regression
from ____.____.____ import ____
# Import the library for Kmeans
from ____.____.____ ____ ____