or
Acest exercițiu face parte din cursul
Spark este un framework pentru lucrul cu Big Data. În acest capitol vei parcurge câteva noțiuni de bază despre Spark și Machine Learning. Vei afla apoi cum să te conectezi la Spark folosind Python și cum să încarci date din fișiere CSV.
Acum că știi cum să încarci date în Spark, vei trece la construirea a două tipuri de modele de clasificare: Arbori de Decizie și Regresie Logistică. Vei descoperi și câteva metode de pregătire a datelor.
În continuare vei învăța să creezi modele de Regresie Liniară. Vei afla cum să îmbogățești datele prin crearea de noi predictori și cum să selectezi doar predictorii cei mai relevanți printr-o abordare robustă.
Exercițiul curent
În final vei învăța cum să îți faci modelele mai eficiente. Vei descoperi cum să folosești pipeline-uri pentru a scrie cod mai clar și mai ușor de întreținut. Vei aplica apoi validarea încrucișată pentru a testa mai bine modelele și a alege parametri optimi. În încheiere, vei explora două tipuri de modele ansamblu.