Začněte nyníZačněte zdarma

Predikce na testovacích datech

K dispozici máš natrénovaný logistický model df_fitted. K dispozici máš také dataframe df_testset s testovacími daty pro tento model. Proměnná fields obsahuje seznam ['prediction', 'label', 'endword', 'doc', 'probability'] a slouží k určení toho, která predikční pole se mají vypsat.

Toto cvičení je součástí kurzu

Úvod do Spark SQL v Pythonu

Zobrazit kurz

Pokyny k cvičení

  • Aplikuj model na data v df_testset.
  • Vypiš "incorrect", pokud se predikce neshoduje s labelem.

Interaktivní cvičení na vyzkoušení si v praxi

Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.

# Apply the model to the test data
predictions = df_fitted.____(____).select(fields)

# Print incorrect if prediction does not match label
for x in predictions.take(8):
    print()
    if x.label != int(x.____):
        print("INCORRECT ==> ")
    for y in fields:
        print(y,":", x[y])
Upravit a spustit kód