Kom igångKom igång gratis

Förutsäg testdata

En anpassad logistisk modell df_fitted finns tillgänglig. En dataram df_testset finns tillgänglig med testdata för den här modellen. En variabel fields finns tillgänglig och innehåller listan ['prediction', 'label', 'endword', 'doc', 'probability']. Den används för att ange vilka prediktionsfält som ska skrivas ut.

Den här övningen är en del av kursen

Introduktion till Spark SQL i Python

Visa kurs

Övningsinstruktioner

  • Applicera modellen på datan i df_testset.
  • Skriv ut "incorrect" om prediktionen inte stämmer överens med etiketten.

Interaktiv övning med praktiskt arbete

Testa den här övningen genom att slutföra den här exempelkoden.

# Apply the model to the test data
predictions = df_fitted.____(____).select(fields)

# Print incorrect if prediction does not match label
for x in predictions.take(8):
    print()
    if x.label != int(x.____):
        print("INCORRECT ==> ")
    for y in fields:
        print(y,":", x[y])
Redigera och kör kod