Procvičování cache: vše dohromady
Jaký byl nejlepší přístup k cachování df1 a df2 a proč?
Tvoje výsledky se mohou lišit; tady je jeden (náhodný) výsledek pro každý ze dvou přístupů:
První odpověď (cache df1):
df1_1st : 2.4s
df1_2nd : 0.1s
df2_1st : 0.3s
df2_2nd : 0.2s
Overall elapsed : 3.9
Druhá odpověď (cache df2):
df1_1st : 2.3s
df1_2nd : 1.1s
df2_1st : 1.7s
df2_2nd : 0.1s
Overall elapsed : 6.4
Toto cvičení je součástí kurzu
Úvod do Spark SQL v Pythonu
Interaktivní praktické cvičení
Proměňte teorii v praxi s jedním z našich interaktivních cvičení
Začít cvičení