开始使用免费开始使用

练习缓存:把所有要点串起来

针对 df1df2,最佳的缓存方式是什么?原因是什么?

您的结果可能会不同;下面是两种方法各一次(随机)运行的示例结果:

第一个答案(缓存 df1):

df1_1st : 2.4s
df1_2nd : 0.1s
df2_1st : 0.3s
df2_2nd : 0.2s
Overall elapsed : 3.9

第二个答案(缓存 df2):

df1_1st : 2.3s
df1_2nd : 1.1s
df2_1st : 1.7s
df2_2nd : 0.1s
Overall elapsed : 6.4

本练习是课程的一部分

Python 中的 Spark SQL 入门

查看课程

动手互动练习

通过我们的互动练习之一,将理论转化为实践

开始练习