Зачем нужны явные схемы
Вы и ваш коллега из Global Retail Analytics загружаете customer_orders.csv и запускаете один и тот же конвейер очистки данных, однако получаете разные результаты. На изображении показаны оба подхода рядом.
Какова наиболее вероятная причина расхождения в количестве строк?
Это упражнение является частью курса
Преобразование данных с помощью Spark SQL в Databricks
Практическое интерактивное упражнение
Превратите теорию в практику с помощью одного из наших интерактивных упражнений
Начать упражнение