НачатьНачать бесплатно

Зачем нужны явные схемы

Вы и ваш коллега из Global Retail Analytics загружаете customer_orders.csv и запускаете один и тот же конвейер очистки данных, однако получаете разные результаты. На изображении показаны оба подхода рядом.


Какова наиболее вероятная причина расхождения в количестве строк?

Это упражнение является частью курса

Преобразование данных с помощью Spark SQL в Databricks

Посмотреть курс

Практическое интерактивное упражнение

Превратите теорию в практику с помощью одного из наших интерактивных упражнений

Начать упражнение