Шаги конвейера данных
Один из наиболее критически важных конвейеров данных в компании Sierra Publishing основан на высокоскоростном потоке данных из Kafka. Необходимо считать эти данные и объединить их с несколькими другими наборами данных.

Команда разработчиков данных хочет использовать Databricks, чтобы повысить эффективность этого конвейера и дать потребителям возможность работать с актуальными данными в режиме реального времени для их аналитических задач.
Это упражнение является частью курса
Концепции Databricks
Практическое интерактивное упражнение
Превратите теорию в практику с помощью одного из наших интерактивных упражнений
Начать упражнение