НачатьНачать бесплатно

Шаги конвейера данных

Один из наиболее критически важных конвейеров данных в компании Sierra Publishing основан на высокоскоростном потоке данных из Kafka. Необходимо считать эти данные и объединить их с несколькими другими наборами данных.

Data Streaming Pipeline

Команда разработчиков данных хочет использовать Databricks, чтобы повысить эффективность этого конвейера и дать потребителям возможность работать с актуальными данными в режиме реального времени для их аналитических задач.

Это упражнение является частью курса

Концепции Databricks

Посмотреть курс

Практическое интерактивное упражнение

Превратите теорию в практику с помощью одного из наших интерактивных упражнений

Начать упражнение