Перейти к основному контенту

Курс

Преобразование данных с помощью Spark SQL в Databricks

Средний3 ч

Постройте сквозные data pipelines — от очистки и агрегации до streaming и orchestration.

Python3 ч{count, plural, one {# видео} few {# видео} many {# видео} other {# видео}}{count, plural, one {# упражнение} few {# упражнения} many {# упражнений} other {# упражнения}}1,750 XP1,091Заявление об успешном завершении

Создайте бесплатный аккаунт

Продолжить с Google
или
Продолжая, вы принимаете наши Условия использования, наш Политика конфиденциальности и что ваши данные хранятся в США.

Любимый инструмент учащихся тысяч компаний

Обучаете команду?

Попробовать для бизнеса

Описание курса

Готовы работать с реальными данными в больших масштабах? Этот курс научит вас преобразовывать крупные наборы данных с помощью Spark SQL и PySpark в Databricks. Вы освоите формирование и очистку данных, научитесь выполнять агрегации с оптимизированными соединениями и применять оконные функции для продвинутой аналитики. Кроме того, вы настроите потоковую обработку файлов с отказоустойчивыми контрольными точками и сохранение результатов в виде таблиц Delta. В итоге вы сможете самостоятельно оркестрировать многошаговые производственные пайплайны с помощью Databricks Workflows и Lakeflow Declarative Pipelines.

Предварительные требования

Программа

Структура курса

Преобразование данных с помощью Spark SQL в Databricks

Курс
завершён

Получить справку об окончании курса

Записаться

Развивайте навыки работы с данными с DataCamp для мобильных устройств

Продолжайте учиться в любом месте с мобильными курсами и ежедневными 5-минутными практическими заданиями.