Перейти к основному содержимому

Трек

Большие данные с PySpark

Освойте обработку больших данных и эффективное их использование с Apache Spark с помощью API PySpark.

  • Python
  • Импорт и очистка данных
  • 25 часы
  • 10,134

Создать бесплатный аккаунт

Продолжить через Google
или
Продолжая, вы принимаете нашу Условия использования, наши Политику конфиденциальности и то, что ваши данные хранятся в США.

Нас выбирают учащиеся из тысяч компаний

Обучаете команду?Попробовать для бизнеса

Описание трека

Большие данные с PySpark

Усовершенствуйте свои навыки работы с данными, освоив Apache Spark. Используя Spark Python API, PySpark, вы будете использовать параллельные вычисления с большими наборами данных и подготовитесь к высокопроизводительному машинному обучению. От очистки данных до создания признаков и внедрения моделей машинного обучения — вы будете выполнять сквозные рабочие процессы с Spark. Трек завершается созданием рекомендательной системы с использованием популярного набора данных MovieLens и набора данных Million Songs.

Предварительные требования

Для этого трека нет предварительных требований

Развивайте навыки работы с данными с помощью DataCamp для мобильных устройств

Продвигайтесь вперёд в дороге с нашими мобильными курсами и ежедневными 5-минутными заданиями по программированию.