Перейти к основному контенту
ГлавнаяPython

Трек

Профессиональный инженер данных на Python

Обновлено 05.2026
Освойте передовые навыки и современные инструменты, которые сегодня меняют роль data engineer, с нашим треком Professional Data Engineer.
Начать трек бесплатно
PythonИнженерия данных
40 ч
12,609

Создать бесплатный аккаунт

Продолжить через GoogleПоказать больше вариантов

или


Продолжая, вы принимаете наши Условия использования, Политику конфиденциальности и соглашаетесь с хранением ваших данных в США.

Любимая обучающимися из тысяч компаний

Group

Обучаете команду?

Попробуйте для бизнеса

Описание трека

Профессиональный инженер данных на Python

Поднимите свои навыки на новый уровень с нашим треком Professional Data Engineer. Этот продвинутый трек предназначен для развития на основе треков Associate Data Engineer in SQL и Data Engineer in Python. Он вооружает вас передовыми знаниями и инструментами, востребованными в современных ролях data engineering. На протяжении этого пути вы освоите современные архитектуры данных, улучшите навыки Python, углубившись в объектно-ориентированное программирование, изучите базы данных NoSQL и научитесь использовать dbt для бесшовной трансформации данных. Откройте секреты DevOps с помощью основных практик, продвинутых методов тестирования и таких инструментов, как Docker, чтобы оптимизировать процессы разработки и развертывания. Погрузитесь в технологии больших данных с PySpark и овладейте обработкой данных и автоматизацией с помощью shell scripting. Применяйте знания на практике в проектах и работайте с реальными наборами данных, чтобы оттачивать навыки, отлаживать сложные рабочие процессы и оптимизировать процессы обработки данных. Пройдя этот трек, вы не только освоите продвинутые навыки, необходимые для решения сложных задач data engineering, но и обретёте уверенность в их применении в динамичном мире data engineering.

Необходимые условия

Инженер данных
  • Course

    1

    Современные архитектуры данных

    Откройте ключевые компоненты современной архитектуры данных: от ingestion и serving до governance и orchestration.

  • Course

    Командная строка Unix помогает объединять существующие программы по-новому, автоматизировать рутинные задачи и запускать программы на кластерах и в облаках.

  • Course

    Курс знакомит с dbt для моделирования данных, преобразований, тестирования и создания документации.

  • Course

    В этом введении в DevOps вы освоите основы DevOps и изучите ключевые концепции, инструменты и методы для повышения продуктивности.

  • Project

    бонус

    Debugging Code

    Sharpen your debugging skills to enhance sales data accuracy.

  • Course

    10

    Введение в Docker

    Познакомьтесь с Docker и узнайте, почему он важен в арсенале специалиста по данным. Узнайте о контейнерах Docker, образах и многом другом.

  • Course

    Освойте PySpark для работы с большими данными: обрабатывайте, запрашивайте и оптимизируйте огромные наборы данных для мощной аналитики!

  • Chapter

    This chapter introduces the exciting world of Big Data, as well as the various concepts and different frameworks for processing Big Data. You will understand why Apache Spark is considered the best framework for BigData.

  • Chapter

    The main abstraction Spark provides is a resilient distributed dataset (RDD), which is the fundamental and backbone data type of this engine. This chapter introduces RDDs and shows how RDDs can be created and executed using RDD Transformations and Actions.

  • Chapter

    In this chapter, you'll learn about Spark SQL which is a Spark module for structured data processing. It provides a programming abstraction called DataFrames and can also act as a distributed SQL query engine. This chapter shows how Spark SQL allows you to use DataFrames in Python.

  • Chapter

    In this chapter, we learn how to download data files from web servers via the command line. In the process, we also learn about documentation manuals, option flags, and multi-file processing.

  • Chapter

    In the last chapter, we bridge the connection between command line and other data science languages and learn how they can work together. Using Python as a case study, we learn to execute Python on the command line, to install dependencies using the package manager pip, and to build an entire model pipeline using the command line.

  • Course

    Узнайте о разнице между пакетной и потоковой обработкой, масштабировании потоковых систем и реальных сценариях применения.

  • Course

    В этом курсе вы изучите основы Kubernetes и научитесь разворачивать и оркестрировать контейнеры с помощью Manifests и инструкций kubectl.

Профессиональный инженер данных на Python
13 Курсов
Трек
завершён

Получить сертификат об окончании

Добавьте эту квалификацию в профиль LinkedIn, резюме или CV
Поделитесь в социальных сетях и в обзоре эффективности
Записаться сейчас

Присоединяйтесь к более чем 19 миллионам обучающихся и начните Профессиональный инженер данных на Python уже сегодня!

Создать бесплатный аккаунт

Продолжить через GoogleПоказать больше вариантов

или


Продолжая, вы принимаете наши Условия использования, Политику конфиденциальности и соглашаетесь с хранением ваших данных в США.

Развивайте свои навыки работы с данными с помощью DataCamp для мобильных устройств.

Успевайте в обучении на ходу с помощью наших мобильных курсов и ежедневных 5-минутных заданий по программированию.