Chuyển đến nội dung chính
Trang chủPython

Lộ trình

Dữ liệu lớn với PySpark

Đã cập nhật tháng 03, 2026
Nắm vững cách xử lý dữ liệu lớn và tận dụng hiệu quả với Apache Spark thông qua giao diện lập trình ứng dụng PySpark.
Bắt Đầu Track Miễn Phí

Bao gồm vớiCao cấp or Đội nhóm

PythonNhập và làm sạch dữ liệu25 giờ7,861

Tạo tài khoản miễn phí

hoặc

Bằng cách tiếp tục, bạn chấp nhận Điều khoản sử dụng, Chính sách bảo mật và việc dữ liệu của bạn được lưu trữ tại Hoa Kỳ.

Được yêu thích bởi học viên tại hàng nghìn công ty

Group

Đào tạo 2 người trở lên?

Thử DataCamp for Business

Mô tả track

Dữ liệu lớn với PySpark

Nâng cao kỹ năng xử lý dữ liệu của quý vị bằng cách thành thạo Apache Spark. Sử dụng API Spark Python, PySpark, quý vị sẽ tận dụng tính toán song song với các tập dữ liệu lớn và chuẩn bị cho việc học máy hiệu suất cao. Từ việc làm sạch dữ liệu đến tạo tính năng và triển khai các mô hình học máy, quý vị sẽ thực hiện các quy trình làm việc từ đầu đến cuối bằng Spark. Chương trình kết thúc bằng việc xây dựng một hệ thống đề xuất sử dụng bộ dữ liệu MovieLens phổ biến và bộ dữ liệu Million Songs.

Điều kiện tiên quyết

Không có điều kiện tiên quyết cho track này
  • Course

    1

    Introduction to PySpark

    Master PySpark to handle big data with ease—learn to process, query, and optimize massive datasets for powerful analytics!

  • Course

    Learn the gritty details that data scientists are spending 70-80% of their time on; data wrangling and feature engineering.

  • Course

    Learn how to make predictions from data with Apache Spark, using decision trees, logistic regression, linear regression, ensembles, and pipelines.

  • Project

    thưởng

    Building a Demand Forecasting Model

    Use PySpark to build an e-commerce forecasting model!

Dữ liệu lớn với PySpark
6 Khóa học
Hoàn
Thành

Nhận Giấy Chứng Nhận Hoàn Thành

Thêm chứng chỉ này vào hồ sơ LinkedIn, CV hoặc sơ yếu lý lịch của ban
Chia sẻ trên mạng xã hội và trong đánh giá hiệu suất của ban

Bao gồm vớiCao cấp or Đội nhóm

Đăng Ký Ngay

Tham gia cùng hơn 19 triệu học viên và bắt đầu Dữ liệu lớn với PySpark ngay hôm nay!

Tạo tài khoản miễn phí

hoặc

Bằng cách tiếp tục, bạn chấp nhận Điều khoản sử dụng, Chính sách bảo mật và việc dữ liệu của bạn được lưu trữ tại Hoa Kỳ.