Chuyển đến nội dung chính
Trang chủPython

Lộ trình

Dữ liệu lớn với PySpark

Đã cập nhật tháng 05, 2026
Nắm vững cách xử lý dữ liệu lớn và tận dụng hiệu quả với Apache Spark thông qua giao diện lập trình ứng dụng PySpark.
Bắt Đầu Track Miễn Phí
PythonNhập và làm sạch dữ liệu25 giờ8,479

Tạo tài khoản miễn phí

hoặc

Bằng cách tiếp tục, bạn chấp nhận Điều khoản sử dụng, Chính sách bảo mật và việc dữ liệu của bạn được lưu trữ tại Hoa Kỳ.

Được yêu thích bởi học viên tại hàng nghìn công ty

Group

Đào tạo 2 người trở lên?

Thử DataCamp for Business

Mô tả track

Dữ liệu lớn với PySpark

Nâng cao kỹ năng xử lý dữ liệu của quý vị bằng cách thành thạo Apache Spark. Sử dụng API Spark Python, PySpark, quý vị sẽ tận dụng tính toán song song với các tập dữ liệu lớn và chuẩn bị cho việc học máy hiệu suất cao. Từ việc làm sạch dữ liệu đến tạo tính năng và triển khai các mô hình học máy, quý vị sẽ thực hiện các quy trình làm việc từ đầu đến cuối bằng Spark. Chương trình kết thúc bằng việc xây dựng một hệ thống đề xuất sử dụng bộ dữ liệu MovieLens phổ biến và bộ dữ liệu Million Songs.

Điều kiện tiên quyết

Không có điều kiện tiên quyết cho track này
  • Course

    1

    Nhập môn PySpark

    Thành thạo PySpark để xử lý big data dễ dàng—học cách xử lý, truy vấn và tối ưu hóa các bộ dữ liệu khổng lồ cho phân tích mạnh mẽ!

  • Course

    Learn the gritty details that data scientists are spending 70-80% of their time on; data wrangling and feature engineering.

  • Course

    Learn how to make predictions from data with Apache Spark, using decision trees, logistic regression, linear regression, ensembles, and pipelines.

  • Project

    thưởng

    Building a Demand Forecasting Model

    Use PySpark to build an e-commerce forecasting model!

Dữ liệu lớn với PySpark
6 Khóa học
Hoàn
Thành

Nhận Giấy Chứng Nhận Hoàn Thành

Thêm chứng chỉ này vào hồ sơ LinkedIn, CV hoặc sơ yếu lý lịch của ban
Chia sẻ trên mạng xã hội và trong đánh giá hiệu suất của ban
Đăng Ký Ngay

Tham gia cùng hơn 19 triệu học viên và bắt đầu Dữ liệu lớn với PySpark ngay hôm nay!

Tạo tài khoản miễn phí

hoặc

Bằng cách tiếp tục, bạn chấp nhận Điều khoản sử dụng, Chính sách bảo mật và việc dữ liệu của bạn được lưu trữ tại Hoa Kỳ.

Phát triển kỹ năng dữ liệu với DataCamp cho thiết bị di động

Tiến bộ mọi lúc mọi nơi với các khóa học cho thiết bị di động và thử thách lập trình 5 phút hằng ngày.