Chuyển đến nội dung chính

Khóa học

Feature Engineering với PySpark

Nâng cao4 giờ

Nắm vững kỹ năng xử lý dữ liệu và xây dựng đặc trưng—hai công việc chiếm 70-80% thời gian của Nhà khoa học dữ liệu.

Python4 giờ16 video60 bài tập5,000 XP17,880Giấy chứng nhận thành tích

Tạo tài khoản miễn phí

Tiếp tục với Google
hoặc
Bằng việc tiếp tục, ban chấp nhận Điều khoản sử dụng, của chúng tôi Chính sách bảo mật và rằng dữ liệu của bạn được lưu trữ tại Hoa Kỳ.

Được người học tại hàng nghìn công ty yêu thích

Đào tạo đội ngũ?

Dùng thử cho Doanh nghiệp

Mô tả khóa học

Thế giới thực rất lộn xộn và nhiệm vụ của bạn là tìm ra ý nghĩa từ đó. Các bộ dữ liệu đồ chơi như MTCars và Iris là kết quả của việc tuyển chọn và làm sạch cẩn thận, nhưng ngay cả vậy dữ liệu vẫn cần được biến đổi để các thuật toán Machine Learning mạnh mẽ có thể rút trích ý nghĩa, dự báo, phân loại hoặc phân cụm. Khóa học này sẽ đi sâu vào những chi tiết thực tế mà các nhà khoa học dữ liệu dành 70–80% thời gian cho chúng: xử lý dữ liệu và xây dựng đặc trưng (feature engineering). Khi kích thước dữ liệu ngày càng lớn, hãy dùng PySpark để thu nhỏ bài toán Big Data này về mức vừa tầm!

Yêu cầu tiên quyết

Chương trình học

Đề cương khóa học

Feature Engineering với PySpark

Hoàn
thành khóa học

Nhận Chứng nhận Hoàn thành

Đăng ký ngay

Phát triển kỹ năng dữ liệu với DataCamp for Mobile

Tiến bộ mọi lúc mọi nơi với các khóa học di động và thử thách lập trình 5 phút hàng ngày.