Chuyển đến nội dung chính

Khóa học

Feature Engineering với PySpark

Nâng cao4 giờ

Nắm vững kỹ năng xử lý dữ liệu và xây dựng đặc trưng—hai công việc chiếm 70-80% thời gian của Nhà khoa học dữ liệu.

Python4 giờ16 video60 bài tập5,000 XP17,991Bản xác nhận thành tích

Tạo tài khoản miễn phí của bạn

Tiếp tục với Google
hoặc
Bằng cách tiếp tục, bạn chấp nhận Điều khoản sử dụng, Chính sách quyền riêng tư và việc dữ liệu của bạn được lưu trữ tại Hoa Kỳ.

Được yêu thích bởi người học tại hàng nghìn công ty

Đào tạo một nhóm?

Dùng thử cho Doanh nghiệp →

Mô tả khóa học

Thế giới thực rất lộn xộn và nhiệm vụ của bạn là tìm ra ý nghĩa từ đó. Các bộ dữ liệu đồ chơi như MTCars và Iris là kết quả của việc tuyển chọn và làm sạch cẩn thận, nhưng ngay cả vậy dữ liệu vẫn cần được biến đổi để các thuật toán Machine Learning mạnh mẽ có thể rút trích ý nghĩa, dự báo, phân loại hoặc phân cụm. Khóa học này sẽ đi sâu vào những chi tiết thực tế mà các nhà khoa học dữ liệu dành 70–80% thời gian cho chúng: xử lý dữ liệu và xây dựng đặc trưng (feature engineering). Khi kích thước dữ liệu ngày càng lớn, hãy dùng PySpark để thu nhỏ bài toán Big Data này về mức vừa tầm!

Yêu cầu tiên quyết

Chương trình học

Đề cương khóa học

Feature Engineering với PySpark

Hoàn
thành khóa học

Nhận Giấy Chứng Nhận Hoàn Thành

Đăng ký ngay

Phát triển kỹ năng dữ liệu của bạn với DataCamp for Mobile

Tiến bộ mọi lúc mọi nơi với các khóa học di động và thử thách lập trình 5 phút mỗi ngày của chúng tôi.