Chuyển đến nội dung chính

Khóa học

Web Scraping với Python

Trung cấp4 giờ

Học cách truy xuất và phân tích thông tin từ internet bằng thư viện Python scrapy.

Python4 giờ17 video56 bài tập4,500 XP93,529Giấy chứng nhận thành tích

Tạo tài khoản miễn phí

Tiếp tục với Google
hoặc
Bằng việc tiếp tục, ban chấp nhận Điều khoản sử dụng, của chúng tôi Chính sách bảo mật và rằng dữ liệu của bạn được lưu trữ tại Hoa Kỳ.

Được người học tại hàng nghìn công ty yêu thích

Đào tạo đội ngũ?

Dùng thử cho Doanh nghiệp

Mô tả khóa học

Khả năng xây dựng các công cụ để truy xuất và phân tích thông tin trên internet đã, đang và sẽ tiếp tục rất hữu ích trong nhiều nhánh của khoa học dữ liệu. Trong khóa học này, bạn sẽ học cách điều hướng và phân tích mã HTML, và xây dựng công cụ để tự động thu thập dữ liệu từ website. Mặc dù chúng ta sẽ thực hành scraping bằng thư viện Python linh hoạt là scrapy, nhiều kỹ thuật bạn học được cũng có thể áp dụng cho các thư viện Python phổ biến khác như BeautifulSoup và Selenium. Sau khi hoàn thành khóa học, bạn sẽ có mô hình tư duy vững chắc về cấu trúc HTML, có thể xây dựng công cụ để phân tích mã HTML và truy cập thông tin mong muốn, và tạo các spider scrapy đơn giản để thu thập dữ liệu web ở quy mô lớn.

Yêu cầu tiên quyết

Chương trình học

Đề cương khóa học

1

Giới thiệu về HTML

Tìm hiểu cấu trúc của HTML. Chúng ta bắt đầu bằng việc giải thích vì sao web scraping là một bổ sung giá trị cho bộ công cụ khoa học dữ liệu của bạn, rồi đi vào các kiến thức cơ bản về HTML. Cuối chương, chúng ta sẽ giới thiệu ngắn gọn về cú pháp XPath, dùng để điều hướng các phần tử trong mã HTML.
Bắt đầu chương
3

CSS Locator, Chaining và Response

Web Scraping với Python

Hoàn
thành khóa học

Nhận Chứng nhận Hoàn thành

Đăng ký ngay

Phát triển kỹ năng dữ liệu với DataCamp for Mobile

Tiến bộ mọi lúc mọi nơi với các khóa học di động và thử thách lập trình 5 phút hàng ngày.