Chuyển đến nội dung chính

Khóa học

Deep Reinforcement Learning bằng Python

Nâng cao4 giờ

Python4 giờ15 video49 bài tập4,050 XP5,780Giấy chứng nhận thành tích

Tạo tài khoản miễn phí

Tiếp tục với Google
hoặc
Bằng việc tiếp tục, ban chấp nhận Điều khoản sử dụng, của chúng tôi Chính sách bảo mật và rằng dữ liệu của bạn được lưu trữ tại Hoa Kỳ.

Được người học tại hàng nghìn công ty yêu thích

Đào tạo đội ngũ?

Dùng thử cho Doanh nghiệp

Mô tả khóa học

Bắt đầu hành trình giúp máy học thông minh hơn với Deep Reinforcement Learning (DRL). Khóa học này mang đến trải nghiệm thực hành với các thuật toán mạnh mẽ sử dụng PyTorch và Gymnasium. Khởi động với nền tảng DRL và Reinforcement Learning truyền thống, sau đó bạn sẽ hiện thực hóa Deep Q-Networks (DQN) kèm các cải tiến nâng cao như Prioritized Experience Replay. Nâng tầm kỹ năng với các phương pháp dựa trên policy và khám phá các thuật toán tiêu chuẩn trong ngành như Proximal Policy Optimization (PPO) trước khi tối ưu mô hình bằng Optuna.

Yêu cầu tiên quyết

Chương trình học

Đề cương khóa học

3

Giới thiệu về các phương pháp Policy Gradient

Tìm hiểu các khái niệm nền tảng của phương pháp policy gradient trong DRL. Bạn sẽ bắt đầu với định lý policy gradient, nền tảng của các phương pháp này. Sau đó, bạn sẽ triển khai thuật toán REINFORCE, một cách tiếp cận mạnh mẽ để học policy. Chương này sẽ hướng dẫn bạn qua các phương pháp Actor-Critic, tập trung vào thuật toán Advantage Actor-Critic (A2C), kết hợp điểm mạnh của cả policy gradient và phương pháp dựa trên giá trị để tăng hiệu quả và ổn định khi học.
Bắt đầu chương
4

Proximal Policy Optimization và các mẹo DRL

Khám phá Proximal Policy Optimization (PPO) để đạt hiệu năng DRL vững chắc. Tiếp theo, bạn sẽ tìm hiểu việc dùng entropy bonus trong PPO, giúp khuyến khích khám phá bằng cách ngăn hội tụ sớm vào các policy tất định. Bạn cũng sẽ học về cập nhật theo lô (batch) trong các phương pháp policy gradient. Cuối cùng, bạn sẽ tìm hiểu cách tối ưu siêu tham số với Optuna, một công cụ mạnh mẽ để tối ưu hiệu năng cho các mô hình DRL của bạn.
Bắt đầu chương

Deep Reinforcement Learning bằng Python

Hoàn
thành khóa học

Nhận Chứng nhận Hoàn thành

Đăng ký ngay

Phát triển kỹ năng dữ liệu với DataCamp for Mobile

Tiến bộ mọi lúc mọi nơi với các khóa học di động và thử thách lập trình 5 phút hàng ngày.