Ir al contenido principal

Curso

Aprendizaje profundo por refuerzo en Python

Avanzado4 h

Aprende y utiliza potentes algoritmos de Aprendizaje Profundo por Refuerzo, incluyendo técnicas de refinamiento y optimización.

Python4 h15 vídeos49 ejercicios4,050 XP5,775Certificado de logro

Crea tu cuenta gratis

Continuar con Google
o
Al continuar, aceptas nuestros los Términos de uso, nuestro la Política de privacidad y que tus datos se almacenan en EE. UU.

Les encanta a estudiantes de miles de empresas

¿Formando a un equipo?

Prueba para empresas

Descripción del curso

Descubre las técnicas de vanguardia que permiten a las máquinas aprender e interactuar con su entorno. Te sumergirás en el mundo del Aprendizaje por Refuerzo Profundo (DRL) y adquirirás experiencia práctica con los algoritmos más potentes que hacen avanzar este campo. Utilizarás PyTorch y el entorno Gymnasium para construir tus propios agentes.

Domina los fundamentos del aprendizaje profundo por refuerzo

Nuestro viaje comienza con los fundamentos del DRL y su relación con el Aprendizaje por Refuerzo tradicional. A partir de ahí, pasamos rápidamente a implementar Deep Q-Networks (DQN) en PyTorch, incluyendo refinamientos avanzados como Double DQN y Prioritized Experience Replay para potenciar tus modelos.Lleva tus habilidades al siguiente nivel explorando métodos basados en políticas. Aprenderás y aplicarás técnicas esenciales de gradiente de políticas, como los métodos REINFORCE y Actor-Crítico.

Utiliza algoritmos de vanguardia

Te encontrarás con potentes algoritmos DRL de uso común en la industria actual, incluida la Optimización de la Política Próxima (PPO). Adquirirás experiencia práctica con las técnicas que impulsan los avances en robótica, IA de juegos y mucho más. Por último, aprenderás a optimizar tus modelos utilizando Optuna para el ajuste de hiperparámetros.Al final de este curso, habrás adquirido los conocimientos necesarios para aplicar estas técnicas de vanguardia a problemas del mundo real y aprovechar todo el potencial de DRL.

Requisitos previos

Programa de formación

Contenido del curso

2

Aprendizaje Q profundo

Sumérgete en el Aprendizaje Q Profundo implementando el algoritmo original DQN, que incluye la Repetición de Experiencias, la gradación épsilon y los objetivos Q fijos. Más allá de DQN, explorarás dos fascinantes extensiones que mejoran el rendimiento y la estabilidad del aprendizaje Q profundo: Doble DQN y Repetición de Experiencias Priorizadas.
Empezar capítulo
3

Introducción a los métodos de gradiente político

Conoce los conceptos fundamentales de los métodos de gradiente político que se encuentran en DRL. Empezarás con el teorema del gradiente político, que constituye la base de estos métodos. A continuación, pondrás en práctica el algoritmo REINFORCE, un potente método de aprendizaje de políticas. A continuación, el capítulo te guiará a través de los métodos Actor-Crítico, centrándose en el algoritmo Actor-Crítico de Ventaja (A2C), que combina los puntos fuertes de los métodos basados en el gradiente de la política y en el valor para mejorar la eficacia y la estabilidad del aprendizaje.
Empezar capítulo
4

Optimización de la Política Proximal y Consejos DRL

Explora la Optimización de la Política Proximal (PPO) para un rendimiento sólido de DRL. A continuación, examinarás el uso de un bono de entropía en PPO, que fomenta la exploración evitando la convergencia prematura a políticas deterministas. También aprenderás sobre las actualizaciones por lotes en los métodos de gradiente de política. Por último, aprenderás sobre la optimización de hiperparámetros con Optuna, una potente herramienta para optimizar el rendimiento de tus modelos DRL.
Empezar capítulo

Aprendizaje profundo por refuerzo en Python

Curso
completado

Obtén el certificado de logro

Inscríbete ahora

Desarrolla tus habilidades con la aplicación móvil de DataCamp

Progresa sobre la marcha con nuestros cursos móviles y desafíos diarios de 5 minutos.