Reinforcement Learning from Human Feedback (RLHF)

AvancéNiveau de compétence

Actualisé 10/2024

Découvrez comment créer des modèles GenAI qui reflètent les valeurs humaines tout en acquérant une expérience pratique avec des LLM avancés.

Description du cours

Alliez l’efficacité de l’IA générative à la compréhension de l’expertise humaine dans ce cours sur le Reinforcement Learning from Human Feedback. Vous apprendrez à faire en sorte que les modèles de GenAI reflètent réellement les valeurs et préférences humaines, tout en vous exerçant concrètement avec des LLM. Vous aborderez aussi les subtilités des modèles de récompense et verrez comment tirer parti des LLM pour créer une IA qui non seulement apprend, mais s’adapte aussi aux situations réelles.

Prérequis

Deep Reinforcement Learning in Python

Foundational Concepts

This chapter introduces the basics of Reinforcement Learning with Human Feedback (RLHF), a technique that uses human input to help AI models learn more effectively. Get started with RLHF by understanding how it differs from traditional reinforcement learning and why human feedback can enhance AI performance in various domains.

Description du cours

Obtenez un certificat de réussite

Rejoignez plus de .css-nklxlk{color:var(--wf-brand--main, #03EF62);}19 millions d'utilisateurs et commencez Reinforcement Learning from Human Feedback (RLHF) dès aujourd'hui !

Créez votre compte gratuitement

Apprenez où que vous soyez avec l'application DataCamp

Rejoignez plus de 19 millions d'utilisateurs et commencez Reinforcement Learning from Human Feedback (RLHF) dès aujourd'hui !