Apprentissage par renforcement avec Python - Partie 1
Aucune description disponible
Contenu de la formation
90 vidéos
Introduction à la problématique de l'apprentissage par renforcement
Approche avec les équations de Bellman
Application sur un projet réel
Méthodes d'optimisation basées sur la programmation dynamique
Méthodes de Monte Carlo
Apprentissage par différences temporelles (TD Methods) - Sarsa et Q-learning
Méthodes par différences temporelles n-Step (n-step TD Methods)