Apprentissage par renforcement avec Python - Partie 2

Alexandre Bourrieau Français 10h 54min Udemy 85 vidéos

Aucune description disponible

Contenu de la formation
85 vidéos
Prédiction de type on-policy par approximations
Construction des fonctions d'approximations linéaires
Approximation des fonctions non linéaires avec les réseaux neuronaux artificiels
Contrôle de type on-policy par approximations
Contrôle on-policy Deep-Sarsa (Méthode Sarsa avec les réseaux de neurones)
Méthodes off-policy avec approximations
Contrôle off-policy Deep Q-learning