Explore les sujets d'apprentissage avancés du renforcement, y compris les politiques, les fonctions de valeur, la récursion de Bellman et le contrôle de la TD sur les politiques.
Couvertures Modèles linéaires généralisés, probabilité, déviance, fonctions de liaison, méthodes d'échantillonnage, régression de Poisson, surdispersion et modèles de régression alternatifs.
Couvre la probabilité appliquée, les chaînes de Markov et les processus stochastiques, y compris les matrices de transition, les valeurs propres et les classes de communication.
Explore les techniques de réduction de la variance dans la simulation stochastique, en mettant l'accent sur l'utilisation de variables aléatoires auxiliaires et de moyennes d'échantillons pour améliorer l'efficacité.