Explore la modélisation des signaux neurobiologiques avec les chaînes Markov, en mettant l'accent sur l'estimation des paramètres et la classification des données.
Explore les sujets d'apprentissage avancés du renforcement, y compris les politiques, les fonctions de valeur, la récursion de Bellman et le contrôle de la TD sur les politiques.
Couvre le cours de simulations stochastiques, le modèle de file d'attente G/G/1, la finance computationnelle, les statistiques, la physique et l'inférence bayésienne.
Couvre la chaîne Markov Monte Carlo pour l'échantillonnage des distributions haute dimension, en discutant des défis, des avantages et des applications comme le problème Knapsack et la cryptographie.