Explore les classes communicantes dans les chaînes de Markov, en distinguant les classes transitoires et récurrentes, et approfondit les propriétés de ces classes.
Couvre les bases de l'apprentissage du renforcement, y compris les processus décisionnels de Markov et les méthodes de gradient des politiques, et explore les applications du monde réel et les avancées récentes.
Présente les chaînes de Markov, couvrant les bases, les algorithmes de génération et les applications dans les promenades aléatoires et les processus de Poisson.
Explore l'optimisation de portefeuille robuste sur le plan de la distribution et compare différentes approches et méthodes d'estimation pour l'évaluation de portefeuille.