Couvre les méthodes de prédiction sans modèle dans l'apprentissage par renforcement, en se concentrant sur Monte Carlo et les différences temporelles pour estimer les fonctions de valeur sans connaissance de la dynamique de transition.
Explore la découverte de modules composites dans le méta-apprentissage, en mettant l'accent sur les cadres d'apprentissage automatique flexibles et le rôle des biais inductifs.