Séance de cours
Mediaspace scheduled maintenance: Aug 25, 2026 07:00 - 12:00 AM. During this time, videos will be temporarily unavailable. Check status updates.
Cette séance de cours couvre l'importance des mini-batches dans l'apprentissage par renforcement profond, expliquant comment éviter la corrélation de données en utilisant des tampons de relecture ou plusieurs acteurs. Il aborde les méthodes on-policy et off-policy, telles que Q-Learning et Advantage Actor-Critic, ainsi que les avantages et les inconvénients de chaque approche.
Network: Computation in Neural Systems', Journal of Computational Neuroscience', and `Science'.