Séance de cours
Mediaspace scheduled maintenance: Aug 25, 2026 07:00 - 12:00 AM. During this time, videos will be temporarily unavailable. Check status updates.
Cette séance de cours présente les méthodes de gradient de politique en utilisant un exemple simple d'un seul neurone avec une sortie binaire. La séance de cours explique comment associer des actions à des stimuli, optimiser directement les récompenses et changer le poids des neurones pour maximiser les récompenses attendues.
Network: Computation in Neural Systems', Journal of Computational Neuroscience', and `Science'.