Séance de cours
Mediaspace scheduled maintenance: Aug 25, 2026 07:00 - 12:00 AM. During this time, videos will be temporarily unavailable. Check status updates.
Cette séance de cours présente l'équation de Bellman, qui relie les valeurs Q des paires état-action aux récompenses futures. Il couvre l'importance du facteur d'actualisation, le concept de récompense escomptée totale escomptée, et la cohérence de la valeur des États voisins. L'instructeur explique comment l'équation de Bellman est utilisée pour déterminer les actions optimales et les implications des différentes politiques sur la formulation de l'équation.
Network: Computation in Neural Systems', Journal of Computational Neuroscience', and `Science'.