Introduit les bases de l'apprentissage automatique, en mettant l'accent sur l'utilisation de Piazza pour les communications liées à la classe et les exercices pratiques en Python.
Couvre les concepts clés de l'apprentissage par renforcement, des réseaux neuronaux, du clustering et de l'apprentissage non supervisé, en mettant l'accent sur leurs applications et leurs défis.
Explore les sujets d'apprentissage avancés du renforcement, y compris les politiques, les fonctions de valeur, la récursion de Bellman et le contrôle de la TD sur les politiques.
Explore les bases des réseaux neuraux, le problème XOR, la classification et les applications pratiques comme la prévision des données météorologiques.
Introduit une régression linéaire et logistique, couvrant les modèles paramétriques, la prédiction multi-sorties, la non-linéarité, la descente de gradient et les applications de classification.
Présente la régularisation Lasso et son application à l'ensemble de données MNIST, en mettant l'accent sur la sélection des fonctionnalités et les exercices pratiques sur la mise en œuvre de la descente en gradient.