Couvre les statistiques descriptives, les tests d'hypothèses et l'analyse de corrélation avec diverses distributions de probabilités et des statistiques robustes.
Plongez dans l'importance des fonctionnalités, de l'évolution des modèles, des défis d'étiquetage et de la sélection des modèles dans l'apprentissage automatique.
Explore les méthodes de clustering K-means et DBSCAN, en discutant des propriétés, des inconvénients, de l'initialisation et de la sélection optimale des clusters.
Présente les bases du traitement de données textuelles, couvrant la récupération de documents, la classification, l'analyse des sentiments et la détection de sujets.
Explore la gestion du texte, en se concentrant sur les matrices, les documents et les sujets, y compris les défis de la classification des documents et des modèles avancés comme BERT.
Couvre la réplication de l'analyse de données à partir d'articles scientifiques et propose des extensions créatives pour améliorer les compétences en méta-science des données.
Explore la couverture des conflits armés dans les nouvelles en ligne, en analysant l'attention des médias et la gravité des conflits dans toutes les langues.
Se concentre sur le projet final, guidant les étudiants sur la création d'une histoire de données et d'un pitch vidéo pour leur analyse d'extension créative.
Couvre les principes fondamentaux de la science des données, l'évolution des méthodes scientifiques, le rôle d'un data scientist et l'importance des données en tant que nouveau pétrole.