Introduit le cours d'analyse des données appliquées à l'EPFL, couvrant un large éventail de sujets d'analyse des données et mettant l'accent sur l'apprentissage continu en sciences des données.
Couvre l'essentiel de la science des données, y compris le traitement, la visualisation et l'analyse des données, en mettant l'accent sur les compétences pratiques et l'engagement actif.
Explore l'évolution de l'analyse des données à l'IA et au ML, en mettant l'accent sur les mégadonnées, l'apprentissage automatique et l'interaction avec les médias sociaux.
Couvre les meilleures pratiques et les lignes directrices pour les mégadonnées, y compris les lacs de données, l'architecture, les défis et les technologies comme Hadoop et Hive.
Couvre la calorimétrie isotherme, une méthode pour mesurer le taux de production de chaleur dans des matériaux comme le ciment, en discutant de son importance et de ses applications pratiques.
Explore les techniques de mesure structurelle, en mettant l'accent sur la sécurité, les approches systématiques et l'interprétation des données au fil du temps, en utilisant l'étude de cas Riddes ponts.
Couvre les méthodes de projection d'images pour simplifier l'interprétation multidimensionnelle des données à l'aide d'opérations telles que la projection d'intensité maximale et les filtres.
Examine les éléments fondamentaux de la gestion des données, y compris les modèles, les sources et les querelles, en soulignant l'importance de comprendre et de résoudre les problèmes de données.
Examine les défis que posent les hypothèses de données, les biais et d'autres aspects de la recherche, y compris les écritures incomplètes et les frustrations des nouveaux arrivants.
Introduit les principes fondamentaux du traitement des données, soulignant l'importance des Pandas et de la modélisation des données pour une analyse efficace.
Couvre les concepts fondamentaux en probabilité et en statistiques, en mettant l'accent sur les techniques d'analyse de données et la modélisation statistique.
Examine la distinction entre association et lien de causalité dans l'analyse statistique, en soulignant les limites de l'association dans l'inferration de lien de causalité.
Discute des techniques avancées d'optimisation Spark pour gérer efficacement les Big Data, en se concentrant sur la parallélisation, les opérations de mélange et la gestion de la mémoire.