Introduit le cours d'analyse des données appliquées à l'EPFL, couvrant un large éventail de sujets d'analyse des données et mettant l'accent sur l'apprentissage continu en sciences des données.
Couvre l'essentiel de la science des données, y compris le traitement, la visualisation et l'analyse des données, en mettant l'accent sur les compétences pratiques et l'engagement actif.
Examine les défis que posent les hypothèses de données, les biais et d'autres aspects de la recherche, y compris les écritures incomplètes et les frustrations des nouveaux arrivants.
Explore l'évolution de l'analyse des données à l'IA et au ML, en mettant l'accent sur les mégadonnées, l'apprentissage automatique et l'interaction avec les médias sociaux.
Couvre la calorimétrie isotherme, une méthode pour mesurer le taux de production de chaleur dans des matériaux comme le ciment, en discutant de son importance et de ses applications pratiques.
Couvre les meilleures pratiques et les lignes directrices pour les mégadonnées, y compris les lacs de données, l'architecture, les défis et les technologies comme Hadoop et Hive.
Examine les éléments fondamentaux de la gestion des données, y compris les modèles, les sources et les querelles, en soulignant l'importance de comprendre et de résoudre les problèmes de données.
Explore les techniques de mesure structurelle, en mettant l'accent sur la sécurité, les approches systématiques et l'interprétation des données au fil du temps, en utilisant l'étude de cas Riddes ponts.
Couvre les méthodes de projection d'images pour simplifier l'interprétation multidimensionnelle des données à l'aide d'opérations telles que la projection d'intensité maximale et les filtres.
Introduit les principes fondamentaux du traitement des données, soulignant l'importance des Pandas et de la modélisation des données pour une analyse efficace.
Couvre les concepts fondamentaux en probabilité et en statistiques, en mettant l'accent sur les techniques d'analyse de données et la modélisation statistique.
Discute des techniques avancées d'optimisation Spark pour gérer efficacement les Big Data, en se concentrant sur la parallélisation, les opérations de mélange et la gestion de la mémoire.