Couvre les outils de science des données, Hadoop, Spark, les écosystèmes des lacs de données, le théorème CAP, le traitement par lots vs. flux, HDFS, Hive, Parquet, ORC, et l'architecture MapReduce.
Présente les bases du traitement de données textuelles, couvrant la récupération de documents, la classification, l'analyse des sentiments et la détection de sujets.
Déplacez-vous dans le « virage numérique » de l'histoire, en examinant la recherche historique à l'aide de journaux numérisés et en explorant la réutilisation du texte, l'intégration des mots et la visualisation des données.
Explore les données sur la consommation d'eau à Genève, y compris les graphiques sur la consommation et les pertes, les ensembles de données disponibles et les phases de traitement des données.
Introduit les bases de la science des données, couvrant les arbres de décision, les progrès de l'apprentissage automatique et l'apprentissage par renforcement profond.
Déplacez-vous dans la culture, une approche computationnelle de l'étude des tendances culturelles par l'analyse quantitative des données textuelles numérisées.
Explore la pratique de l'histoire à l'aide de sources numérisées et numériques nées, heuristique, critique, synthèse et big data pour l'analyse historique.
Explore l'histoire numérique et l'analyse de la presse, en mettant l'accent sur l'impact des outils numériques sur la diffusion des connaissances et la recherche historique.
Couvre le système logiciel Canalflow pour l'analyse numérique du flux de fluide incompressible dans les géométries des canaux, y compris les méthodes spectrales et les solutions invariantes.
Explore l'analyse micro-architecturale de DBMS moderne, en mettant l'accent sur l'optimisation des performances et l'atténuation du décrochage des caches de données.
Couvre les règles d'association minière, se concentrant sur les algorithmes de croissance d'Apriori et de FP pour trouver des itemset fréquents et extraire les règles efficacement.