Couvre les bases de travail avec les fichiers dans Python, y compris les objets de fichier, les fichiers de lecture et d'écriture, et la copie des fichiers.
Couvre les techniques de manipulation des données à l'aide de Hadoop, en se concentrant sur les bases de données axées sur les lignes et les colonnes, les formats de stockage populaires et l'intégration HBase-Hive.
Couvre les réactions complexes, les lois de vitesse, les équations différentielles et l'approximation à l'état d'équilibre pour les réactions parallèles.
Couvre les outils de science des données, Hadoop, Spark, les écosystèmes des lacs de données, le théorème CAP, le traitement par lots vs. flux, HDFS, Hive, Parquet, ORC, et l'architecture MapReduce.
Couvre les méthodes de recherche de ligne de gradient et les techniques d'optimisation en mettant l'accent sur les conditions Wolfe et la définition positive.
Couvre les bases du travail avec les fichiers texte dans la programmation C, y compris l'ouverture, la lecture, l'écriture et la fermeture des fichiers, avec des exemples et des démonstrations.
Introduit les bases de la science des données, couvrant les arbres de décision, les progrès de l'apprentissage automatique et l'apprentissage par renforcement profond.
Explore les données sur la consommation d'eau à Genève, y compris les graphiques sur la consommation et les pertes, les ensembles de données disponibles et les phases de traitement des données.