Plongez dans le Big Data historique, en explorant les régimes d'accélération des données et les défis de la re-documentation des jeux de données passés.
Couvre les techniques de manipulation des données à l'aide de Hadoop, en se concentrant sur les bases de données axées sur les lignes et les colonnes, les formats de stockage populaires et l'intégration HBase-Hive.
Couvre les optimisations avancées de Spark, la gestion de la mémoire, les opérations de brassage et les stratégies de partitionnement des données pour améliorer l'efficacité du traitement des données volumineuses.
Introduit les bases de la science des données, couvrant les arbres de décision, les progrès de l'apprentissage automatique et l'apprentissage par renforcement profond.
Explore les défis liés à la manipulation de grandes tailles de données dans l'informatique distribuée et discute des techniques de dégroupage et des stratégies de gestion des défaillances.
Déplacez-vous dans le « virage numérique » de l'histoire, en examinant la recherche historique à l'aide de journaux numérisés et en explorant la réutilisation du texte, l'intégration des mots et la visualisation des données.
Explore les défis du big data, les caractéristiques, les techniques de dégroupage et les stratégies de gestion des défaillances dans le traitement et la gestion des données.
Couvre les principes fondamentaux de l'apprentissage profond, y compris les données, l'architecture et les considérations éthiques dans le déploiement de modèles.