Explore la fraude scientifique, l'intégrité, les cas d'inconduite, les lignes directrices et les cadres institutionnels pour l'intégrité de la recherche.
Couvre Nexus Fusion, une plateforme pour la découverte collaborative de données et de connaissances, y compris la gestion des données, la présentation et la recherche.
Se penche sur l'utilisation des systèmes d'information géographique dans les interventions d'urgence, en soulignant l'importance de données géographiques précises et accessibles.
Explore Apache Hive pour l'entreposage de données, les formats de données et la partition, avec des exercices pratiques dans la requête et la connexion à Hive.
Plonge dans les défis de la publication de données sur les humanités numériques et l'importance des principes de données FAIR pour la gestion des données scientifiques.
Examine la façon dont l'IA/ML façonne le futur lieu de travail, en mettant l'accent sur les systèmes et les processus d'entreprise, et discute de l'état actuel de l'adoption de l'IA/ML dans les entreprises.
Couvre la mise en œuvre d'un système d'information pour la gestion des trajectoires de taxi, y compris le filtrage des données, la création de modèles de trajectoire et la comparaison des performances.
Couvre les meilleures pratiques et les lignes directrices pour les mégadonnées, y compris les lacs de données, l'architecture, les défis et les technologies comme Hadoop et Hive.
Couvre les fondamentaux des écosystèmes de big data, en se concentrant sur les technologies, les défis et les exercices pratiques avec le HDFS d'Hadoop.
Explore les techniques de résolution d'entités, la déduplication des données, les métriques de similitude, le coût de calcul, les techniques de blocage et l'échelle des jointures de similarité.