Examine les défis que posent les hypothèses de données, les biais et d'autres aspects de la recherche, y compris les écritures incomplètes et les frustrations des nouveaux arrivants.
Couvre les meilleures pratiques et les lignes directrices pour les mégadonnées, y compris les lacs de données, l'architecture, les défis et les technologies comme Hadoop et Hive.
Explore Association Rule Mining, en mettant l'accent sur les éléments fréquents et les mesures alternatives d'intérêt, y compris l'algorithme FP-Growth et la comparaison des performances.
Explore l'analyse des données en temps réel, les défis de la croissance rapide des données, les problèmes d'estimation et la reconstruction du calendrier des événements.
Couvre les bases du traitement des flux de données, y compris des outils comme Apache Storm et Kafka, des concepts clés tels que le temps d'événement et les opérations de fenêtre, et les défis du traitement des flux.
Explore l'apprentissage automatique atomistique, intégrant les principes physiques dans les modèles pour prédire avec précision les propriétés moléculaires.
Explique les conditions d'utilisation de l'apprentissage automatique dans des problèmes complexes avec des modèles dans les données et l'accès à un ensemble de données.
Introduit le cours sur les systèmes d'information distribués, en mettant l'accent sur les concepts clés et les outils pratiques pour le traitement des données.
Couvre les défis et les opportunités de l'exploration de données, des questions pratiques, des composants d'algorithmes et des applications telles que l'analyse du panier d'achat.
Explore les archives de presse numérisées, les défis du traitement des données textuelles, les méthodologies pour le travail de groupe et l'impact sociétal des humanités numériques.