Couvre les défis des systèmes d'information distribués, y compris l'autonomie, l'hétérogénéité, l'évaluation de la confiance et la protection de la vie privée.
Introduit des concepts de modélisation de données, l'utilisation de SQL et des applications de bibliothèque Pandas pour un traitement efficace des données.
Examine les éléments fondamentaux de la gestion des données, y compris les modèles, les sources et les querelles, en soulignant l'importance de comprendre et de résoudre les problèmes de données.
Couvre les meilleures pratiques et les lignes directrices pour les mégadonnées, y compris les lacs de données, l'architecture, les défis et les technologies comme Hadoop et Hive.
Couvre les cadres de données Spark, les collections distribuées de données organisées en colonnes nommées, et les avantages de les utiliser sur les DDR.
Explore la définition et les composants des systèmes d'information, en mettant l'accent sur leur rôle dans la collecte, le traitement et la distribution de l'information.
Couvre la vue d'ensemble des systèmes d'information, la modélisation des données, la gestion des données et la distinction entre les données et l'information.
Couvre les fondements des systèmes de base de données, y compris la modélisation des données, le traitement de l'information et les défis de la gestion d'importants volumes de données.
Introduit le cours sur les systèmes d'information, couvrant sa structure, ses objectifs et ses concepts fondamentaux essentiels à la compréhension de la gestion des données et de la prise de décision.
Discute de la représentation des données au moyen de modèles et de systèmes, couvrant les modèles mathématiques, les structures de données, les niveaux de modélisation et la gestion des données.
Couvre les systèmes d'information distribués, y compris les principaux défis et l'évaluation de la qualité, de la confiance et de la confidentialité de l'information.