Couvre les techniques de manipulation des données à l'aide de Hadoop, en se concentrant sur les bases de données axées sur les lignes et les colonnes, les formats de stockage populaires et l'intégration HBase-Hive.
Explore la motivation et les avantages de l'utilisation des GPU pour le calcul, en se concentrant sur leurs performances et leur programmation via CUDA.
Discute des techniques avancées d'optimisation Spark pour gérer efficacement les Big Data, en se concentrant sur la parallélisation, les opérations de mélange et la gestion de la mémoire.
Couvre les cadres de données Spark, les collections distribuées de données organisées en colonnes nommées, et les avantages de les utiliser sur les DDR.
Couvre les techniques d'optimisation dans l'apprentissage automatique, en se concentrant sur la convexité et ses implications pour une résolution efficace des problèmes.
Couvre efficacement l'optimisation de joint accéléré GPU pour les requêtes complexes, en se concentrant sur l'amélioration des temps d'optimisation et de la qualité du plan heuristique.
Discute des modèles de traitement des requêtes et des opérations relationnelles, en se concentrant sur les sélections, les projections et les jointures dans les systèmes à forte intensité de données.
Couvre l'optimisation des requêtes relationnelles, y compris les plans de requêtes logiques et physiques, l'estimation des coûts, les équivalences et la stratégie du système R.
Introduit le modèle relationnel et l'algèbre, essentiels pour comprendre les systèmes à forte intensité de données et la gestion efficace des bases de données.
Explore les opérations de traitement des requêtes, les conditions d'adhésion, les opérations définies et l'impact de tampon sur les performances des requêtes.
Introduit le modèle relationnel, SQL, les clés, les contraintes d'intégrité, la traduction ER, les entités faibles, les hiérarchies ISA et SQL vs. noSQL.
Introduit le modèle relationnel et l'algèbre relationnelle, en se concentrant sur SQL et ses opérations pour une gestion efficace des bases de données.
Explore l'optimisation des requêtes basée sur les coûts dans les systèmes de base de données, couvrant l'estimation des coûts, l'estimation de la sélectivité, et rejoindre la cardinalité.