Examine les méthodes de regroupement pour la partition des données en classes significatives lorsque l'étiquetage est inconnu, couvrant les moyennes K, les mesures de dissimilarité et le regroupement hiérarchique.
Couvre les concepts de lunettes de spin et d'estimation bayésienne, en se concentrant sur l'observation et la déduction de l'information d'un système de près.
Couvre les techniques de réduction de dimensionnalité telles que PCA et LDA, les méthodes de clustering, l'estimation de la densité et la représentation des données.
Introduit des méthodes de regroupement hiérarchique et k-means, en discutant des approches de construction, des fonctions de liaison, de la méthode de Ward, de l'algorithme Lloyd et de k-means++.
Explore le regroupement hiérarchique, les dendrogrammes et diverses fonctions de liaison pour l'agglomération de grappes en fonction de mesures de distance.
Explore l'indexation dans les systèmes de base de données, couvrant le stockage, les fichiers, et des techniques efficaces de récupération de données utilisant différents types d'index.