Couvre l'apprentissage non supervisé, en mettant l'accent sur la réduction de la dimensionnalité et le regroupement, en expliquant comment il aide à trouver des modèles dans les données sans étiquettes.
Introduit des méthodes de regroupement hiérarchique et k-means, en discutant des approches de construction, des fonctions de liaison, de la méthode de Ward, de l'algorithme Lloyd et de k-means++.
Explore le centroïde, le médioïde, l'homogénéité, la séparabilité dans le clustering, l'évaluation de la qualité, la stabilité, les connaissances d'experts et les algorithmes de clustering.
Introduit la méthode k-means du noyau pour former des grappes non convexes et discute du regroupement par densité pour identifier les régions denses dans les ensembles de données.
Explore l'organisation des fichiers, les formats d'enregistrement, les techniques d'indexation et les classifications d'index dans les bases de données, en soulignant l'importance d'un stockage et d'un accès efficaces aux données.