Explore les forêts aléatoires en tant que méthode d'ensemble puissante pour la classification, en discutant des stratégies d'ensachage, d'empilage, de renforcement et d'échantillonnage.
Introduit des arbres de décision pour la classification, couvrant l'entropie, la qualité fractionnée, l'indice Gini, les avantages, les inconvénients, et le classificateur forestier aléatoire.
Les couvertures comportent des méthodes d'extraction, de regroupement et de classification pour les ensembles de données de grande dimension et l'analyse comportementale utilisant PCA, t-SNE, k-means, GMM et divers algorithmes de classification.
Explore les caractéristiques de la distribution normale, les scores Z, la probabilité dans les statistiques inférentielles, les effets d'échantillon et l'approximation de la distribution binomiale.
Introduit des statistiques inférentielles, couvrant l'échantillonnage, la tendance centrale, la dispersion, les histogrammes, les scores z et la distribution normale.