Couvre les défis posés par les données à haute dimension, la nécessité de réduire la dimensionnalité et les implications pour les modèles d'apprentissage automatique.
Introduit la modélisation fondée sur les données en mettant l'accent sur la régression, couvrant la régression linéaire, les risques de raisonnement inductif, l'APC et la régression des crêtes.