Présente les bases de la récupération d'informations, couvrant la récupération basée sur le texte, les caractéristiques du document, les fonctions de similarité et la différence entre la récupération booléenne et la récupération classée.
Explore les algorithmes et les techniques d'extraction de l'information, y compris l'algorithme Viterbi, la reconnaissance des entités nommées, et la surveillance lointaine.
Explore les méthodes d'extraction de l'information, y compris les approches traditionnelles et fondées sur l'intégration, l'apprentissage supervisé, la surveillance à distance et l'induction taxonomique.
Introduit le cours sur les systèmes d'information, couvrant sa structure, ses objectifs et ses concepts fondamentaux essentiels à la compréhension de la gestion des données et de la prise de décision.
Couvre les techniques d'apprentissage supervisées et non supervisées dans l'apprentissage automatique, en mettant en évidence leurs applications dans la finance et l'analyse environnementale.
Couvre des modèles thématiques, en se concentrant sur l'allocation de Dirichlet latente, le regroupement, les MGM, la distribution de Dirichlet, l'apprentissage LDA et les applications en humanités numériques.
Couvre les concepts de base de la récupération d'informations textuelles et la façon dont les documents sont indexés et récupérés en fonction des requêtes des utilisateurs.
Couvre les solutions les moins carrées pour les systèmes linéaires utilisant des opérations matricielles et des systèmes normaux, illustrés par des exemples.