Explore l'algorithme de modularité de Louvain pour optimiser la qualité de la communauté grâce à la modularité et ses applications dans l'analyse des réseaux sociaux.
Introduit l'algorithme de Girvan-Newman pour la décomposition de réseau basée sur l'entrelacement de bord et démontre son application dans les collaborations de physique.
Explorez des données semi-structurées, intégrez des informations de schéma pour expliquer les valeurs et les relations des données, discutez du XML, des avantages des données sans schéma et de la sérialisation.
Présente les bases de la récupération d'informations, couvrant la récupération basée sur le texte, les caractéristiques du document, les fonctions de similarité et la différence entre la récupération booléenne et la récupération classée.
Explore les ontologies populaires et les bases de connaissances telles que WordNet, WikiData, Google Knowledge Graph et Schema.org, ainsi que les ensembles de données ouvertes liées.
Couvre l'extraction de phrases clés, une méthode pour extraire des phrases importantes du texte pour la synthèse, l'indexation et la recherche de documents.
Explore les approches d'extraction d'informations telles que les modèles écrits à la main et la supervision à distance, avec des exemples de paires d'entités correspondant à des modèles.
Couvre les concepts de base de la récupération d'informations textuelles et la façon dont les documents sont indexés et récupérés en fonction des requêtes des utilisateurs.
Explore la désambiguïsation des entités, reliant les mentions de texte à une base de connaissances, la cohérence dans les graphes d'entités et le PageRank personnalisé.