Classification et catégorisation de documentsLa classification et catégorisation de documents est l'activité du traitement automatique des langues naturelles qui consiste à classer de façon automatique des ressources documentaires, généralement en provenance d'un corpus. Cette classification peut prendre une infinité de formes. On citera ainsi la classification par genre, par thème, ou encore par opinion. La tâche de classification est réalisée avec des algorithmes spécifiques, mis en œuvre par des systèmes de traitement de l'information.
Classification en classes multiplesIn machine learning and statistical classification, multiclass classification or multinomial classification is the problem of classifying instances into one of three or more classes (classifying instances into one of two classes is called binary classification). While many classification algorithms (notably multinomial logistic regression) naturally permit the use of more than two classes, some are by nature binary algorithms; these can, however, be turned into multinomial classifiers by a variety of strategies.
Coût irrécupérableEn économie comportementale et dans l'analyse de la décision, les coûts irrécupérables (sunk cost en anglais) sont les coûts qui ont déjà été payés définitivement ; ils ne sont ni remboursables, ni récupérables par un autre moyen. La distinction avec les autres coûts est importante pour les scénarios où l'on envisage, ou bien où l'on craint de subir, de renoncer à, ou de ne plus être en mesure d'utiliser ce qu'ils ont servi à acquérir.
DonnéeUne donnée est ce qui est connu et qui sert de point de départ à un raisonnement ayant pour objet la détermination d'une solution à un problème en relation avec cette donnée. Cela peut être une description élémentaire qui vise à objectiver une réalité, le résultat d'une comparaison entre deux événements du même ordre (mesure) soit en d'autres termes une observation ou une mesure. La donnée brute est dépourvue de tout raisonnement, supposition, constatation, probabilité.
Modèle de donnéesEn informatique, un modèle de données est un modèle qui décrit la manière dont sont représentées les données dans une organisation métier, un système d'information ou une base de données. Le terme modèle de données peut avoir deux significations : Un modèle de données théorique, c'est-à-dire une description formelle ou un modèle mathématique. Voir aussi modèle de base de données Un modèle de données instance, c'est-à-dire qui applique un modèle de données théorique (modélisation des données) pour créer un modèle de données instance.
Qualité des donnéesLa qualité des données, en informatique se réfère à la conformité des données aux usages prévus, dans les modes opératoires, les processus, les prises de décision, et la planification (J.M. Juran). De même, les données sont jugées de grande qualité si elles représentent correctement la réalité à laquelle elles se réfèrent. Ces deux points de vue peuvent souvent entrer en contradiction, y compris lorsqu'un même ensemble de données est utilisé avec un objectif commun.
Coût d'opportunitéLe coût d'opportunité (de l'anglais opportunity cost), également appelé coût d'option, coût alternatif, coût de substitution, coût de renonciation ou encore coût de renoncement désigne la perte des biens auxquels on renonce lorsqu'on procède à un choix, autrement dit lorsqu'on affecte les ressources disponibles à un usage donné au détriment d'autres choix. C'est le coût d'une chose estimé en termes d'opportunités non réalisées, ou encore la valeur de la meilleure autre option non réalisée.