Transformeurvignette|Schéma représentant l'architecture générale d'un transformeur. Un transformeur (ou modèle auto-attentif) est un modèle d'apprentissage profond introduit en 2017, utilisé principalement dans le domaine du traitement automatique des langues (TAL). Dès 2020, les transformeurs commencent aussi à trouver une application en matière de vision par ordinateur par la création des vision transformers (ViT).
Transformeur génératif pré-entraînédroite|vignette| Architecture du modèle GPT Le transformeur génératif pré-entraîné (ou GPT, de l’anglais generative pre-trained transformer) est une famille de modèles de langage généralement formée sur un grand corpus de données textuelles pour générer un texte de type humain. Il est construit en utilisant plusieurs blocs de l'architecture du transformeur. Ils peuvent être affinés pour diverses tâches de traitement du langage naturel telles que la génération de texte, la traduction de langue et la classification de texte.
ChatGPTChatGPT () est un prototype d'agent conversationnel utilisant l'intelligence artificielle, développé par OpenAI et spécialisé dans le dialogue. L'agent conversationnel de ChatGPT repose sur les technologies du traitement automatique des langues (NLP), des grands modèles de langage (LLM) et des chatbots. Il est issu du modèle de langage GPT d'OpenAI, et est affiné en continu grâce à l'utilisation de techniques d'apprentissage supervisé et d'apprentissage par renforcement.
Text-to-image modelA text-to-image model is a machine learning model which takes an input natural language description and produces an image matching that description. Such models began to be developed in the mid-2010s, as a result of advances in deep neural networks. In 2022, the output of state of the art text-to-image models, such as OpenAI's DALL-E 2, Google Brain's , StabilityAI's Stable Diffusion, and Midjourney began to approach the quality of real photographs and human-drawn art.
Attention (machine learning)Machine learning-based attention is a mechanism mimicking cognitive attention. It calculates "soft" weights for each word, more precisely for its embedding, in the context window. It can do it either in parallel (such as in transformers) or sequentially (such as recursive neural networks). "Soft" weights can change during each runtime, in contrast to "hard" weights, which are (pre-)trained and fine-tuned and remain frozen afterwards. Multiple attention heads are used in transformer-based large language models.
Grand modèle de langageUn grand modèle de langage, grand modèle linguistique, grand modèle de langue, modèle massif de langage ou encore modèle de langage de grande taille (LLM, pour l'anglais large language model) est un modèle de langage possédant un grand nombre de paramètres (généralement de l'ordre du milliard de poids ou plus). Ce sont des réseaux de neurones profonds entraînés sur de grandes quantités de texte non étiqueté utilisant l'apprentissage auto-supervisé ou l'apprentissage semi-supervisé.
Traitement automatique du langage naturelLe traitement automatique du langage naturel (TALN), en anglais natural language processing ou NLP, est un domaine multidisciplinaire impliquant la linguistique, l'informatique et l'intelligence artificielle, qui vise à créer des outils de traitement du langage naturel pour diverses applications. Il ne doit pas être confondu avec la linguistique informatique, qui vise à comprendre les langues au moyen d'outils informatiques.
Information extractionInformation extraction (IE) is the task of automatically extracting structured information from unstructured and/or semi-structured machine-readable documents and other electronically represented sources. In most of the cases this activity concerns processing human language texts by means of natural language processing (NLP). Recent activities in multimedia document processing like automatic annotation and content extraction out of images/audio/video/documents could be seen as information extraction Due to the difficulty of the problem, current approaches to IE (as of 2010) focus on narrowly restricted domains.
Prix NobelLe prix Nobel (Nobelpriset) est une récompense de portée internationale. Remis pour la première fois en 1901, les prix sont décernés chaque année à des personnes , par leurs inventions, découvertes et améliorations dans différents domaines de la connaissance, par l'œuvre littéraire la plus impressionnante, ou par leur travail en faveur de la paix, suivant ainsi les derniers vœux d'Alfred Nobel, inventeur de la dynamite. Au , les prix sont décernés pendant tout le mois d’octobre de chaque année.
Prix Nobel de physiquevignette|Le diplôme du Prix Nobel de Physique attribué pour moitié à Pierre et Marie Curie, l'autre moitié étant attribuée à Henri Becquerel, dont le nom figure sur la récompense attribuée au couple (1903). Le prix Nobel de physique est une récompense attribuée par la fondation Nobel, selon les dernières volontés du testament du chimiste Alfred Nobel. Il distingue des figures scientifiques éminentes ayant rendu de grands services à l'humanité par une œuvre et des travaux considérés comme une exceptionnelle contribution en physique.
Prix Nobel de physiologie ou médecineLe prix Nobel de physiologie ou médecine honore annuellement, selon les volontés du testament d'Alfred Nobel, des personnalités du monde médical et de la recherche en biologie dont l'œuvre a rendu de grands services à l'humanité. Le lauréat doit ainsi avoir apporté des savoirs inédits ou des techniques nouvelles dans le domaine. Le prix est attribué par l'assemblée Nobel, composée de cinquante professeurs de l'Institut Karolinska, à partir d'une liste de nominations proposées par le comité Nobel.
Prix de la Banque de Suède en sciences économiques en mémoire d'Alfred NobelLe prix de la Banque de Suède en sciences économiques en mémoire d'Alfred Nobel, communément surnommé « prix Nobel d'économie », est une distinction qui récompense chaque année une ou plusieurs personnes pour leur contribution exceptionnelle dans le domaine des sciences économiques. Créé et doté par la Banque de Suède en 1968, à l'occasion de son , le prix est décerné pour la première fois en 1969. C'est le seul prix géré par la Fondation Nobel qui n'a pas été créé par le testament d'Alfred Nobel.
Prix Nobel de la paixLe prix Nobel de la paix récompense selon les volontés, définies par le testament, d'Alfred Nobel. Cela comprend la lutte pour la paix, les droits de l'Homme, l'aide humanitaire et la liberté. Le prix de l'année peut être partagé entre deux, voire trois personnalités ou institutions ayant rendu de grands services à l'humanité par la voie diplomatique. Le prix Nobel de la paix a été attribué pour la première fois en 1901. Des récompenses ont été décernées en 1917, 1944 et 1945, mais le prix n'a pas été attribué les autres années des deux guerres mondiales.
Prix Nobel de littératureLe prix Nobel de littérature (Nobelpriset i litteratur en suédois) récompense annuellement, depuis 1901, un écrivain ayant rendu de grands services à l'humanité grâce à une œuvre littéraire qui, selon le testament du chimiste suédois Alfred Nobel, « a fait la preuve d'un puissant idéal ». Récompense considérée comme la plus prestigieuse et la plus médiatique au monde, le prix Nobel de littérature met en lumière un auteur et ses travaux. Il lui assure une promotion à l'échelle planétaire, une renommée internationale et une certaine aisance financière.
OpenAIOpenAI (« AI » pour artificial intelligence, ou intelligence artificielle) est une entreprise spécialisée dans le raisonnement artificiel, à « but lucratif plafonné », dont le siège social est à San Francisco. Avant , elle est reconnue association à but non lucratif. L'objectif de cette société est de promouvoir et de développer un raisonnement artificiel à visage humain qui profitera à toute l'humanité.
Intelligence artificielle générativeL'intelligence artificielle générative ou IA générative (ou GenAI) est un type de système d'intelligence artificielle (IA) capable de générer du texte, des images ou d'autres médias en réponse à des invites (ou "prompts"). Les modèles génératifs apprennent les modèles et la structure des données d'entrée, puis génèrent un nouveau contenu similaire aux données d'apprentissage mais avec un certain degré de nouveauté (plutôt que de simplement classer ou prédire les données).
Commonsense reasoningIn artificial intelligence (AI), commonsense reasoning is a human-like ability to make presumptions about the type and essence of ordinary situations humans encounter every day. These assumptions include judgments about the nature of physical objects, taxonomic properties, and peoples' intentions. A device that exhibits commonsense reasoning might be capable of drawing conclusions that are similar to humans' folk psychology (humans' innate ability to reason about people's behavior and intentions) and naive physics (humans' natural understanding of the physical world).
Application linéaireEn mathématiques, une application linéaire (aussi appelée opérateur linéaire ou transformation linéaire) est une application entre deux espaces vectoriels qui respecte l'addition des vecteurs et la multiplication scalaire, et préserve ainsi plus généralement les combinaisons linéaires. L’expression peut s’utiliser aussi pour un morphisme entre deux modules sur un anneau, avec une présentation semblable en dehors des notions de base et de dimension. Cette notion étend celle de fonction linéaire en analyse réelle à des espaces vectoriels plus généraux.
Alignement des intelligences artificiellesLalignement des intelligences artificielles (ou alignement de l'IA, ou encore problème de l'alignement) est un champ de recherche visant à concevoir des intelligences artificielles (IA) dont les résultats s'orientent vers les objectifs, éthiques ou autres, de leurs concepteurs. On dit ainsi qu'une IA est alignée avec un opérateur si elle essaie de faire ce que l'opérateur veut qu'elle fasse. Les systèmes d'IA peuvent être difficiles à aligner, et être dysfonctionnels ou dangereux si mal alignés.
Modèle de langageEn traitement automatique des langues, un modèle de langage ou modèle linguistique est un modèle statistique de la distribution de symboles distincts (lettres, phonèmes, mots) dans une langue naturelle. Un modèle de langage peut par exemple prédire le mot suivant dans une séquence de mots. Un modèle de langage n-gramme est un modèle de langage qui modélise des séquences de mots comme un processus de Markov. Il utilise l'hypothèse simplificatrice selon laquelle la probabilité du mot suivant dans une séquence ne dépend que d'une fenêtre de taille fixe de mots précédents.